从零开始:音记AI 完整上手教程
一步步教你安装音记AI,选择合适的转录模型,导出你的第一份 AI 会议笔记,并理解本地转录与 AI 后端的隐私边界。
教程音记AI转录入门
这篇教程能帮你做什么
跟着走完,你会完成三件事:装好音记AI,挑一个适合你硬件的模型,从一段音频里拿到一份 AI 整理过的笔记。核心转录在本机完成,是否调用云端只取决于你后续选择的 AI 后端。
第一步:下载安装
音记AI 支持 macOS 和 Windows。去 audionote.app 下载最新版,登录账号并完成订阅授权后即可开始本地转录;本地转录本身不需要填写云端 API Key。
第二步:下载转录模型
第一次启动会提示你选一个模型下载。这是一次性的事情,下好之后所有转录都在本地跑。
选哪个模型?
| 模型 | 音记AI 模型文件大小 | 适合什么 |
|---|---|---|
| Tiny | 80MB | 快速试一下,老款机器也可以先从这里开始 |
| Base | 150MB | 轻量任务、短音频、临时笔记 |
| Small | 500MB | 日常会议、课程、访谈的起步选择 |
| Medium | 1.5GB | 更重视准确率、音频条件复杂的材料 |
| Large-v3 | 3.1GB | 质量优先、需要长期保存或反复引用的材料 |
| Large-v3 Turbo | 1.6GB | 希望保留大模型能力,同时更看重处理速度 |
这张表按音记AI使用的 whisper.cpp / GGML 模型文件大小整理。实际运行仍会占用内存或 GPU 资源,取决于设备、加速方式和参数;第一次选择时,可以先从 Small 或 Large-v3 Turbo 试起,老款机器先用 Tiny 或 Base 验证体验。下载一次之后就在本地了,之后可以离线使用。
第三步:转录第一个文件
- 点「文件转录」(或者直接把文件拖进去)
- 选文件——MP3、WAV、M4A、AAC、FLAC 都行,视频也可以
- 点「转录」
处理速度取决于模型、硬件、音频长度和音频质量。第一次使用时,可以先用一小段样本音频测试,再决定长期使用哪个模型。有进度条,不着急。
转完之后是带时间戳的全文,能识别说话人的话会自动标上,还有逐词高亮。
第四步:让 AI 帮你出笔记
音记AI 跟普通转录工具的区别在这:不用把文字复制到别的工具再去整理,你在应用里就能让它产出结构化的内容。
- 打开转录结果
- 点「AI 对话」
- 选一个预设:
- 摘要——把全文浓缩成几条要点
- 行动项——提取任务、截止时间和负责人
- 会议纪要——按标准格式整理
- 关键要点——抓出最重要的信息
- AI 会通过你配置的后端处理:Ollama、LM Studio 等本地模型在本机运行;云端 API 会把转录文本发送给对应服务。处理完成后会在侧边栏显示结果
如果选择本地 AI 后端,转录文本可以继续留在电脑里;如果选择云端 AI,转录文本会发送给对应服务。
第五步:导出或者继续编辑
转录结果和 AI 笔记可以导出成几种格式:
- Markdown——方便扔进 Notion、Obsidian
- SRT / VTT——视频字幕
- TXT——纯文本
- JSON——程序处理
也可以直接在内置编辑器里继续改,支持富文本、标签和搜索。
上手检查清单
| 步骤 | 检查点 |
|---|---|
| 安装 | 是否来自官网,是否能正常启动 |
| 模型 | 是否已下载到本地,是否能断网转录 |
| 第一次转录 | 是否能导入文件,是否能看到时间戳 |
| AI 笔记 | 是否确认使用的是本地后端还是云端 API |
| 导出 | 是否选择了适合目标工具的格式 |
接下来可以试试这些
- 实时转录——会议、课程边听边出文字
- 链接转录——贴一个 YouTube 或 Bilibili 链接直接出稿
- 文件夹监控——设好文件夹,新文件进去就自动转
- 系统音频转录——抓 Mac 上任何应用的声音直接转
这几个功能都会陆续有单独的教程。