Zoom / Teams / 腾讯会议本地实时转录指南
在电脑上捕获 Zoom、Microsoft Teams、Google Meet 或腾讯会议的声音,本地转成文字。不用会议机器人,也不把录音上传云端。
为什么需要实时转录
开会记笔记本身就有矛盾。要么漏听关键内容,要么记出一堆没法用的文字。实时转录的思路很直接:话说完,文字就出来了,你专心听就行。
音记AI 有三种实时模式,对应不同场景:
- 麦克风——录电脑内置或外接麦克风的声音
- 应用音频——录某个应用的声音(比如 Zoom、Teams、腾讯会议)
- 系统音频——录电脑正在播放的全部声音
Mac 和 Windows 都可以用。
会前准备
开会前
- 打开 音记AI,在侧边栏选「实时转录」
- 选音频来源:
- 在线会议(Zoom、腾讯会议、飞书等):选「应用音频」,然后在列表里选对应的会议应用
- 面对面会议:选「麦克风」
- 选模型。「流式模型」为了低延迟做了优化,一句话还没说完字就已经出来了
- 点「开始」
如果你需要评估延迟,建议用自己的会议设备录一段固定样本,观察文字出现时间和可接受程度。机器、模型和音频来源都会影响实时体验。
Zoom、Teams、Google Meet、腾讯会议
云端会议机器人会以参会者身份进房。本地捕获不会。你转写的是这台电脑已经在播放的声音,对面看不到多了一个 notetaker。
Zoom、Microsoft Teams、Google Meet、腾讯会议、飞书都可以按这个流程:
- 先在会议软件或浏览器里把会开起来
- 音记AI 里选「应用音频」,再选对应应用。列表里没有的话,改用「系统音频」
- 在你要记录的讨论开始前点开始。没有机器人等候室需要放行
- 自己这边不要把会议窗口静音。本地捕获的是播放出来的声音,不是对方的上传链路
应用音频通常比系统音频干净,因为不会把别的软件的音乐和通知录进去。会议开在浏览器里、列表里又没有独立应用时,再用系统音频。
权限因系统和会议软件而异。正式开会前先打两分钟测试。如果字幕一直是空的,多半是系统还没授权音频捕获。
开会中
- 文字自动滚动,可以随时暂停回看某段
- 点「标记」按钮标记重要时刻——会后可以快速定位到这些位置
- 说话人标签会自动出现(如果模型检测到不同声音)
- 你可以在转录文字旁边做笔记,不影响录音
会后整理
停止录音。音记AI 会保存完整的带时间戳的转录文本和标记位。然后:
- 点「AI 对话」,选「会议纪要」——自动整理成结构化的会议记录,包含参与人、讨论要点和结论
- 选「行动项」——提取任务和负责人
- 导出 Markdown 发给错过会议的人
几个实用的优化建议
音频质量影响最大
实时转录的准确率,输入音频的质量比模型选哪个影响更大。几个有用的做法:
- 面对面开会时优先用外接麦克风。笔记本内置麦克风可以应急,但外接设备通常更容易获得稳定输入
- 麦克风尽量靠近主要说话人,并避免正对空调、键盘和扬声器
- 在嘈杂环境中,打开 音记AI 设置里的降噪开关
说话人分离
安静的小型会议更容易校对说话人。人数更多或者环境嘈杂时,结果就没那么可靠了。一个实用的补救:转录后用编辑工具手动标注说话人。
会议时长
没有硬性限制。长会议会产生更长的转录文本,后续编辑、搜索和 AI 整理也会更依赖机器性能。重要会议建议按议题或时间段拆分,后期更容易校对。
隐私说明
整个实时转录过程在本地运行。音频通过 Whisper 或 Sherpa-ncnn 在这台电脑上处理,结果存在应用本地数据库里。录音不会发到转写服务器。这就是它和云端会议机器人的差别。