产品文档
模型与引擎总览
按 Whisper、实时模型与 Pro 高级 ASR 梳理 Audio Note 的模型选择、两条推理路线、套餐边界与延伸阅读。
模型与引擎总览
设置
转录设置总览截图
本页术语(悬停查看说明):实时模型ML 引擎
这页解决什么问题
选模型前先分清三层:
- 工作流:文件转录、麦克风/应用实时、链接、监控文件夹等。
- 应用里的模型分类:Whisper、实时模型、Pro 的 ML 引擎(高级 ASR 模型)。
- 加速方式:CPU、GPU(CUDA / Vulkan / CoreML),与所选模型相互独立。
本页是枢纽:不替代选型细节,而是把子文档串起来。
在应用里怎么选
| 设置里的分类 | 更适合 | 典型套餐 | 深入阅读 |
|---|---|---|---|
| Whisper(含社区) | 文件/链接/长音频、可调高级参数 | Free 六档;Standard 官方 11 个;Pro 含社区模型 | 使用模型建议 |
| 实时模型 | 麦克风/应用/全局实时、低 RTF;也可文件 | Standard 起(中英);Pro 多语言实时模型 | 概念 |
| ML 引擎(高级 ASR) | 离线文件、多语高精度 | 仅 Pro(Qwen3-ASR、Cohere、Parakeet 等) | 高级 ASR 模型 |
实时模型与 ML 引擎 是设置里的两个分类:前者偏实时与低延迟,后者(Pro)偏离线文件高精度。
套餐与能力对照(摘要)
与桌面端权益真源对齐的摘要(细节以应用内为准):
| 能力 | Free | Standard | Pro |
|---|---|---|---|
| Whisper 模型 | Tiny~Small 六档 | 官方 11 个 | 官方 + 社区全部 |
| 实时转录 / GPU | 不可用 | 可用;GPU;实时预设 | 可用;GPU;实时自定义参数 |
| 实时模型语言 | — | 中文、英文 | 多语言实时模型 |
| 高级 ASR(ML 引擎分类) | — | — | 全部可用模型 |
| 录制应用期望帧率可选上限 | — | 应用内较高档位 | 应用内最高档位(实际帧率见录制文档) |
| 应用实时视频归档 | — | — | 支持 |
完整权益列表见价格页;若有差异以应用内提示为准。
和 GPU 的关系
- Whisper 文件/实时在 Standard 及以上可开 GPU(Free 仅 CPU)。
- 实时模型通常不依赖独显,更关注 CPU 与延迟。
- 实时模型与 ML 引擎 分类下的模型有各自的引擎与下载项,与 Whisper GPU 包不同。
Windows NVIDIA 用户请同时阅读 NVIDIA 显卡与 CUDA 兼容性 与 GPU 转录。
常见问题
可以先只下载一种模型吗?
可以。在设置里按需下载 Whisper、实时模型或高级 ASR 模型,未下载的不会占用空间。
Pro 的高级 ASR 和 Whisper Large 怎么选?
Whisper 生态成熟、社区模型多;高级 ASR 适合 Pro 用户尝试特定多语离线包。见 高级 ASR 模型。
调参应该看哪页?
先 高级参数转录,再按路线查 分引擎参数说明。
下一步阅读
- 按任务选型:使用模型建议
- 高级 ASR 专页:高级 ASR 模型
- 显卡与 CUDA:NVIDIA 显卡与 CUDA 兼容性