产品文档

模型与引擎总览

按 Whisper、实时模型与 Pro 高级 ASR 梳理 Audio Note 的模型选择、两条推理路线、套餐边界与延伸阅读。

模型与引擎总览

设置

转录设置总览截图

真实截图

本页术语(悬停查看说明):实时模型ML 引擎

这页解决什么问题

选模型前先分清三层:

  1. 工作流:文件转录、麦克风/应用实时、链接、监控文件夹等。
  2. 应用里的模型分类Whisper实时模型、Pro 的 ML 引擎高级 ASR 模型)。
  3. 加速方式:CPU、GPU(CUDA / Vulkan / CoreML),与所选模型相互独立。

本页是枢纽:不替代选型细节,而是把子文档串起来。

在应用里怎么选

设置里的分类更适合典型套餐深入阅读
Whisper(含社区)文件/链接/长音频、可调高级参数Free 六档;Standard 官方 11 个;Pro 含社区模型使用模型建议
实时模型麦克风/应用/全局实时、低 RTF;也可文件Standard 起(中英);Pro 多语言实时模型概念
ML 引擎(高级 ASR)离线文件、多语高精度仅 Pro(Qwen3-ASR、Cohere、Parakeet 等)高级 ASR 模型

实时模型ML 引擎 是设置里的两个分类:前者偏实时与低延迟,后者(Pro)偏离线文件高精度。

套餐与能力对照(摘要)

与桌面端权益真源对齐的摘要(细节以应用内为准):

能力FreeStandardPro
Whisper 模型Tiny~Small 六档官方 11 个官方 + 社区全部
实时转录 / GPU不可用可用;GPU;实时预设可用;GPU;实时自定义参数
实时模型语言中文、英文多语言实时模型
高级 ASR(ML 引擎分类)全部可用模型
录制应用期望帧率可选上限应用内较高档位应用内最高档位(实际帧率见录制文档)
应用实时视频归档支持

完整权益列表见价格页;若有差异以应用内提示为准。

和 GPU 的关系

  • Whisper 文件/实时在 Standard 及以上可开 GPU(Free 仅 CPU)。
  • 实时模型通常不依赖独显,更关注 CPU 与延迟。
  • 实时模型ML 引擎 分类下的模型有各自的引擎与下载项,与 Whisper GPU 包不同。

Windows NVIDIA 用户请同时阅读 NVIDIA 显卡与 CUDA 兼容性GPU 转录

常见问题

可以先只下载一种模型吗?
可以。在设置里按需下载 Whisper、实时模型或高级 ASR 模型,未下载的不会占用空间。

Pro 的高级 ASR 和 Whisper Large 怎么选?
Whisper 生态成熟、社区模型多;高级 ASR 适合 Pro 用户尝试特定多语离线包。见 高级 ASR 模型

调参应该看哪页?
高级参数转录,再按路线查 分引擎参数说明

下一步阅读

Whisper大模型驱动 - 音视频秒转文字,声波流式转录,让每个声音都成篇章

Contact us

Email
Copyright © 2026. Made by AudioNote, All rights reserved.