语音转录
Qwen3-ASR 支持的语言与方言
安装端侧 Qwen3-ASR 模型,查看官方支持的 30 种全球语言与 22 种中文方言口音列表。
Kapinote 内置了对阿里开源的 Qwen3-ASR 0.6B 本地端侧模型的开箱即用支持。模型权重一键下载到本机后,转录全程在 Mac 上独立运行,完全不消耗云端额度,也不会将任何音频数据传出设备。
下载与配置步骤
- 打开 设置 → 语音。
- 转录模型下拉选择 Qwen3-ASR 0.6B。
- 点击开始下载模型(大小约 1.2 GB),保持 Kapinote 开启直至下载校验完成。
- 在语言偏好中指定预期语言(或选择自动),然后点击运行内置测试。
- 试录一段包含你日常工作口音和专业词汇的音频,验证识别效果。
提示: 首次下载需要稳定的网络连接与至少 2 GB 的可用磁盘空间。本地实时转录速度取决于 Mac 的 Apple 芯片规格(M 系列统一内存与 GPU 算力)。
官方支持的 30 种全球语言
根据 Qwen3-ASR 官方模型库规范,该模型针对以下 30 种主要语言进行了深度训练与识别优化:
| 语种与代码 | 语种与代码 | 语种与代码 | 语种与代码 |
|---|---|---|---|
中文 (zh) | 英语 (en) | 粤语 (yue) | 阿拉伯语 (ar) |
德语 (de) | 法语 (fr) | 西班牙语 (es) | 葡萄牙语 (pt) |
印度尼西亚语 (id) | 意大利语 (it) | 韩语 (ko) | 俄语 (ru) |
泰语 (th) | 越南语 (vi) | 日语 (ja) | 土耳其语 (tr) |
印地语 (hi) | 马来语 (ms) | 荷兰语 (nl) | 瑞典语 (sv) |
丹麦语 (da) | 芬兰语 (fi) | 波兰语 (pl) | 捷克语 (cs) |
菲律宾语 (fil) | 波斯语 (fa) | 希腊语 (el) | 匈牙利语 (hu) |
马其顿语 (mk) | 罗马尼亚语 (ro) |
官方支持的 22 种中文方言与口音
Qwen3-ASR 具备强大的中文方言适应力,官方原生支持 22 类地域方言与特色口音:
- 北方与中原方言区: 东北话、河北话、天津话、山东话、河南话、陕西话、山西话
- 西南与华中方言区: 四川话、湖北话、湖南话、贵州话、云南话、江西话、安徽话
- 西北方言区: 甘肃话、宁夏话
- 南方与东南方言区: 粤语(香港口音)、粤语(广东口音)、吴语、闽南语、福建话、浙江话
语言与方言支持代表模型具备该声学特征的识别能力。实际转录准确率仍受录音信噪比、麦克风距离、多人抢话及专业词汇复杂度影响。更多模型技术细节可参阅 Qwen3-ASR 官方 GitHub 仓库。
提升本地转录质量的技巧
- 优化收音环境: 尽量佩戴耳机或让麦克风靠近发言者,减少房间回声与键盘敲击杂音。
- 减少语料歧义: 若会议以单一语种为主,在设置中手动指定语言(如中文或英文),避免模型在多语种判定上产生瞬时犹豫。
- 结合自定义词库: 将公司专有词、客户姓名与英文缩写录入 自定义词汇。虽然本地 Qwen 转录在声学层面独立运行,但词汇表会在后续 AI 笔记与总结阶段作为提示词补充,确保笔记拼写绝对精准。