Meta 推出首个实时音频感知模型 Muse Voice Transcribe。它为 Mac 版 Meta AI、Muse Code 以及通过 Meta Model API 接入的开发者带来多语言流式转写。
Muse Voice Transcribe 驱动 Mac 全系统听写
Meta Superintelligence Labs 表示,Muse Voice Transcribe 把流式自动语音识别、说话人分离和端点检测合在一起。
实际使用中,它能边说边转写,在超过 20 个说话人的录音里分开各人声音,并判断对方何时说完,全程不用额外后处理。
模型训练覆盖 70 多种语言,发布时已验证 25 种。它支持超过一小时的音频,也能处理句内或句间的语码转换。语言、关键词和上下文偏置还能进一步提升识别效果。
Muse Voice Transcribe 不会在速度和准确度之间固定取舍,而是自行决定听多久再输出每个词。Meta 称之为“自适应延迟”。简单的话可以更快落字,难词则会多听一点上下文再确认。

Meta 称,截至 9 月 1 日,该模型在 Artificial Analysis 流式语音转文字榜单上排名第一。
Muse Voice Transcribe 即日起可通过 Meta Model API 使用,价格为每 1000 音频分钟 3 美元,约合每小时 0.18 美元。
它也已接入 Mac 版 Meta AI 和 Muse Code 的听写功能。在 Mac 上,按住 Fn 键就能向任意应用听写。
可在此了解 Muse Voice Transcribe 的更多信息。
近期 Meta AI 相关报道:
- Meta AI 获得有限的 CarPlay 支持
- Meta AI 登陆 Mac
- Meta 推出 Muse Code
让你的苹果设备更好用
Apple AirTag 2 | 给钥匙、包、自行车等加上查找网络追踪
AirPods 4 | 苹果最新无线耳机
AirPods Pro 3 | 苹果最好的无线耳机
Beats USB-A to USB-C 线缆 | 官方 CarPlay 线
无线 CarPlay 转接器 | 不用再插线
Withings Body Comp | 最适合对接 Apple 健康的智能体脂秤
















