Meta AI 推出 muse voice transcribe 语音转写模型,速度达 Whisper 十倍
Meta AI 推出语音转写模型 muse voice transcribe,转写速度达 Whisper 的十倍且准确率更高。
AI 深度解读
Meta AI 推出专用语音转写模型 muse voice transcribe,其推理速度与识别精度表现引发业内关注,为高并发语音转写与实时交互场景提供了新的模型选择。
- Scale AI 创始人 Alexandr Wang 于 2026 年 9 月 16 日披露,Meta AI 推出的 muse voice transcribe 语音转写模型在推理速度上接近 OpenAI Whisper 最强版本的十倍。
- 测评反馈显示该模型在字错率(WER)等准确率指标上亦优于对照模型。
- 该模型针对语音特征编码与推理流水线进行了专门优化,旨在兼顾长音频快速转录与低延迟转写需求。
- 影响/看点:推理效率提升近十倍意味着部署成本可能显著降低,若该模型开放权重或 API 服务,可能促使更多实时会议转录与语音智能体项目完成底层转写引擎的迁移。
- 资料依据:
- X:Alexandr Wang(2026-09-16):https://x.com/alexandr_wang/status/2100244841670258901
- Meta AI(2026-09-16):https://ai.meta.com/research/publications/muse-voice-transcribe/
本内容由 AI 生成,仅供参考,请注意甄别