Artificial Analysis 评测微软新语音模型 MAI-Transcribe-2:错误率仅 2.0%

📡 Artificial Analysis2026-09-03 22:36

Artificial Analysis 评测显示微软 MAI-Transcribe-2 语音转录模型错误率降至 2.0%,位列榜单前列。

AI 深度解读

微软 AI 团队于 2026 年 9 月 3 日发布语音识别模型 MAI-Transcribe-2,其在公开基准测试中展现出高精度与高吞吐特性,反映出语音转录领域在速度与成本维度的进一步优化。

  • 评测指标:在评测机构 Artificial Analysis 的 AA-WER 语音识别榜单中,该模型以 2.0% 的词错误率位列第二,达到约 411 倍实时处理速度。
  • 功能特性:据微软官方文档介绍,模型支持多语种语码混合识别、说话人日志分离、字级时间戳定位以及逐字与平滑两种转录风格切换。
  • 商业定价:微软公布的 API 接入价格为每小时音频 0.10 美元,面向会议记录、医疗文书及无障碍字幕等长音频场景。
  • 影响/看点:高并发与低成本语音转录模型的普及可能加速企业级音视频分析流程的自动化,但其实际生产可用性仍需在多方言混合、高背景噪声等现实复杂声学环境中接受检验。
  • 资料依据:
  • Microsoft AI(2026-09-03):https://microsoft.ai/news/mai-transcribe-2
  • X:Artificial Analysis(2026-09-03):https://x.com/ArtificialAnlys/status/2095521214777442546

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手