OpenAI 发布非流式语音转录模型 GPT Transcribe

📡 Artificial Analysis2026-07-29 10:01

OpenAI发布非流式转录模型GPT Transcribe,词错误率3.31%排名第9,速度约达实时34倍。

AI 深度解读

OpenAI 推出了新一代非流式语音转录模型「GPT Transcribe」,在权威基准 AA-WER 上词错误率做到 3.31%、跻身第 9 名,较上一代模型提升了 0.7 个百分点,同时把价格打了下来。

  • 定位是非流式(批量)转录,适合处理已录制好的完整音频文件
  • 支持文本提示、关键词提示、多语言提示三种上下文输入方式,便于提升专有名词识别准确率
  • 处理速度约为实时的 34 倍,批量转写效率明显提升
  • 定价降至每千分钟音频 4.5 美元,相比同类产品更具成本优势
  • 对做播客转写、会议纪要、字幕生成等场景的开发者而言,精度和价格的双重优化让语音转文字这类基础能力进一步“商品化”,也在压缩专用转录服务商的空间。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com