OpenAI 上线两款新转录模型 API:实时与批量场景各一
OpenAI上线GPT-Live-Transcribe与GPT-Transcribe两款转录模型API,分别面向实时与批量场景。
AI 深度解读
OpenAI 在 API 中同步上线了两款新的语音转录模型,分别针对实时场景和批量场景做了专门优化,进一步补齐其语音能力矩阵。
- GPT-Live-Transcribe 专为低延迟实时转录设计,适合直播、通话等即时场景
- GPT-Transcribe 则面向已完成的音频文件和批量任务,做异步优化处理
- 两款模型都在上下文理解上有所提升,能更准确处理跨口音、跨语言的真实音频
- 对短句、数字、专业术语及背景噪音较大的语音场景做了针对性优化
- 通过“实时+批量”双模型分工,OpenAI 把语音转录场景做了更精细的产品切分,对需要接入语音转文字能力的开发者而言,选型时可以按延迟需求直接对号入座。
本内容由 AI 生成,仅供参考,请注意甄别