OpenAI 正式在 API 中上线 GPT-Live-1 实时语音模型

📡 Greg Brockman2026-09-11 05:13

OpenAI 将 GPT-Live-1 实时语音模型引入 API,支持开发者构建低延迟、可边说边听的全双工语音应用。

AI 深度解读

OpenAI 正式在 API 中上线全双工实时语音模型 GPT-Live-1,通过端到端音频流与任务委派机制简化实时语音应用的构建流程。

  • OpenAI 联合创始人 Greg Brockman 于 2026 年 9 月 10 日通过社交平台宣布,GPT-Live-1 模型已正式面向 API 开发者开放。
  • 根据 OpenAI 官方开发者文档(2026-09-10),GPT-Live-1 采用全双工架构,支持在输出语音的同时持续监听输入,实现自然的实时打断与语气反馈。
  • 该模型主要负责实时语音交互层,支持将复杂推理、工具调用与检索任务委派(Delegation)给后台主力模型异步处理。
  • 官方定价显示其前端语音接入费用为每分钟 0.05 美元,支持集成于电话客服与实时语音助手等应用场景。
  • 影响/看点:该模型上线意味着开发者无需自行级联语音识别、文本大模型与语音合成三个独立环节,有望降低多轮对话应用的开发门槛,其实际应用成效取决于弱网环境下的延迟稳定性与高并发运行成本。
  • 资料依据:
  • OpenAI(2026-09-10):https://platform.openai.com/docs/guides/live
  • Greg Brockman (@gdb)(2026-09-10):https://x.com/gdb/status/2098157918906384676

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手