谷歌发布Gemini 3.8 Live端到端语音模型:以更低成本叫板OpenAI

📡 The Decoder2026-09-16 02:23

谷歌发布Gemini 3.8 Live语音模型,在语音评测中登顶,并以每小时1.38美元的低定价对标OpenAI。

AI 深度解读

Google DeepMind 于 2026 年 9 月 15 日正式发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 端到端语音模型,以低成本和高推理定位进入实时语音交互开发者市场。

  • 性能评测方面,根据评测机构 Artificial Analysis 截至 2026 年 9 月 15 日的公开榜单,Gemini 3.8 Live Extended Thinking 在语音对语音质量指数中位居榜首。
  • 成本结构方面,该模型双向语音对话的核算成本约为每小时 1.38 美元,明显低于市场上 OpenAI GPT-Live-1 等同类产品的参考成本。
  • 模型采用原生音频端到端处理架构,并提供 Extended Thinking 版本以支持多步骤语音逻辑推理任务。
  • 行业分析指出,尽管价格具有竞争力,但在全双工交互的拟真度与自然对话流方面仍需接受实际应用验证。
  • 影响/看点:若原生语音模型的单位调用成本持续走低,将促进实时语音助手在企业客服与生产力场景的普及,但其实际体验仍取决于弱网环境下的低延迟表现与即时打断处理效果。
  • 资料依据:
  • The Decoder(2026-09-15):https://the-decoder.com/google-launches-gemini-3-8-live-to-take-on-openais-gpt-live-1-at-a-fraction-of-the-cost/
  • Google(2026-09-15):https://blog.google/technology/ai/gemini-3-8-live

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手