谷歌发布 Lyria 3.5 音乐生成模型,已上线 AI Studio 与 Gemini API
谷歌推出Lyria 3.5音乐生成模型,并在AI Studio与Gemini API上线,支持整曲与高保真人声生成。
AI 深度解读
谷歌于 2026 年 9 月初发布新一代音频生成模型 Lyria 3.5,并同步上线 Google AI Studio、Gemini 应用程序及 Gemini API,推进了音频生成技术的开发者可用性。
- 音频规格与编排能力:Lyria 3.5 支持生成 44.1 kHz 立体声音乐,在人声表达与多乐器编排结构上进行了优化,支持主歌、副歌与桥段等整首长曲目的生成与控制。
- 多模态输入与创作模板:模型支持文本提示词与图像作为引导输入,并针对背景音乐、商业广告短音效以及个性化曲目等场景提供了预设创作模板。
- 开发者接口与实时流式支持:除标准生成 API(按次收费,每请求约 0.08 美元)外,谷歌还提供面向低延迟流式交互的 Lyria RealTime 接口与短片段预览模型 Lyria 3.5 Clip。
- 影响/看点:音频模型接入通用 API 降低了互动媒体与内容创作团队的集成门槛,其能否在商业化生产中普及取决于长音频生成的可控性及版权合规保护机制。
- 资料依据:
- X:Testing Catalog(2026-09-04):https://x.com/testingcatalog/status/2095935152312434952
- Google 官方博客(2026-09-03):https://blog.google/technology/ai/google-lyria-3-5-music-generation/
- Google for Developers 官方文档(2026-09-04):https://ai.google.dev/gemini-api/docs/audio/lyria
本内容由 AI 生成,仅供参考,请注意甄别