谷歌音乐生成模型 Lyria 3.5 正式接入 Gemini 与 API
谷歌宣布在Gemini及开发者API中上线音乐生成模型Lyria 3.5,支持生成数分钟的完整歌曲。
AI 深度解读
谷歌宣布将音乐生成模型 Lyria 3.5 接入 Gemini 应用与开放 API,标志着其音频生成能力从实验性工具转变为面向公众与开发者的通用多模态服务。
- 开放的模型包含用于生成 30 秒片段的 Lyria 3 Clip,以及支持生成数分钟完整结构歌曲的 Lyria 3.5。
- 模型支持文本与最多 10 张图像联合输入,能够依据视觉画面与文本提示协同创作音乐。
- 音频默认输出 MP3 格式且 Lyria 3.5 支持 WAV 格式,所有音频均嵌入抗压缩、抗重采样的 SynthID 隐形水印以支持版权溯源。
- 影响/看点:多模态图像配乐与完整曲目生成能力的 API 化可能降低音视频制作的配乐门槛,其实际商业应用取决于商用版权授权条款与音质表现。
- 资料依据:
- IT之家(2026-09-05):https://www.ithome.com/0/998/647.htm
- Google AI Studio 文档(2026-09-05):https://ai.google.dev/gemini-api/docs/audio-generation
本内容由 AI 生成,仅供参考,请注意甄别