语音 AI 创企 Gradium 推出 Voice Design:仅凭提示词即可秒级生成全新合成语音
语音AI初创公司Gradium推出Voice Design功能,用户仅凭文本描述即可在数秒内生成全新的合成语音。
AI 深度解读
语音 AI 公司 Gradium 于 2026 年 9 月 9 日推出基于文本提示词直接生成合成语音的工具 Voice Design,因其摆脱了参考音频采样与版权清理流程而受到语音交互领域的关注。
- 提示词驱动生成:模型仅依靠 1 至 500 字符的自然语言描述(涵盖性别、年龄、口音、音色与应用场景)在 3 至 5 秒内生成全新的合成声音。
- 部署与接口集成:生成的声音可直接接入流式文本转语音(TTS)端点,享有与预设音库相同的响应延迟与音频输出格式。
- 配额与试听机制:每次生成 1 至 5 个候选样本供试听,系统对免费用户开放 5 个自定义语音槽位,付费方案支持最多 1000 个槽位。
- 影响/看点:该技术意味着语音合成从特定音色克隆转向按需角色定制,如果生成的语音一致性与自然度达到商用标准,将可能降低客服与多媒体配音的合规与制作门槛。
- 资料依据:
- MarkTechPost(2026-09-09):https://www.marktechpost.com/2026/09/09/gradium-launches-voice-design-write-a-prompt-get-a-brand-new-synthetic-voice-in-seconds/
- Gradium 官方技术文档(2026-09-09):https://docs.gradium.ai/voice-design
本内容由 AI 生成,仅供参考,请注意甄别