Google Lyria 3.5 上线:AI 音乐生成迎来更强人声与创作控制
7月29日,Google DeepMind 正式发布 Lyria 3.5,这是其 AI 音乐生成模型的最新版本,已通过 Google Flow Music 平台面向用户开放。这次升级的核心卖点很直接:AI 生成的歌曲听起来更像人唱的,创作者对作品的控制也更细了。
四项关键升级
旋律更自然。 Lyria 3.5 能生成更复杂、更有层次感的旋律结构,不再像早期 AI 音乐那样"对但平淡",而是有了起承转合的音乐性。
歌词质量提升。 新模型对用户提示词的遵循度更高,歌词结构也更符合歌曲的常规编排(主歌-副歌-桥段),不再出现逻辑跳跃或结构散乱的问题。
人声表现力增强。 这可能是最被期待的改进。Lyria 3.5 的人声更真实、更有情感层次,发音也更清晰。简单说,AI 歌手不再只是"把字唱出来",而是开始有了情绪和语气。
创作控制更灵活。 用户现在可以直接控制生成曲目的速度(tempo)和时长,不用反复试运气来碰出想要的效果。
不只是生成,还能精修
Lyria 3.5 背后的 Flow Music 平台本身也在持续进化。它已经不只是"输入提示词、出一首歌"的简单工具,而是提供了更细粒度的编辑能力:
- 编辑单曲中的某个部分(比如只改副歌的旋律)
- 改写或翻译歌词
- 替换乐器音色
- 局部调整而不必重新生成整首曲子
这种"生成+精修"的工作流,对需要反复打磨作品的音乐创作者来说更实用。
赛道定位
AI 音乐生成赛道目前竞争激烈,Suno、Udio、MiniMax Music 2.6 都在不断迭代。Lyria 3.5 的差异化主要体现在两方面:
一是 Google 生态整合。Lyria 与 Google 的其他 AI 工具(如 Gemini、Veo)同属一个产品矩阵,未来在视频配乐、多模态创作等场景的联动空间更大。
二是 SynthID 水印和版权保护。Google 从 Lyria 初代就内置了 SynthID 音频水印技术,3.5 版本延续了这一机制。这在版权争议不断的 AI 音乐领域,是一个对创作者和版权方都更友好的信号。
谁能用、怎么用
Lyria 3.5 目前通过 [Google Flow Music](http://flowmusic.google/) 开放使用。适合的人群包括:
- 需要快速出配乐的短视频创作者和 YouTuber
- 独立游戏开发者(用 AI 生成 BGM 和主题曲)
- 想尝试音乐创作但没有专业背景的普通用户
- 需要草稿或灵感起点的专业音乐人
需要注意的限制
- 所有生成的音频都带有 SynthID 水印,无法去除
- 版权保护机制延续,不能用于模仿特定艺术家的声音或风格
- 目前仅通过 Flow Music 网页端使用,尚未开放独立 API
- 多语言支持方面,官方展示了包括日语在内的多语言生成能力,但具体支持语言列表未在公告中明确
---
*基于 Google 官方博客及多家媒体转述整理。官方博客原文:[blog.google](https://blog.google/innovation-and-ai/models-and-research/google-labs/lyria-3-5/);DeepMind 模型页:[deepmind.google](https://deepmind.google/models/lyria/);Gadgets360 报道:[原文链接](https://www.gadgets360.com/ai/news/google-lyria-3-5-ai-music-model-roll-out-flow-music-11843032)*