DeepMind Lyria 3.5 发布:音乐生成在歌词、人声与创作控制上实现全面突破
7 月 29 日,Google DeepMind 发布最新音乐生成模型 Lyria 3.5,在音乐性、歌词质量、人声表现和创作控制四个维度实现显著提升,即日起在 Google Flow Music 平台上线。这是目前 DeepMind 在音乐生成领域能力最全面的版本。
7 月 29 日,Google DeepMind 发布最新音乐生成模型 Lyria 3.5,在音乐性、歌词质量、人声表现和创作控制四个维度实现显著提升,即日起在 Google Flow Music 平台上线。这是目前 DeepMind 在音乐生成领域能力最全面的版本。
从 Lyria 3.0 到 3.5,DeepMind 在音乐生成的四个核心维度上完成了系统性升级。这不是单一指标的提升,而是创作体验的全面重构。
对比基于官方发布信息整理。每个维度的提升幅度因创作场景而异,实际体验建议在 Flow Music 中实测。
Lyria 3.5 的四个核心能力并非孤立存在,而是相互协同,共同构成一个更完整的音乐创作系统。
更丰富的旋律结构、更复杂的和声编排,输出听起来更自然、更有音乐性。
更高品质的歌词生成,更好的提示词遵循与结构意识,押韵与节奏更精准。
更丰富的情感表达与更真实的声音表现,发音清晰度显著提升,歌声更具感染力。
更精确地控制节奏与时长,让创作者在生成过程中拥有更多主导权与自由度。
能力标签基于官方发布描述提炼,每个维度下的具体能力点在实际使用中可组合调用。
「生成一段 2 分钟的氛围音乐,适合阅读时播放,钢琴为主,轻柔舒缓。」——Lyria 3.5 精确控制时长与风格,一次性生成可直接使用的背景音乐。
「把第二段副歌的歌词改得更押韵,情绪更热烈一些。」——模型理解局部修改意图,保持整体结构不变,只调整目标段落。
「把这首民谣改成爵士风格,保留歌词和旋律轮廓。」——Lyria 3.5 对风格指令的理解更精准,创作者可以快速探索不同编曲方向。
答案藏在 DeepMind 在音乐 AI 领域近十年的持续投入里。从早期的 WaveNet 语音合成,到 MusicLM 文本到音乐生成,再到 Lyria 系列的专业化迭代——DeepMind 在音乐理解与生成上积累了深厚的技术底座。
Lyria 3.5 的四个维度升级,本质上是三个核心能力的协同突破:声学建模(人声真实感)、语言理解(歌词结构与提示遵循)、音乐理论(旋律与和声编排)。将这三者融合到一个统一的生成框架中,是 DeepMind 独有的技术整合能力。
一个诚实的注脚:
音乐生成领域并非只有 DeepMind 一家在推进。但 Lyria 3.5 选择的路径——在创作控制上做加法,在生成门槛上做减法——代表了当前行业的主流方向:让 AI 从"黑盒生成"走向"可协作的创作伙伴"。
AI 音乐生成的下一个竞争焦点,不是"谁的声音更像真人",而是"谁能让创作者在生成过程中拥有更多话语权"。
Lyria 3.5 即日起在 Google Flow Music 平台上线,可直接在网页端与移动端体验。
Google Flow Music → 开始创作