🎵 音乐生成 · 模型发布

DeepMind Lyria 3.5 发布:音乐生成在歌词、人声与创作控制上实现全面突破

7 月 29 日,Google DeepMind 发布最新音乐生成模型 Lyria 3.5,在音乐性、歌词质量、人声表现和创作控制四个维度实现显著提升,即日起在 Google Flow Music 平台上线。这是目前 DeepMind 在音乐生成领域能力最全面的版本。

综合公开信息整理 2026-07-29 全文约 3 分钟读完
#DeepMind #Lyria3.5 #AI音乐生成 #GoogleFlowMusic #音乐创作
4 项 核心突破:音乐性·歌词·人声·创作控制
3.5 最新版本 · 从 Lyria 3.0 全面升级
🎯 今日上线 · Google Flow Music 平台

⚡ 30 秒速览

  • 音乐性提升:更丰富的旋律结构与和声编排,输出更自然流畅,音乐表现力明显增强。
  • 歌词质量飞跃:更好的提示词遵循与结构意识,押韵与节奏更精准,歌词创作更可控。
  • 人声情感表达:更真实的情感表现力与发音清晰度,歌声更具感染力,接近真人演唱。
  • 创作控制增强:精确控制节奏、时长与风格,让创作者在生成过程中拥有更多主导权。

01能力进化 Lyria 3.0 → 3.5 四个维度全面升级

从 Lyria 3.0 到 3.5,DeepMind 在音乐生成的四个核心维度上完成了系统性升级。这不是单一指标的提升,而是创作体验的全面重构。

Lyria 3.0

  • 旋律结构基础,偶尔缺乏自然感
  • 歌词生成质量一般,提示词遵循有限
  • 人声偏合成感,情感表现力不足
  • 节奏与时长控制能力有限

Lyria 3.5

  • 丰富旋律 + 复杂和声,自然流畅
  • 高质量歌词,强提示遵循 + 结构意识
  • 真实情感人声,发音清晰,富有感染力
  • 精确控制节奏 / 时长 / 风格

对比基于官方发布信息整理。每个维度的提升幅度因创作场景而异,实际体验建议在 Flow Music 中实测。

02能力图谱 四个维度的具体能力拆解

Lyria 3.5 的四个核心能力并非孤立存在,而是相互协同,共同构成一个更完整的音乐创作系统。

🎵 音乐性

更丰富的旋律结构、更复杂的和声编排,输出听起来更自然、更有音乐性。

旋律丰富 和声复杂 自然流畅

📝 歌词

更高品质的歌词生成,更好的提示词遵循与结构意识,押韵与节奏更精准。

提示遵循 结构意识 押韵精准

🎤 人声

更丰富的情感表达与更真实的声音表现,发音清晰度显著提升,歌声更具感染力。

情感表达 发音清晰 音色真实

🎛️ 创作控制

更精确地控制节奏与时长,让创作者在生成过程中拥有更多主导权与自由度。

节奏控制 时长精确 风格引导

能力标签基于官方发布描述提炼,每个维度下的具体能力点在实际使用中可组合调用。

03它到底能做什么?三个真实创作场景

🎹 专业音乐人:从动机到 demo 的全流程加速创作效率提升

  • 设置好节奏与风格方向,Lyria 3.5 生成完整的旋律动机与和弦进行作为起点。
  • 输入歌词主题与段落结构,模型输出结构完整的歌词(主歌 / 副歌 / 桥段)。
  • 选择人声风格(温暖 / 明亮 / 沙哑等),生成情感丰富的演唱音轨。
  • 最终输出可直接用于 demo 制作,大幅缩短从灵感 to 小样的周期。
Lyria 3.5 的价值不是替代创作者,而是将"从 0 到 1"的启动成本降至接近零。

🎬 内容创作者:为视频精准配乐时长精确到秒

  • 指定视频时长与情绪关键词(如「3 分 20 秒,温暖治愈」),模型精确控制输出长度。
  • 选择纯音乐或带哼唱版本,Lyria 3.5 自动匹配情绪曲线与节奏变化。
  • 可反复调整风格参数(如「更轻快」或「更舒缓」),每次生成都保持时长一致。
  • 输出直接用于视频配乐,无需后期裁剪适配。
时长精确控制是 Lyria 3.5 相比前代最实用的升级之一,直接解锁了音视频同步创作场景。

🎶 业余爱好者:一句话生成一首完整歌曲零门槛创作

  • 输入简单的描述(如「一首关于夏天的民谣,节奏轻快」),模型自动生成歌词与旋律。
  • 可选择不同的演唱风格与编曲配器,实时试听并调整。
  • 支持反复修改歌词与旋律片段,保持整体风格一致。
  • 快速生成一首完整的个人歌曲,可直接分享或导出。
降低了音乐创作的门槛,让没有乐理知识的用户也能表达自己的音乐想法。

04日常创作,一句话就能开始

🎧

快速生成背景音乐

「生成一段 2 分钟的氛围音乐,适合阅读时播放,钢琴为主,轻柔舒缓。」——Lyria 3.5 精确控制时长与风格,一次性生成可直接使用的背景音乐。

✍️

歌词协作改稿

「把第二段副歌的歌词改得更押韵,情绪更热烈一些。」——模型理解局部修改意图,保持整体结构不变,只调整目标段落。

🔄

风格迁移实验

「把这首民谣改成爵士风格,保留歌词和旋律轮廓。」——Lyria 3.5 对风格指令的理解更精准,创作者可以快速探索不同编曲方向。

05为什么是 DeepMind 做出来了?

答案藏在 DeepMind 在音乐 AI 领域近十年的持续投入里。从早期的 WaveNet 语音合成,到 MusicLM 文本到音乐生成,再到 Lyria 系列的专业化迭代——DeepMind 在音乐理解与生成上积累了深厚的技术底座。

Lyria 3.5 的四个维度升级,本质上是三个核心能力的协同突破:声学建模(人声真实感)、语言理解(歌词结构与提示遵循)、音乐理论(旋律与和声编排)。将这三者融合到一个统一的生成框架中,是 DeepMind 独有的技术整合能力。

一个诚实的注脚:

音乐生成领域并非只有 DeepMind 一家在推进。但 Lyria 3.5 选择的路径——在创作控制上做加法,在生成门槛上做减法——代表了当前行业的主流方向:让 AI 从"黑盒生成"走向"可协作的创作伙伴"。

声学建模+ 语言理解+ 音乐理论 统一生成框架
编辑核心判断

AI 音乐生成的下一个竞争焦点,不是"谁的声音更像真人",而是"谁能让创作者在生成过程中拥有更多话语权"。

现在就能用

Lyria 3.5 即日起在 Google Flow Music 平台上线,可直接在网页端与移动端体验。

Google Flow Music → 开始创作