🎵 音乐生成 · 模型发布

Google DeepMind 发布 Lyria 3.5:音乐生成模型四维同步升级,人声表现力直指深水区

7 月 29 日,DeepMind 发布最新音乐生成模型 Lyria 3.5,即日起在 Google Flow Music 上线。本次升级同步覆盖音乐性、歌词、人声、创意控制四个维度——其中人声的"情感细腻度与发音改善",直指音乐生成长期最难逼近的环节。

来源:官方发布 2026-07-29 全文约 2 分钟读完
#Google DeepMind #Lyria 3.5 #音乐生成 #Flow Music
4 维升级 音乐性 / 歌词 / 人声 / 创意控制 同步刷新
今日上线 Google Flow Music,即刻可用
官方通稿 单方披露,未见评测基准与对比数据

⚡ 30 秒速览

  • 发布了什么:Lyria 3.5,DeepMind 最新音乐生成模型,即日起在 Flow Music 上线。
  • 四维升级:音乐性(更复杂的旋律结构)、歌词(提示词遵循度+结构意识)、人声(表现力+发音)、创意控制(节奏与时长)。
  • 最值得关注:人声维度——更真实、情感更细腻、发音改善,这是音乐生成区别于"背景音乐生成"的分水岭。
  • 怎么读:官方博客通稿,所有"提升"均为自述,无评测基准、无量化对比、无第三方复测。
  • 去哪试:Google Flow Music,今日可用。

01四维升级具体改了什么 官方原话 + 编辑转译

DeepMind 在官方博客中逐项列出了四个升级方向。以下为原文引语与中文转译,所有描述均为官方自述,未附量化指标。

🎼 音乐性 Musicality

"Create richer, more complex melodic structures that sound more natural."
生成更丰富、更复杂的旋律结构,听感更自然。
编辑注:旋律"复杂"与"自然"长期互为矛盾——复杂易乱,自然易平。能否同时拿到两者,是音乐生成的老难题。

📝 歌词 Lyrics

"Generate higher quality lyrics with improved prompt adherence and structural awareness."
更高质量歌词,提示词遵循度提升,具备结构意识
编辑注:结构意识意味着模型开始"懂"歌曲段落语法(主歌/副歌/桥段),而非随机堆句。

🎤 人声 Vocals

"More realistic and emotionally nuanced vocals, plus improved pronunciation."
更真实、情感更细腻的人声,发音改善。
编辑注:人声是音乐生成最难的部分——音色易仿,情感难拟。这一维度被独立列出,本身就是信号。

🎛️ 创意控制 Creative Control

"More easily control the tempo and duration of your outputs."
更易控制输出的节奏与时长
编辑注:从"生成一段"到"按规格生成",是工具化与可商用的前提。

02为什么人声被单独列出 音乐生成的难度阶梯

音乐生成存在一条清晰的难度阶梯:旋律与歌词是符号系统,可被离散建模、逐 token 预测;而人声是连续时频信号,涉及音色、气息、咬字与情感微表情,是生成模型最难逼近的部分。

旋律歌词人声(情感 + 发音)

难度递增:从离散符号建模,走向连续情感信号逼近。

Lyria 3.5 将人声列为独立升级维度,并强调"情感细腻度"——这意味着模型开始触及音乐生成的真正深水区。此前多数音乐模型停留在"能生成一段背景音乐",而人声质量能否过关,决定了输出是"素材"还是"可发行作品"

另一个值得注意的信号是"创意控制"维度:节奏与时长可控,意味着生成结果开始具备规格化交付能力——这是从玩具走向工具的关键一步。

编辑视角 · 来源立场提示

本文核心信息来自 DeepMind 官方博客,属企业通稿。所有"提升""改善""更自然""更细腻"均为官方自述,未附评测基准、无量化对比数据、无第三方复测。官方亦未披露模型参数、训练数据或技术实现细节。读者宜将其作为产品预告而非独立评测来读——真实表现需待上手体验与社区实测。

行业判断:当人声情感细腻度成为卖点而非噱头,AI 音乐开始逼近"可发行作品"的门槛——版权归属与署名机制将成为下一轮不可回避的焦点。

现在就能用

Lyria 3.5 已在 Google Flow Music 上线,登录即可体验。

flow.google.com/music → Flow Music