7月29日,Google DeepMind正式发布了新一代AI音乐生成模型Lyria 3.5,并同步集成至Google Labs旗下的AI音乐创作工具Flow Music。相比此前的Lyria 3和Lyria 3 Pro,新模型在音乐性、歌词质量、AI人声和创作控制四个维度实现了系统性升级。

如果说之前的AI音乐生成还停留在“能写歌”的阶段,Lyria 3.5正在把它推向“会唱歌”的新高度。

Lyria 3.5最核心的升级在AI人声。新模型生成的人声拥有更自然、更具情绪表达力的演唱效果,同时发音准确率也得到了改善。这不是简单的音色模仿,而是让AI在演唱时能够传达出细腻的情感层次——欢快时有语气起伏,忧伤时有气息变化,让AI演唱更加接近真人的表现力。

Google DeepMind官方博文用了一组关键词来定义这次人声升级:更具表现力(more expressive)、更富动感(dynamic)。这意味着Lyria 3.5生成的歌声不再是一段单调的机器合成音,而是带有情绪张力、能够随着歌曲内容起伏变化的“活人声”。

在人声之外,Lyria 3.5的音乐性同样大幅提升。新模型能够生成结构更丰富、更复杂的旋律,同时改善了不同段落之间的衔接,让生成结果听起来更加自然。

简单说,Lyria 3.5创作的歌曲不再是简单重复的循环段落,而是有了更完整的起承转合——前奏、主歌、副歌、桥段之间的过渡更加流畅,歌曲编排更符合真实音乐创作逻辑。

对于包含明确曲风、情绪和编曲要求的提示词,新模型也能更准确地理解用户意图。你说“要一首慵懒的R&B”,它不会给你一段激昂的电子乐。

歌词层面,Lyria 3.5进一步提升了提示词遵循度(Prompt Adherence)和歌曲结构意识。相比只围绕关键词拼接内容的老思路,新模型会进一步处理歌词与歌曲段落、旋律走向之间的关系。

这意味着它能生成结构更合理、质量更高的歌词,在段落组织和整体连贯性方面都有明显改善。你输入一段关于“夏日离别”的提示,它给你的是一首有叙事逻辑的歌,而不是一堆跟“夏天”和“再见”有关的词拼在一起。

Lyria 3.5还赋予用户更精细的创作控制权。用户可以通过自然语言提示持续修改歌曲——调整旋律、重写歌词、更换风格、改变节奏,而无需每次重新生成整首歌曲。在Flow Music中,用户还可以单独调节人声、鼓点和贝斯等独立轨道,实现更精细的创作控制。

新模型还支持控制歌曲的BPM(节奏速度) 和生成长度,输出范围从30秒到3分钟。此外,还支持导出完整歌曲的音轨(stems)——这对需要后期混音的专业创作者来说是一个实用功能。

Lyria 3.5首发搭载于全新的AI音乐创作平台Google Flow Music。Flow Music提供了多项独特功能:修改曲目特定段落、重写或翻译歌词、更换乐器、在不改变歌曲其余部分的前提下调整节拍。

Google将Flow Music纳入AI订阅体系——AI Plus、AI Pro和AI Ultra会员分别对应不同权益档位。

AI音乐赛道上,Suno、Udio等初创公司已快速崛起,OpenAI也在多模态生成方面持续探索。谷歌此次发布Lyria 3.5时并未公布新的基准测试成绩,而是将升级重点放在人声质量、歌词创作和创作控制等用户体验层面——业内认为,这意味着谷歌希望进一步提升AI生成音乐的可用性,而非单纯追求模型性能指标。

从Lyria到Lyria 3,从Lyria 3 Pro到Lyria 3.5,Google DeepMind正在用一代代模型的迭代回答一个问题:AI到底能不能写出让人真正想听的歌? Lyria 3.5给出的答案是——能写,而且能唱出感情。