当 Suno 和 Udio 正在 AI 音乐赛道激烈竞争时,谷歌 DeepMind 悄然拿出了第三代大招。7月29日,谷歌正式发布Google Lyria 3.5,在音乐性、歌词生成、AI 人声和创作控制四个维度全面升级,并与旗下 AI 音乐创作平台 Google Flow Music 同步上线。与上一代 Lyria 3 相比,新版本生成的歌曲更像"歌",而非" Demo 片段"。

Lyria 3.5 此次升级最亮眼的突破在于人声表现。谷歌表示,新模型生成的人声更贴近真实演唱,情感层次更细腻,发音更准确——这恰恰是此前 AI 音乐最容易露馅的环节。配合 Flow Music 平台,用户可以单独调节人声、鼓点、贝斯等独立轨道,实现多轨道的精细混音控制。生成时长覆盖 30 秒至 3 分钟,覆盖从短视频配乐到完整歌曲的多场景需求。
一、四大升级:从"听起来不错"到"听起来像人唱"
在音乐性方面,Lyria 3.5 能够生成更加丰富、复杂的旋律结构,不同段落之间的衔接更加自然流畅,模型深层理解了音乐起承转合的逻辑,而非停留于简单的旋律循环。
歌词层面,新版本提升了提示词遵循度与歌曲结构意识。Lyria 3.5 生成的歌词不仅贴合风格描述,还能在整体结构上符合前奏、主歌、副歌、桥段的自然分布,解决了上一代模型歌词与音乐结构脱节的痛点。
创作控制精细化是另一个核心改进。新版本允许用户更便捷地调节曲目节奏和持续时间,有效减少生成结果在速度、结构和长度上偏离预期的概率。用户可单独替换人声音轨而不影响其他部分——这正是 Lyria 3.5 的核心创新:支持段落级编辑,用户可以仅针对某一段落重新生成,保持其余部分不变。
二、Google Flow Music:谷歌的 AI 音乐工作站
Lyria 3.5 已集成至 Google Labs 旗下的 AI 音乐创作平台 Flow Music。该平台提供多项编辑功能,包括修改曲目特定段落、重写或翻译歌词、更换乐器,以及在不破坏整曲结构的前提下调整节拍。用户可将生成的歌曲导出为 48kHz WAV 或 MP3 格式,用于商业发行、视频配乐或社交媒体发布。
对于 YouTube Shorts 创作者,Lyria 3.5 已直接集成至平台的 Dream Track 功能,创作者可在 Shorts 内直接生成 30 秒原创配乐,无需额外版权声明。Flow Music 还支持配套生成 AI 音乐视频(基于 Veo 视频模型),实现"词曲视"一体化输出。
在 AI 音乐赛道,谷歌正面对 Suno、Udio 等初创公司的快速崛起,以及 OpenAI 在多模态生成方面的持续探索。谷歌将 Flow Music 纳入 AI 订阅体系,AI Plus、AI Pro 和 AI Ultra 会员分别对应不同档位的使用配额,进一步巩固其在生成式创作领域的竞争力。
三、AI 音乐的"奥本海默时刻":创作民主化还是行业大洗牌
Lyria 3.5 的发布,让 AI 音乐赛道正式进入"三足鼎立"阶段:Suno 凭借先发优势和庞大的用户社区占据市场心智,Udio 依靠人声克隆等差异化功能抢占专业用户,而谷歌则凭借搜索、邮箱、YouTube 等生态的深度整合,试图在"工具+平台+分发"的全链条上建立壁垒。
对于普通创作者而言,Lyria 3.5 意味着无需掌握乐器演奏或复杂 DAW 操作,仅凭文字描述即可快速生成完整歌曲骨架,大幅降低了音乐创作门槛。但与此同时,AI 音乐对词曲作者、编曲人和音乐制作人的冲击也在加剧——当任何人都能在几分钟内生成一首"像样的"歌曲时,专业音乐人的价值如何重新定义?Lyria 3.5 的发布,或许正是 AI 音乐走向成熟的标志性节点。


