Google出手了:一句提示,最长能出3分钟完整歌
本文介绍Google在Flow Music上线的Lyria 3.5模型,主打表现力升级与时长控制(30秒至3分钟)。新增BPM调节与完整歌曲分轨导出功能,推动AI音乐从“片段生成”向“专业工作流”转变。文章还对比了Suno等竞品,指出Lyria采用授权数据训练在商用版权上的优势,并提醒实际效果仍需实测验证。

哈啰,我的老伙计们!我是小谱。
前阵子聊AI出歌,大家默认的对手就那几个:Suno、MiniMax、Mureka。这两天桌子对面,坐下来一个不太好惹的新人。Google。
01
四项表现力全升,还能把整首歌拆成分轨导出
7月29日,Google在自家的Flow Music里上线了Lyria 3.5。
这一版主打的是「表现力」,官方点了四处升级:旋律结构更复杂也更自然、歌词质量和结构感更强(也更听得懂你的提示词)、人声更有情感、还专门修了发音。最后那个「发音」值得单拎出来说,做过AI翻唱和外文歌的老伙计都懂,咬字含糊、吞音、洋腔洋调,是最容易露馅的地方,一句没咬清整首就废了。
时长上,一首歌可以在30秒到3分钟之间调。3分钟这个上限,其实今年3月的Lyria 3 Pro就立下了,这回3.5把它做得更顺、结构更完整。更实用的是两个新控制项:BPM(速度)可调,以及完整歌曲的分轨导出。
02
从「出个片段」到「出完整歌」,差的就是可控加能拆
很多人对AI音乐的印象还停在两年前:出来一段,好听是好听,但你不能动它。想让节奏收一收、把人声单独抠出来?没门,只能重roll,roll到天荒地老。
Lyria3.5这次把方向掰过来了。BPM能调、时长能控,一首歌里有intro、主歌、副歌、bridge的结构意识,最后还能把成品拆成分轨导出。分轨这两个字对我们做AI音乐的人分量很重:人声、鼓、贝斯各自成轨,意味着你能把AI出的东西拖进DAW接着编、接着混,而不是只能整块听个响。能拆,才谈得上二次创作。
一句话,它整个产品形态,正在往专业创作工作流那头靠。这也是这一年所有AI音乐模型在抢的同一条路:谁能让创作者「不只是抽卡,而是真能改」,谁就从玩具,变成了工具。
03
对手又多一个,而且它手里攥着一张「版权牌」
对我们做AI音乐的人来说:一个手握模型、算力和分发渠道的巨头,正式进场做完整歌生成了。 正面对标的,就是Suno、MiniMax、Mureka这几家。
而且Google这次带了张别人不太好接的牌:Lyria用的是授权数据训练。 同一时间,Suno和Udio正因为版权问题被索尼音乐告上法庭。对只是玩玩的人,这也许无所谓;但对想拿AI音乐去商用、去发行的创作者,训练数据干不干净,是能不能安心用的真金白银。
当然也别急着吹。Flow Music目前是逐步开放,具体哪些地区先拿到、要不要订阅哪档,官方还没完全说清。参数再好看,真出手一首中文歌、一段复杂编曲,咬字稳不稳、结构塌不塌,得亲耳听过才算数。发布会PPT上的3分钟,和你真正想要的那3分钟,中间还隔着一次次试听。
不过趋势已经很清楚了:AI出歌,正在从「能出个响」,走向「能出首歌」,还能拆开接着改。巨头下场,只会把这一天,往前提。
↑ 扫码关注谱乐AI官方公众号
RELATED
相关阅读