谱乐AI接入开源音乐模型ACE-Step 1.5:速度、质量与可控性提升
谱乐AI已正式接入开源AI音乐基础模型ACE-Step 1.5,该模型由ACE Studio与StepFun联合推出。ACE-Step 1.5以其极快的生成速度、更完整的音乐结构和强大的可控性在AI音乐圈备受关注。它采用LM + Diffusion Transformer架构,支持商业使用和消费级硬件运行,为AI音乐创作带来了新的可能性。

最近 AI 音乐圈,有一个名字被频繁提起:ACE-Step 1.5。很多开发者甚至把它称为:“音乐版 Stable Diffusion 时刻。”可以说它是目前 最接近真正产品级能力的开源 AI 音乐模型之一。
而现在,一个好消息来了:谱乐AI 已正式接入 ACE-Step 1.5。现在在谱乐AI里,就可以直接体验这个被很多 AI 开发者疯狂讨论的新模型。

今天我们就来聊聊:ACE-Step 1.5,到底厉害在哪?
ACE-Step 1.5 是什么?
ACE-Step 1.5 是一个开源 AI 音乐基础模型,由 ACE Studio 与 StepFun 联合推出。 它的目标非常明确:做一个可以真正进入创作流程的 AI 音乐“基础设施”。
与很多只做简单生成的模型不同,ACE-Step 的定位更像是:音乐生成的基础模型(Music Foundation Model),它不是只给某个平台用,而是任何开发者、任何产品都可以基于它做自己的音乐工具。
也就是说,它不是只会“生成一段音乐”,而是可以成为:AI 作曲工具、AI 音乐编辑工具甚至是AI 音乐制作引擎。现在很多开发者正在基于它构建自己的音乐产品。
它为什么在 AI 音乐圈爆火?
原因其实很简单:它同时解决了 AI 音乐的三个最常被吐槽问题。速度、质量、可控性。

1️⃣ 生成速度极快
在 ACE-Step 1.5 中,生成一首 4 分钟歌曲只需约 20 秒(A100 GPU),在消费级 GPU 上也能快速生成音乐 。这意味着创作者可以:不断试错、快速迭代灵感。创作效率直接翻倍。
2️⃣ 音乐结构更完整
很多 AI 音乐会出现一个问题:听起来像拼接的片段。而 ACE-Step 的设计目标之一,就是解决这个问题。它能够保持:旋律连续性、节奏稳定性、和声结构一致。整体音乐听起来更像一首真正的完整作品。
3️⃣ 控制能力更强
ACE-Step 1.5 不只是“生成音乐”,它还提供了一整套音乐编辑能力,例如:
- AI 翻唱生成
- 音频重绘(修改某一段音乐)
- 人声 → 伴奏转换
- 音轨分离
- 音乐续写与扩展
这些能力让 AI 音乐从 “随机生成” 变成 “可控创作”。
它的技术路线也很特别
ACE-Step 1.5 的技术思路很有意思,它采用了一种比较新的架构:LM + Diffusion Transformer。
简单理解就是:很多 AI 生成音乐,其实是“边想边唱”。想到哪儿唱到哪儿,所以有时候会出现一种感觉——旋律是好听的,但整首歌像是临时拼出来的。
ACE-Step 在真正生成音乐之前,它会先把整首歌的大方向想清楚,比如:
这首歌是什么情绪?是轻快、热血,还是有点伤感?
结构大概怎么走?哪里是主歌,哪里是副歌?
歌词表达的核心是什么?
等这些想明白之后,它才开始把音乐一点点生成出来。你可以把这个过程想象成写歌:先把 故事和结构搭好,再去 填旋律和声音细节。
这样做的好处很明显——生成出来的音乐,往往会更像一首完整的歌,而不是一段段随机的旋律拼在一起。情绪会更连贯,段落也更清晰。
很多研究者也认为,这种“先构思、再生成”的思路,很可能会成为未来 AI 音乐模型的一种重要方向。
还有一个很关键的点:
它是开源的。
ACE-Step 1.5 采用 MIT 许可证,允许商业使用,并且支持在消费级硬件上运行。 开发者不仅可以自由使用这个模型,还可以在它的基础上做二次开发,甚至用于商业产品。同时,它对硬件要求也没有那么“高不可攀”,很多普通显卡就能跑起来。

这对 AI 音乐行业来说意义重大:在过去一段时间里,AI 音乐最强的能力基本都集中在少数几个平台手里。像 Suno AI、Udio 这样的产品,确实做出了很惊艳的效果,但模型本身是完全封闭的。用户可以使用工具,却看不到模型,也很难在它的基础上继续做新的东西。
ACE-Step 的出现,也许就是一个信号:AI 音乐可能正在进入一个类似当年 AI 绘画的发展阶段——当开源模型出现之后,创新的速度往往会突然加快。
现在,你可以直接在谱乐AI体验它
为了让更多创作者体验这项能力,谱乐AI 已正式接入 ACE-Step 1.5。
不用复杂部署,也不用折腾本地环境。打开谱乐AI,就能开始创作。
如果你已经体验了 ACE-Step 1.5,也欢迎来分享你的作品。
说不定下一首 AI 爆款音乐,就诞生在你的灵感里。
