Suno 申请封存训练数据量:AI 音乐版权争议中的“合理使用”与商业机密
Suno 在版权官司中申请司法封存其 AI 模型训练所用的音频总数,引发了关于“合理使用”原则和商业机密的讨论。文章分析了 Suno 法律策略中的矛盾点,并指出其竞争对手 Udio 也有类似举动,反映了 AI 音乐行业在训练数据规模问题上的普遍态度。这引发了创作者对 AI 音乐平台训练数据来源和版权补偿的深思。

最近,Suno 在与各大唱片公司的版权官司中,悄悄做了一件事:向法院申请,将其训练模型时所用的音频总数进行司法封存。Suno 的 CTO 亲自出面作证,表示这个数字“从未在本诉讼之外对外披露”,一旦公开,会对公司造成“重大竞争损害”。
Suno 目前的核心法律策略是“合理使用”(Fair Use)。它向法庭阐述的逻辑是:“我用音乐训练 AI,不是在‘复制’歌曲。我学的是旋律规律、和声结构、音色特征这些统计模式。输入进去的是歌,出来的是全新的东西。这是‘变革性使用’,不是侵权。”Suno 的律师引用了美国法院在其他 AI 案件中的判例,试图证明训练过程本身是合法的。
然而,如果 Suno 的训练方式真的只是“学习统计规律”,那么训练集里有多少首歌,理论上应该是一个工程参数,而不是最高机密。你用了 100 首歌来训练和用了 1 亿首歌来训练,对于“我只是在学规律”这个论点,在法律层面不一定有直接影响。但如果这个数字真的“无害”,它为什么要封存?
封存的理由是:竞争对手知道这个数字之后,可以“更快、更低成本地开发竞争产品”。这表明这个数字揭示了 Suno 的训练策略和模型架构选择,是其商业底牌。这就在 Suno 的两个论点之间造成了矛盾:一方面声称“我的训练是变革性的,我学的是规律,不是歌”,另一方面又强调“那个数字不能公开,否则竞争对手会获得不公平的商业优势”。如果训练方式真的是“无害地学规律”,那这个数字顶多是个竞争情报,跟版权侵权与否关系不大。但如果这个数字一旦公开,外界能看出问题来,那情况就不同了。
值得一提的是,Suno 提出封存申请几天后,其竞争对手 Udio 在自己的索尼案中,也提出了几乎一模一样的申请,理由也如出一辙。这表明这不是某家公司的特殊操作,而是整个 AI 音乐行业在面对“训练集规模”这道题时,给出了同样的答案:能不说,就不说。
作为创作者,我们该如何理解这件事?之前有另一起独立音乐人的诉讼,其中披露了一个说法,Suno 的训练数据可能超过 4000 万首,其中超过 60% 来自独立艺术家,即没有签大公司的那批人。这些艺术家既没有被询问,也没有授权协议,更没有拿到任何补偿。这个说法,Suno 没有正面回应过。而现在,那个最有可能帮助外界理解“你到底用了多少”的数字,被申请封存了。
如果 AI 音乐平台是靠“吃”了海量音乐才长大的,作为一个做音乐的人,这引发了我们对版权、公平性和行业未来的深思。