Suno 发布 v6:首批基于华纳音乐、BMG 与 Believe 授权训练的 AI 音乐模型
版税分成随上线同步启动,而环球与索尼仍在推进联邦版权诉讼,裁决指向 2027 年

Suno 于 9 月 9 日下架了此前的全部模型,换上 v6 —— 这家总部位于马萨诸塞州剑桥的公司称,这是其首个用华纳音乐集团、BMG 和数字发行商 Believe 授权曲库训练出来的 AI 音乐模型世代,而对这三家合作方的收入分成也于同一天开始。在所有 AI 音乐平台中,这是朝着「训练权与商业版税同步谈定、而不是事后在法庭上解决」这一模式迈出的最具体的一步。这同样构成了一种法律上的反讽,而对手们已经在借题发挥:它证明了 AI 训练数据的授权市场是存在的 —— 这恰恰是环球音乐集团和索尼音乐在那场仍在进行、v6 丝毫没有化解的联邦诉讼中所主张的论点。
三个模型,一次平台重置
v6 家族由三个各不相同的模型构成,区分它们的不只是能力档位,更是创作取向。v6 是旗舰,面向 Pro 和 Premier 订阅用户,定位是稳定、忠于曲风的输出。v6-wild 同样面向付费档,该公司形容它刻意「更难预测、更多变」—— 为那种「意外本身就是目的」的实验而造。v6-mini 对所有用户免费,据首席产品官 Jack Brody 称,它比前代更快 —— 提示词发出后几秒内就能交付完整曲目。
这次发布让此前的每一代 Suno 模型都退了役。用户仍能访问用 v5 或 v5.5 做出的歌曲,但生成它们的模型已从平台上消失。这次交接里藏着一个先例:当 Suno 在 2025 年 11 月与华纳音乐集团就版权诉讼达成和解时,该公司承诺,一旦有了获得正当授权的后继模型,就会弃用当时的模型。v6 的发布兑现了这一承诺。
Brody 在接受 Music Business Worldwide 采访时表示,「v6 是完全从零开始、从头训练的」,所用数据「不包含来自环球或索尼的数据」。这种排除既是法律现实,也是商业约束:环球音乐和索尼音乐仍是波士顿一桩联邦案件的现役原告,Suno 决定把它们的曲库挡在 v6 训练之外,部分是为了限缩这两家厂牌在证据开示中所能主张的范围。
Suno 的模型究竟怎样生成音乐
Suno 没有为任何一代模型发表过技术论文,v6 也不例外。关于其架构的已知信息,来自专利申请、第三方分析,以及 Brody 与 CEO Mikey Shulman 的表态。大致图景是:Suno 使用潜在扩散 transformer 架构 —— 一种混合方法,先把音频编码成压缩的潜在表示,再在那个空间里用基于 transformer 的逆向扩散过程生成输出音频。
让 Suno 区别于许多文本到音频研究模型的关键架构选择,是它按顺序生成音频 token —— 更像语言模型一个词接一个词地生成,而不是图像扩散所用的并行去噪过程。这种做法每个 token 更慢,但在整首歌的尺度上保持音乐结构要好得多:副歌需要呼应三分钟前主歌里确立的旋律模式。
Brody 对 Music Business Worldwide 表示,v6 的进步与其说来自授权曲库本身,不如说来自积累的工程研究:「让这些模型变好的很多东西,其实不是训练它的数据,而是研发 —— 是那些突破和技术创新:这些模型怎么搭建、怎么塑形、怎么根据偏好来调,诸如此类。」
他说的调优,指的是从一开始就内建在 Suno 平台里的、基于用户偏好的强化学习。每次创作都会生成两个版本;用户的选择 —— 留哪个、丢哪个 —— 就是一个训练信号。Brody 确认,v6 在授权曲库之外,还吸收了 Suno 累计 1 亿用户多年来产生的这类偏好数据。训练语料不只是华纳或 BMG 的曲目;它把这些曲目与大量「用户实际偏爱什么样的生成音乐」的累积信号结合在了一起。
v6 能做到、而此前 Suno 模型做不到的事
v6 的生成能力,相对早期版本那种「一条提示词出一整首歌」的工作流,是一次实质性的功能扩展。其中最具实用意义的是用自然语言做分段编辑:用户现在可以让模型只改副歌、不动主歌,或者只换一句歌词而不重新生成整首曲目。Suno 的文档举的例子是让副歌「由福音合唱团来唱」—— 周围的编曲保持不变,只有那一段的处理方式改变。
混搭(mashup)能力可以在一次生成请求里组合来自多个来源的元素。用户可以指定取某首现有曲目的人声、另一首的鼓、一个新的歌词主题和一个风格方向 —— 然后收到一份把这四条指令融为一体的输出。这不是传统意义上的混音技术;它是对用户创作意图的一种多模态理解,模型把它当作一份作曲简报来诠释。
第三种新工作流以时间戳精度处理采样:「采 0:45 处的那段 riff,把吉他分离出来,围绕它搭一段节拍。」模型会定位目标时刻,把那件乐器从混音中分离出来,再以分离出的音频为基础做一次新的生成。时间戳引用、音源分离加生成,这套组合在传统音频制作流程里需要三个独立的工具。
输入现在也是多模态的了。v5.5 接受文本和音频。v6 接受文本、音频、图像和视频。用户可以提供一段用手机拍的环境或演唱会视频,或一张照片,并要求生成与画面相配的音乐。这让 Suno 进入了与视频优先型 AI 工具相同的输入领地,而不再只是文本到歌曲的生成器,扩大了它能替代或增强的创作流程范围。
授权架构:它覆盖了什么,没覆盖什么
支撑 v6 的合作模式,远比「Suno 授权了一些歌」复杂。三笔交易在结构上各不相同,而且没有一笔覆盖任何一家合作方的全部曲库。
华纳音乐的交易于 2025 年 11 月作为华纳版权诉讼的和解而敲定,赋予华纳对「哪些曲库曲目进入训练」的发言权。Brody 对 Music Business Worldwide 说:「华纳基本上是在那个过程中自己确定了要交出哪些音乐用于训练。」华纳和解的具体曲目与财务条款均未公开。作为交易的一部分,Suno 还收购了华纳旗下的现场音乐发现平台 Songkick。
至于 8 月 12 日宣布的 BMG 交易,结构又不一样。BMG 从未起诉过 Suno,所以没有官司可和解 —— 这份协议转而对 Suno 此前对其曲库的使用做追溯补偿,并授权 BMG 的曲目供此后使用。这笔交易是选择加入制:只有主动选择参与的艺人,其音乐才会授权给 Suno。BMG 的名单包括米克·贾格尔、基思·理查兹、布鲁诺·马尔斯和黛安·沃伦等人的出版权;有多少人会选择加入,这笔交易把答案留给了艺人自己。
Believe 的交易于 9 月 8 日签署,推翻了该公司仅仅五个月前的立场 —— 2026 年 4 月,Believe 曾封禁所有 Suno 生成的曲目通过其平台和 TuneCore 发行。新协议同样是选择加入制,为同意的艺人恢复发行渠道。
收入分成立即开始,Suno 把其平台收入的一部分分配给三家合作方,再由合作方负责把这些款项分配给各自的艺人。无论是 Suno 付给合作方的计算公式,还是下游付给艺人的计算公式,都没有公开披露。
这套授权架构没覆盖的部分,与它覆盖的部分同样重要。环球和索尼被明确排除在 v6 训练语料之外。这意味着,母带由环球或索尼控制的艺人的音乐 —— 两家合计占全球商业流行音乐的相当大份额 —— 在训练如今为 1 亿用户提供服务的这些模型时,没有起任何作用。管理一批独立常青作品曲库、且拒绝和解的 Round Hill Music,同样没有得到处理。v6 里「授权」的范围,就是三份具体商业协议的范围,而不是整个行业的广泛共识。
Suno 在 AI 音乐竞争格局中的位置
这次授权进展对 Suno 相对于 Udio —— 它在「能唱人声的整首歌生成」上的主要对手 —— 的竞争位置的改变,并不是那么直截了当。
Udio 于 2025 年 10 月与环球就版权案达成和解,随后又签下覆盖华纳、Merlin 和 Kobalt 的交易 —— 在那个时点,它的授权覆盖面比 Suno 更全面。代价是环球一直力推、视为 AI 音乐首选架构的「围墙花园」模式:作为其合作变更的条件,Udio 关闭了所有用户音频、视频和分轨的下载。截至 2026 年 9 月,你可以在 Udio 上创作音乐,但不能把它导出、拿到别处发行。
Suno 一直抵制那种模式。该公司首席音乐官 Paul Sinclair 在 2 月主张要「开放的工作室,而不是围墙花园」,v6 的发布延续了这一立场:付费订阅用户可以在平台条款范围内下载并商业发行自己的作品。对于需要把音乐放上流媒体平台、YouTube 视频或商业作品的创作者来说,这种发行上的开放一直是一个有意义的差异点。
v6 让 Suno 拿到了华纳和 BMG 的覆盖 —— 与 Udio 的授权部分重叠 —— 同时保留了下载。代价是索尼和环球的曲库被明确排除在 v6 训练之外,而 Udio 与环球的交易覆盖了环球的艺人(尽管 Udio 的产出出不了平台)。对于企业用户或同步授权从业者来说,两个平台目前都给不出干净的方案,只是给出了两种不同的、不完整的方案。
ElevenLabs Music 于 2025 年 8 月上线时就已具备授权,其训练数据历史更干净,但在复杂、跨曲风的人声歌曲生成上能力更弱。Stability AI 于 2026 年 5 月推出的 Stable Audio 3 以开放权重发布、能在消费级硬件上运行,但它没有人声生成,与这里讨论的用例并不构成竞争。
延伸阅读:谷歌把 Lyria 3.5 AI 音乐放进 Gemini 应用和开发者 API
v6 没有化解的法律风险
v6 的发布处理了 Suno 在与三家合作方的前向业务上的法律风险。它没有处理环球与索尼的诉讼意在逼上法庭的那些核心法律问题。
这起在美国马萨诸塞州联邦地区法院审理的诉讼指控,Suno 的早期模型 —— 也就是 v6 刚刚取代的那些 —— 是在未经授权的受版权保护录音上训练的。8 月 25 日,环球和索尼提交了修正后的起诉状,新增一项「抓取流媒体」(stream-ripping)指控,称 Suno 绕过了 YouTube 的防下载技术来获取训练用音频。Suno 于 9 月 1 日作出答辩,在文书中承认「训练数据所用的音频是使用 YT-DLP 从 YouTube 获取的」—— YT-DLP 是一款开源下载工具 —— 同时主张两家厂牌不具备依据《数字千年版权法》提出抓取流媒体指控的诉讼资格。该案的事实证据开示于 9 月 30 日截止,决定性动议的提交期限为 2027 年 4 月 9 日。
Suno 的法律处境里有一层叠加的反讽。通过与华纳和 BMG 签订授权协议,Suno 证明了 AI 训练数据的商业授权市场是存在的。环球和索尼如今正拿这一事实来反驳 Suno 的合理使用抗辩:按照美国版权法,合理使用分析会考虑被告的使用是否可能取代一个正当的授权市场。如果这样一个市场确实存在 —— 华纳和 BMG 的交易正好证实了这一点 —— 那就更难主张此前未经授权的训练属于合理使用。Suno 的这些协议,既是它表达诚意最清楚的信号,也是对手手里「早期使用本应付费」的最有力证据。
在美国之外,慕尼黑地区法院于 7 月 31 日裁定,Suno 在训练早期模型时侵犯了 GEMA 所代表作曲人的权利,责令该公司停止未经授权的复制、披露使用规模并支付赔偿 —— 在 Suno 评估是否上诉期间,该裁决即可执行。一项提交至欧洲法院的先决裁判请求(C-250/25 号案)可能会把类似义务延伸到整个欧盟。
Round Hill Music 于 8 月 17 日提起的诉讼,又开辟了一条该公司拒绝以谈判了结的战线。AI 音乐版权诉讼中的每一起重大和解,都发生在任何法院就合理使用问题作出最终具有约束力的裁决之前。Round Hill 明言要争取陪审团裁决,再加上它选的律师 Richard Busch —— 正是打赢了那起里程碑式《Blurred Lines》侵权案的人 —— 表明它意在催生第一个有约束力的判例,而不是拿法律威胁去换一纸授权协议。Jason Isbell 与另外三位艺人于 9 月 1 日另行提起集体诉讼,指控 Suno 未经同意使用其姓名与形象。SOCAN 则于 9 月 2 日在加拿大联邦法院起诉。
第二阶段已在视野之内,而一项裁决将重塑整个行业
Shulman 把 v6 的发布定位为两个阶段中的第一个。第二个阶段只有粗略描述,涉及「围绕单个艺人打造的选择加入式体验:艺人可以选择参与、参与就能拿到报酬,而粉丝则能以新的方式与自己喜爱的艺人建立联系」。除了「未来几个月的某个时候」,没有给出任何时间表。
一项「创建自定义模型」功能出现在 Suno 平台上,但未包含在官方发布文章里;它标着 Beta,定价 100 积分 —— 允许用户用自己上传的曲目训练个性化模型,这是那种艺人选择加入式体验未来规模化后可能样貌的一个早期雏形。
对 AI 音乐行业而言,最要紧的标记不是 Suno 的产品路线图,而是美国联邦法院的日程表。马萨诸塞州案件 2027 年 4 月的决定性动议截止日,将把合理使用之争推到摊牌时刻 —— 不只对 Suno,也对任何在授权协议出现之前就用受版权保护材料训练过的 AI 公司。如果法院裁定此前的训练不属于合理使用,Suno 的授权架构就会成为行业的强制底线,而不再是一种竞争选择。如果法院裁定此前的使用属于合理使用,华纳和 BMG 的交易看起来就像是自愿多付了钱。无论哪种结果,都将界定 AI 创作公司究竟欠它们从中学习的那些行业什么。