top of page

音乐出版商起诉之际,Anthropic 与 Google 的联盟面临版权考验

Anthropic 面临一项新诉讼,诉讼称 Claude 曾使用数万首非法获取的歌曲进行训练。此案也使 Anthropic 与 Google 的关系受到更严格的审视。Sony Music Publishing 和 Warner Chappell Music 指控 Anthropic 利用通过盗版获得的受版权保护作品,构建了具有高价值的 AI 系统。

出版商于 2026 年 8 月 28 日在北加州联邦法院提交起诉书。被告包括 Anthropic、首席执行官 Dario Amodei 以及联合创始人 Benjamin Mann。Anthropic 否认相关指控,并表示将在法庭上为自己辩护。

这并不只是又一场围绕 AI 训练是否构成合理使用的争论。核心冲突在于 Anthropic 被指在将材料用于训练前,如何获取这些材料。这一区别此前已在涉及受版权保护书籍的诉讼中为该公司带来法律麻烦。

Google 未被列为被告。不过,它是 Claude 的重要投资者、基础设施合作伙伴,并通过 Google Cloud 分发 Claude。因此,这起诉讼检验的不只是 Anthropic 的法律策略,也检验领先云服务公司能否将其 AI 合作关系与围绕训练数据来源日益增多的争议区分开来。

Sony 和 Warner 扩大针对 Anthropic 的诉讼范围

这起新诉讼将音乐行业的挑战从个别歌词输出,转向 Anthropic 被指建立训练资料库的行为。

Sony Music Publishing 和 Warner Chappell Music 旗下实体称,Anthropic 复制了数万首受保护的音乐作品。其主张涉及数字书籍中包含的歌词、乐谱以及其他形式的作品呈现。

出版商称,Anthropic 从包括 Library Genesis 和 Pirate Library Mirror 在内的未获授权资料库获取了部分材料。这些服务常被称为影子图书馆,因为它们在未经众多版权持有人授权的情况下传播数字书籍。

据报道,这份起诉书长达 48 页,描述了一场通过 BT 下载、抓取和下载受版权保护作品的行动。BitTorrent 是一种点对点分发系统,用户可从多台计算机获取文件的不同部分。

出版商称,Anthropic 使用这些文件开发并运营 Claude 系列 AI 模型。他们还寻求让 Amodei 和 Mann 就其被指在获取相关材料中所扮演的角色承担个人责任。

这些目前仍属指控。公开报道的主张并不能证明每一首被识别出的作品都进入了 Claude 的训练数据,也不能证明哪些模型版本处理过特定文件。

不过,这起诉讼的范围超出了聊天机器人返回可辨识歌词的争议。它针对的是被指建立了一个包含盗版副本的集中式训练资料库。

这一区别至关重要,因为版权案件可能涉及多种相互独立的行为。获取文件可能产生一项主张;存储文件可能产生另一项;将其用于模型训练则可能引发单独的合理使用问题。而模型输出若复制了受保护表达,还可能触发另一场争议。

音乐出版商将被指的获取过程描述为有意为之,而非意外发生。他们的论点部分依赖于早先涉及书籍的诉讼中形成的证据。

据报道的 48-page complaint 概述,原告指控 Anthropic 开展大规模行动,为 Claude 获取受保护作品。Anthropic 回应称,其不同意这些主张,并打算积极为自己辩护。

这起诉讼也发生在数起较早的音乐案件之后。Concord Music Group、Universal Music Publishing Group 和 ABKCO 最先对 Claude 处理歌曲歌词的方式提出挑战。据报道,另一项 2026 年诉讼涉及超过 20,000 首作品。

BMG 随后就 493 首作品提出主张。Round Hill Music 于 2026 年 8 月提起另一项诉讼。如今,Sony 和 Warner 又加入了由业内两大出版集团控制的作品目录。

这一连串案件使 Anthropic 在音乐领域面临的风险,演变为一组争议,而非单一的测试案件。每位原告控制的权利、作品和合同利益各不相同。与其中一个团体达成解决方案,并不会自动解决其他争议。

因此,最新的 publishing lawsuit 加大了 Anthropic 说明其数据获取流程的压力。围绕变革性训练的一般性抗辩,可能无法回应以未经授权下载为核心的主张。

为何 Anthropic 与 Google 的关系至关重要

案件直接向 Anthropic 施压,但其商业影响范围也使这场争议与 Google Cloud 的客户和合作伙伴息息相关。

Anthropic 与 Google 的合作如今横跨投资、计算基础设施和企业分发。Google 已投资 Anthropic,而 Google Cloud 则提供用于训练和服务 Claude 模型的专用处理器。

企业开发者也可通过 Vertex AI 使用 Claude。这一安排让客户能够在 Google 的云环境中调用 Anthropic 模型,也使 Claude 与 Google 自家的 Gemini 模型一同纳入更广泛的企业 AI 产品目录。

这种关系并不意味着 Google 要为 Anthropic 被指的行为负责。起诉书点名的是 Anthropic 及其两位领导者,而非 Google。没有报道称 Google 指示进行出版商所描述的下载行为。

不过,云服务合作会形成运营依赖。客户会综合评估模型质量、安全性、可用性、合规性和知识产权风险。影响某一层级的法律争议,可能影响整个服务体系中的采购决策。

Google 和 Anthropic 持续扩大其基础设施合作关系。Anthropic 于 2026 年 4 月宣布,将在数吉瓦计算容量中使用更多 Google 和 Broadcom 系统。

该公司将这次 compute expansion 描述为扩大 Claude 规模战略的一部分。预计多数新增容量将在美国运行。

大型计算承诺以模型训练和推理需求持续存在为前提。推理是指运行已训练模型以回答请求的过程。当企业信任模型及其配套的数据实践时,这两类活动都会更具价值。

版权不确定性并不会自动阻止这种需求。尽管法院仍在审理涉及文本、图像、代码、视频和音乐的诉讼,企业仍在持续采用生成式 AI。

不过,企业买家越来越常要求供应商记录训练来源、模型限制、赔偿条款,以及回应权利主张的程序。一项指控故意盗版的诉讼,使得用笼统保证来回答这些问题变得更加困难。

因此,Anthropic 与 Google 的联盟面临治理考验。Google 必须继续将 Claude 作为企业选项进行销售,同时将自身的基础设施角色与 Anthropic 的模型开发决策区分开来。

Anthropic 则必须证明,其当前数据控制措施能够应对早期训练周期中可能发生的任何做法。它还必须说明,有争议的文件是否仍存在于任何内部资料库、评估集或模型开发流程中。

问题并不局限于一家云服务商。Amazon 仍是 Anthropic 的另一重要投资者和基础设施合作伙伴。Claude 还与通过 Microsoft 云服务分发的 OpenAI 模型竞争,同时也与 Google 的 Gemini 系列竞争。

美国联邦贸易委员会一直在审视 AI 市场中的这类关系。其 cloud partnership study 强调,投资可通过支出承诺、访问安排和技术依赖,将 AI 开发商与其云服务合作伙伴联系起来。

该研究并未指控 Google 或 Anthropic 侵犯版权。但它表明,为何 AI 开发商的法律风险可能超出单一公司的边界。

对客户而言,眼下的问题不是 Claude 是否会消失。实际问题在于,诉讼是否会改变合同条款、风险审查、模型可用性或未来的训练披露。

对 Google 而言,压力主要来自声誉和商业层面,而非直接的诉讼风险。Claude 吸引企业工作负载进入 Google Cloud 时,Google 将从中受益;当 Claude 的开发做法受到审视时,它也会承接客户提出的棘手问题。

真正的冲突在于获取行为与变革性使用

Anthropic 最有力的合理使用论点,并不必然能为被指获取盗版源文件的行为开脱。

AI 版权争论往往将数个法律问题归结为一个。支持模型训练的人认为,模型学习的是统计关系,而不是为每一份来源材料存储传统意义上的替代副本。

版权持有人则回应称,公司在收集、准备和训练过程中仍会制作副本。他们还认为,部分模型输出可能会与受保护作品竞争、模仿或复制这些作品。

Anthropic 相关案件揭示了第三个问题:一种可能具有变革性的使用,是否可以为通过未经授权来源获取作品的行为开脱。

2025 年 Bartz v. Anthropic 一案中的裁决,在训练和获取之间划出了一条清晰界线。作者指控 Anthropic 使用受版权保护书籍构建 Claude,并从盗版图书馆获取数百万份文件。

美国地区法官 William Alsup 认定,根据其面前的事实,将书籍用于训练语言模型构成合理使用。他认为训练用途具有变革性,因为这些模型旨在生成新文本,而非提供书籍副本。

法官对从盗版图书馆获取的副本作出了不同结论。他认定,仅因 Anthropic 后来将部分书籍用于训练,并不足以证明从这些下载内容建立永久性中央资料库具有正当性。

这一区别可在联邦 court record 中看到。它为音乐出版商提供了一个框架,可将其获取行为相关主张与关于机器学习的更广泛论点区分开来。

最新原告可以主张,此案首先关乎非法副本,其次才关乎模型行为。Anthropic 则可通过质疑所有权、识别、因果关系、个人责任,或下载文件与具体训练运行之间的关系来回应。

Anthropic 还可能主张,出版商利用来自无关证据开示的事实扩大了早先案件。该公司可以检验每位原告是否已将其主张的每一首作品,恰当地关联至每位被告实施的具体行为。

这些细节至关重要。对整个目录层面的指控,仍需提供与可识别的权利和行为相关联的证据。法院不会因为作品位于大型数字档案中,就自动认定其已被用于模型训练。

不过,出版商拥有一个可能很重要的叙事优势。法官和陪审团很容易理解“训练”与“获取”之间的区别。

公司可以主张,为学习模式而阅读合法取得的作品属于新的用途。但当合法副本或许可本已存在时,要解释为何这一用途需要下载未经授权的副本,就困难得多。

音乐行业还将权利分散在词曲、歌词、乐谱、录音及合同权益之中。一首歌曲可能涉及多名权利人和多项不同的版权。

Anthropic 并不像 Suno 或 Udio 那样生成录制音乐。Claude 主要是一种语言模型,因此争议重点集中在歌曲的文本和记谱形式上。

这一限制或许有助于 Anthropic 将其产品与专门的音乐生成器区分开来。但对于据称存在于图书收藏中的歌词、歌集或乐谱,它并不能消除相关索赔。

此前的合理使用裁决让 Anthropic 在模型训练问题上取得了重要胜利。但该裁决也保留了如今被音乐出版商重点强调的核心脆弱点:即使后续使用被认定具有转换性,盗版行为仍可能构成可诉行为。

这正是本案背后的核心反转。Anthropic 协助确立了对 AI 训练有利的法律理论,但同一场诉讼也产生了支持新获取指控的证据。

音乐出版商正在构建协调一致的施压行动

不断增加的案件为出版商提供了多条挑战 Anthropic 的路径,即使其中一种法律理论失败也不例外。

音乐行业并未依赖单一原告、目录或理论。出版商已针对 Claude 输出、训练副本、涉嫌通过种子下载,以及集中式资料库的保留提起诉讼。

这种方式分散了风险。如果法院驳回基于输出的索赔,基于获取的索赔仍可继续。如果 Anthropic 成功击败涉及某一目录的索赔,其他权利人仍可提交不同证据。

Sony Music Publishing 和 Warner Chappell 还拥有庞大的目录和诉讼资源。它们的参与表明,这场争议已超出早期原告组成的有限群体。

出版商更广泛的目标似乎不仅涉及损害赔偿,也涉及许可谈判筹码。音乐公司已在市场的其他领域达成与 AI 相关的协议。

Universal Music Group 和 Warner Music Group 已与部分 AI 音乐公司达成安排。这些协议表明,版权方与 AI 开发者可以从诉讼转向获得授权的产品。

Anthropic 面临的是另一类问题,因为 Claude 是通用模型。它的价值来自处理多种语言任务,而非提供专门的音乐生成服务。

为录制音乐建立的许可体系未必能直接适用于在混合资料集上训练的语言模型。出版商需要界定哪些权利应获得报酬、如何衡量训练用途,以及所有权发生变化时如何处理。

技术记录同样带来不确定性。训练数据集可能包含重复文件、提取出的文本、过滤后的版本,或嵌入更大书籍中的材料。

一本歌集可能收录数十乃至数百首作品。一部传记可能引用多段歌词。数字档案可能包含同一作品的多个版本。

这些差异使受影响歌曲的标题数量显得重要,却并不完整。原告必须将其目录与副本及行为联系起来。Anthropic 则必须说明其系统如何处理、过滤或排除这些材料。

该公司目前的回应很简短。它否认出版商的主张,并表示将进行抗辩。这一回应并未透露 Anthropic 是否质疑所称下载、其内容、其用途,或起诉状中的全部内容。

审慎解读不应将所称作品数量视为最终的司法认定。这些主张尚未经历证据开示、证据挑战、简易判决或审判。

同样,认为 Bartz 裁决已经为 Anthropic 解决争议也为时过早。该裁决对具有转换性的训练和盗版获取采取了不同处理方式。音乐权利还涉及典型图书案件中并不存在的所有权结构。

该行业的策略类似于早年针对文件共享服务的行动。权利人曾通过相互重叠的索赔,追究平台、分发方和个人用户的责任。

但这种类比也有局限。Claude 的运作方式不同于 Napster,模型权重也不是一个包含传统歌曲文件、可供搜索的文件夹。有争议的行为包括获取数据、训练模型、保留资料库和生成输出。

这种差异将影响救济措施。法院可能在不下令销毁每一个模型的情况下处理存储文件;也可能将索赔限制在特定作品或行为上。法院也可能需要在确定损害赔偿或个人责任之前先行审判。

对 Anthropic 而言,和解也有自身的复杂性。解决一家出版商的索赔,可能促使其他目录权利人要求获得可比待遇。

诉讼则带来相反的风险。详细的法庭记录可能披露更多有关内部数据决策、训练流程以及公司领导层之间沟通的信息。

因此,出版商正在人们所关注的法律证据开示、商业许可和 AI 透明度交汇点施加压力。即使没有即时限制触及 Claude 用户,这种压力仍将持续。

这起诉讼仍未证明什么

起诉状提出了严肃问题,但并未证明 Claude 记住了每一项所主张的作品,也未证明 Google 参与了任何侵权。

第一项不确定性涉及数据集归属。文件出现在内部收藏中,并不自动证明每个 Claude 模型都曾基于该文件训练。

AI 开发者通常会在训练前对数据进行过滤、去重、分类和转换。公开报道并未提供从每份据称盗版文件到每个生产模型的完整对应图谱。

第二项不确定性涉及输出行为。模型可以在基于某部作品训练后,并不逐字返回该作品。反过来,一段熟悉的歌词也可能出现在公开互联网的许多位置。

早期出版商曾记录 Claude 据称提供受保护歌词的情况。据报道,新案件更强调获取包含于书籍中的作品。

这种转变可能降低证明侵权输出的重要性。但它并未免除识别受保护作品、确立所有权并将被告与未经授权行为联系起来的必要性。

第三项不确定性涉及个人责任。将 Amodei 和 Mann 列为被告提高了案件的利害关系,但原告必须以证据和适用法律支持针对每个人的主张。

公司领导层并不会自动对公司的每项行为产生个人责任。据报道,出版商指称两人直接参与,尤其涉及种子下载决策。Anthropic 可以对这些指控及其法律意义提出抗辩。

第四项不确定性涉及救济。公开讨论常常假定,版权起诉会迫使公司重新训练模型。法院其实有多种更狭窄的选择。

法院可以就已证实的副本判处损害赔偿,下令删除特定资料库文件,限制指定做法,或驳回部分索赔。结果将取决于证据、程序以及每项作品所附带的权利。

第五项不确定性涉及 Anthropic 与 Google 的关联。Google 提供基础设施和商业分发,但当前起诉状并未将其列为被告。

将此描述为针对 Google 的诉讼并不准确。同样,在没有证据的情况下声称 Google 提供了有争议的训练数据,也不准确。

相关问题是间接压力。Google 通过其云平台销售 Claude 访问权限,并已作出与 Anthropic 增长相关的重大基础设施承诺。

企业客户可能会询问 Google 如何评估第三方模型的数据来源。它们也可能寻求有关赔偿、服务连续性以及未来法院命令处理方式的明确说明。

Google 可以在不接受出版商指控的情况下回答这些问题。它可以指出云平台与独立模型提供商之间的合同分工。

不过,这场争议正在检验:这些分工是否足以让同样面临自身版权义务的买家感到安心。受监管企业和媒体公司通常需要的不只是供应商关于诉讼仍在进行的一般性声明。

另一项不确定性涉及未来的训练做法。自所称行为发生以来,Anthropic 可能已改变其数据来源、许可、文档记录或保留政策。

起诉状中的历史指控并不自动描述公司当前的流程。Anthropic 尚未公开足够细节来解决这一问题。

因此,读者应区分三项命题。音乐出版商已提出详细指控。早期诉讼记录了 Anthropic 使用盗版图书资料库的情况。新法院尚未就这里主张的作品确定责任。

这种区分使报道保持基于事实。它也指出了真正的信息缺口:公众仍缺少一份将获取、存储、训练和输出逐项关联的作品级说明。

三个信号将显示接下来会发生什么

下一阶段将取决于 Anthropic 的法律回应、对训练记录的要求,以及云合作伙伴风险控制是否发生变化。

第一个信号是 Anthropic 对起诉状作出的正式回应。驳回动议将显示该公司认为哪些主张在证据开示前即告失败。

Anthropic 可能对所有权、属人管辖权、个人责任、起诉细节,或所主张作品与 Claude 之间的联系提出质疑。它也可以答辩,并逐项抗辩指控。

其选择的回应将澄清 Anthropic 是否主要将本案视为另一场合理使用争议。它也可能将此事定性为未能将特定作品与特定行为相联系。

广泛否认后进入证据开示,将提升内部记录的重要性。若案件在早期成功被驳回,出版商的行动将被削弱,不过后续仍可能出现修订后的起诉状和上诉。

第二个信号是,法院是否允许对 Anthropic 的数据集和通信进行广泛证据开示。证据开示是审判前程序,各方通过该程序获取相关文件、证词和技术记录。

Bartz 诉讼之所以变得重要,部分原因在于内部证据揭示了 Anthropic 如何建立其图书资料库。音乐出版商如今寻求将这些事实适用于包含在下载材料中的作品。

如果作品级训练记录能将受保护作品与已识别的训练运行联系起来,将强化出版商的案件。缺失或模糊的记录会使证明更加困难,并可能暴露数据治理中的薄弱之处。

第三个信号是,Google Cloud 或其他 Anthropic 合作伙伴是否会调整其客户保护措施。这可能包括修订文档、更强的数据来源披露、新的合同措辞,或对第三方索赔承担责任的更明确界定。

诉讼本身尚未确立任何此类变化。然而,合作伙伴的行为可为衡量其所感知风险提供实际依据。

如果 Google 在不调整其控制措施的情况下继续扩大 Claude 的可用范围,这将表明其相信诉讼风险仍可控。若出现新的限制或披露要求,则意味着法律不确定性已影响到企业级分发。

这些信号比诉状中最激烈的指控更重要。版权诉讼要经历诉辩、证据审查以及范围严格限定的裁决。

Anthropic 与 Google 的合作关系并未作为一个法律实体接受审判。但其运营前提仍在经受检验。

Anthropic 在全球一些最大的基础设施提供商支持下打造了 Claude。如今,音乐出版商主张,宝贵的计算能力放大了基于非法获取作品训练而成的模型。

Anthropic 表示这些说法并不属实。法院将根据证据作出判断,而不是依据出版商的措辞或公司的否认。

对于开发者和企业采购方而言,眼下的行动很直接:跟踪 Anthropic 提交的答辩文件,审查供应商如何说明其训练数据控制措施,并核查已部署模型附带的保护机制。不要因为云端可用就认定其来源问题已经得到解决。

更大的问题在于,AI 公司能否在为变革性训练辩护的同时,证明其源材料是合法获得的。答案将影响 Claude、Anthropic 与 Google 的联盟,以及所有基于大型混合数据集构建的企业模型。

 
 

免费开始

一款本地优先的AI助手

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

你的 AI 工作伙伴

remio 一起高效工作

规划、创作、交付

一站式完成

bottom of page