top of page

Anthropic 与 Google 联盟面临索尼和华纳版权诉讼的新压力

9月1日
讀畢需時 13 分鐘

Anthropic 面临一项涵盖数万部音乐作品的新版权诉讼,使 Anthropic 与 Google 的关系受到更严格的法律和商业审视。Sony Music Publishing 和 Warner Chappell 指控 Anthropic 非法获取歌词和乐谱,用于开发 Claude。该案件同时针对 Anthropic 训练数据集中的材料,以及其被指控用于获取这些材料的方法。

这起诉讼发生在 Anthropic 以 15 亿美元和解金解决与图书作者重大纠纷之后。这一背景改变了新案件的意义。争议不再只是 AI 模型能否研究受版权保护的表达形式这一抽象问题,而是资金雄厚的开发者是否明知故犯地利用盗版文件构建了高价值数据集。

Anthropic 否认出版商的指控,并表示将出庭应诉。然而,其眼前的问题不止于潜在赔偿。该诉讼挑战了合作伙伴、客户和投资者能否有把握地将 Claude 的训练来源视为可控的商业风险。对于将 Anthropic 模型整合到产品中的 Google、Amazon 和企业客户而言,这一问题至关重要。

索尼和华纳聚焦 Claude 如何获取音乐作品

该诉讼将训练数据来源置于核心争议,而非将所有使用受版权保护材料的行为一概视为违法。

Sony Music Publishing、Warner Chappell 及其他出版商于 8 月 28 日向美国加利福尼亚北区联邦地区法院提起诉讼。他们还将 Anthropic CEO Dario Amodei 和联合创始人 Benjamin Mann 列为被告。

出版商指控 Anthropic 在为 Claude 模型汇集数据时,非法通过种子下载、抓取和下载方式获取受版权保护的作品。根据诉状,这些材料包括与 Beatles、Taylor Swift、Michael Jackson 及众多其他艺人相关的歌词和乐谱。

相关指控涵盖数万首音乐作品,范围远大于此前一宗涉及数百部已识别作品的音乐出版案件。出版商寻求法定赔偿,并要求法院禁止 Anthropic 使用其材料。

根据美国版权法,每件被故意侵权的作品,法定赔偿最高可达 15 万美元。该金额是法律上限,并非对索尼和华纳最终可获赔金额的预测。法院会考虑多项因素,且在诉讼过程中,争议作品可能被剔除或合并处理。

出版商还称,Claude 在提示下能够逐字复现受保护歌词。他们认为,Anthropic 利用这些作品帮助 Claude 生成与专业授权作品构成竞争的新歌词。

这些均为指控,并非已被认定的事实。Anthropic 向媒体表示,其不同意相关主张,并打算积极应诉。该公司尚未公开提供逐一回应每个被指控获取渠道的详细答复。

不过,关于获取方式的具体指控提高了案件的利害关系。据报道,诉状将盗版资料库、种子下载和被抓取的歌词服务列为来源。因此,它区分了 AI 公司经常混为一谈的两个问题。

第一个问题是模型训练是否可构成合理使用。合理使用是一项法律原则,允许基于用途、转换性、市场影响及其他因素进行某些未经授权的使用。第二个问题是,公司是否以合法方式获得了进入其训练流程的文件。

法院可能对这两个问题作出不同结论。即使训练过程具有转换性,也不会自动豁免为建立基础资料库而进行的、被指侵权的下载行为。

这种区分曾出现在 Anthropic 与图书作者的此前诉讼中。一名联邦法官认定,使用受版权保护图书进行训练可能具有转换性,但对创建盗版中央资料库的行为作出了不同处理。

这起新的音乐训练诉讼将检验这种区分是否会成为生成式 AI 的持久规则。如果会,开发者需要的不仅是关于模型学习内容的可辩护解释,还需要证据证明训练副本来自何处、适用了哪些权利,以及这些副本何时被删除。

对于企业客户而言,这才是实际变化。Claude 的输出控制措施仍然重要,但无法回答历史训练数据集的来源问题。当诉讼聚焦于客户使用模型之前就已发生的被指控行为时,合同保护也会变得不那么令人安心。

因此,新案件形成了本文的核心张力。Anthropic 将 Claude 描述为采用广泛安全控制措施开发的企业级系统;而出版商则将其数据获取行为描绘为一种缺乏管理的捷径,把成本转嫁给版权所有者。

Anthropic 与 Google 的关系为何如今变得重要

Google 并未被指控获取争议音乐,但其合作关系说明了为何该诉讼的影响不止于一家 AI 开发商。

Google 对 Anthropic 进行了大量投资,并提供支持该公司模型开发和分发的云基础设施。Anthropic 还通过 Google Cloud 的 Vertex AI 平台提供 Claude 模型。Amazon 则仍是另一家主要投资者和基础设施合作伙伴,双方通过 Amazon Web Services 合作。

这些关系让 Anthropic 获得资本、算力、企业分发能力和成熟的销售渠道。它们也将 Claude 的法律风险与更大型公司联系起来,而这些公司的客户期待有据可查的治理机制。

Anthropic 与 Google 的合作关系并不会使 Google 成为本案被告。诉状中没有任何内容表明 Google 选择、下载或批准了争议作品。投资者和基础设施提供商在法律上也仍与其投资的公司相互独立。

不过,企业买家很少仅从公司边界来评估这些关系。他们会考虑模型提供商是否能够支持采购审查、数据溯源问题、赔偿谈判和行业特定的合规义务。

这使该诉讼成为对该联盟的压力测试。当 Claude 为 Vertex AI 客户提供又一个领先模型选择时,Google 将从中受益;Anthropic 则受益于 Google 的基础设施、市场准入和信誉。双方都依赖于买家相信模型治理能够延伸至界面之下。

这一争议也正值云平台竞相提供多种模型家族访问权限之际。Microsoft 分发 OpenAI 及其他开发者的模型。Amazon 的 Bedrock 在提供 Anthropic 模型的同时也提供其他选择。Google Cloud 将其 Gemini 系列与包括 Claude 在内的第三方选项结合起来。

因此,客户现在切换模型比第一波生成式 AI 热潮期间更容易。他们仍要面对集成成本、评估工作和工作流程调整,但采购团队无需从头重建每一个应用,就能比较多家供应商。

版权不确定性成为这类比较中的一个因素。构建内部研究助手的公司可能会优先考虑准确性和安全性;生成宣传文案的媒体公司还可能会问,一个模型是否可能复现受保护的表达内容。

构建存储模型输出应用的开发者也面临类似问题。如果生成的段落意外地类似受版权保护的歌词,开发者可能需要建立检测、审查和下架程序。这些控制措施会增加成本,并减缓自动化发布。

因此,该诉讼促使 Anthropic 需要解释的不只是 Claude 的输出过滤机制。客户需要了解,在受保护内容出现在提示词、检索文档、训练数据或生成回复中时,存在哪些保障措施。

Google 面临的问题更为狭窄,但仍然重要:其市场和云治理流程能否区分模型安全主张与数据获取风险?两者相关,但需要不同的证据。

安全评估通常衡量有害输出、滥用、可靠性或模型行为。来源审查则检视许可证、收集方式、保留政策、数据集文档和合规决策。一个模型可能在前一类表现良好,却在后一类仍存在未解决的风险敞口。

这一差异对通过企业工具使用 Claude 的知识工作者很重要。他们的雇主可能已批准将该模型用于摘要工作,同时限制将受版权保护材料用于生成营销内容。政策控制必须反映具体使用场景,而不只是模型名称。

团队可以在 AI knowledge base 中记录这些区分。对获准模型、禁止输入和人工审查要求的清晰记录,能让未来的法律变化更易于管理。

尽管存在诉讼,Anthropic 与 Google 的联盟仍具有商业价值。眼下的压力并非合作关系即将瓦解,而是证明企业 AI 建立在可追溯、可辩护输入之上的成本正在上升。

真正的争夺在于授权访问与数据获取

索尼和华纳正在挑战一种商业实践,而不只是要求法院禁止机器从音乐中学习模式。

出版商最有力的叙事始于获取方式。他们指控 Anthropic 尽管存在合法替代方案,仍通过种子下载和其他未经授权的来源获取受版权保护的作品。这样的论述避免了完全依赖关于模型训练这一尚未确定的理论。

Anthropic 可能的辩护可以将被指控的下载行为与后续模型开发区分开来。它可以质疑个别作品的身份、所有权、登记、来源或实际使用情况,也可以挑战特定输出是否包含受保护的表达内容。

逐件审理的过程很重要。音乐版权在结构上较为复杂,因为一首歌曲可能涉及其作曲、歌词和录音制品的不同权利。不同的出版商、词曲作者、艺人和唱片公司可能分别控制不同部分。

Sony Music Publishing 和 Warner Chappell 代表的是作品创作权利相关利益。他们的案件并不只是关于音频录音如何进入音乐生成器。Claude 主要是通用型语言模型,而指控重点集中在文本和印刷乐谱上。

出版商称 Claude 以两种方式使用了受保护材料。第一,Anthropic 被指在构建训练数据集时复制作品。第二,Claude 被指在训练后复现歌词或生成竞争性内容。

这些主张需要不同证据。数据集记录可以支持关于获取方式的指控,却不能证明已部署的模型记住了该作品。被复现的歌词可以支持输出相关主张,却无法确定导致该结果的确切训练副本。

模型记忆化又增加了一层复杂性。它指模型保留了足够信息,以复现其训练材料中异常接近的片段。不同作品、提示词或模型版本的记忆化情况并不相同。

出版商可以通过针对性提示词测试 Claude,并记录相应输出。Anthropic 可以辩称,这些提示词旨在诱导模型生成受保护文本,或者相关安全措施此后已发生变化。法院随后必须审查:哪些行为应归属于模型提供商,哪些应归属于用户。

输出过滤器可以减少复现,但无法抹去此前的获取行为。同样,获得授权的获取行为也不意味着拥有无限制逐字分发副本的许可。可信的合规计划需要在两个阶段都设置控制措施。

市场已经开始转向授权模式。出版商、新闻机构、论坛及其他内容权利人已签署协议,允许 AI 公司使用特定材料。此前的一项联邦禁令裁定指出,有证据显示 AI 训练许可市场正在增长。

该裁定并未判定 Anthropic 是否侵犯音乐版权。法官之所以拒绝临时救济,是因为出版商未能证明存在不可弥补的损害。裁决明确保留了核心侵权及合理使用问题,未作定论。

这种悬而未决的法律状态带来了艰难的权衡。广泛的训练数据集能够改善覆盖范围,减少模型知识缺口。获得授权的数据集则提供更强的文档证明,但可能更慢、范围更窄,并且分散在不同权利人之间。

出版商认为,运营上的困难并不能授权复制。Anthropic 则可以主张,模型训练是将源材料转化为统计关系,而非分发一个替代性的资料库。两种立场都未消除数据获取这一问题。

此前的图书诉讼表明,为什么这一问题如今占据主导地位。在一项混合裁决后,Anthropic 同意支付 15 亿美元和解金,涉及约 46.5 万本图书。经批准的和解协议处理了与盗版副本相关的索赔,同时保留了 Anthropic 关于训练本身具有转换性的主张。

Sony 和 Warner 正利用这段历史质疑威慑效果。他们的起诉书称,先前的赔付并未改变 Anthropic 的行为。Anthropic 对新的指控提出异议,而出版商仍须证明其主张。

对于一家以负责任 AI 为核心定位的公司而言,这种反差令人不安。Anthropic 长期投入于模型对齐、滥用预防和安全研究。起诉书称,在创意作品的获取方面,并未实行同等程度的约束。

这种对比使这起诉讼比普通的授权纠纷更具破坏性。只有当利益相关方相信安全承诺贯穿整个产品开发过程时,安全承诺才能建立信任。对安全的狭义定义,会将法律、经济和来源可追溯性方面的损害排除在外。

版权主张仍然无法证明什么

详尽的起诉书可以证明争议严肃,但不能替代证据开示、技术证据或法院判决。

Sony 和 Warner 对 Anthropic 被指控的行为提出了有力叙述。他们的文件描述了大规模收集过程,指出了获取方式,并将这些方式与商业化的 Claude 模型联系起来。

Anthropic 尚未提出完整的事实抗辩。其简短公开声明否认了相关主张,但没有说明使用了哪些数据集、哪些来源获得授权,或特定作品如何进入具体模型。

这一空白不应被解读为承认。诉讼回应须遵循法院时间表,被告通常会将详细论点保留到动议及支持性声明阶段。由于涉及模型开发,部分证据也可能仍属保密。

出版商必须证明其拥有或控制争议版权。他们必须将已识别的作品与 Anthropic 实施的行为关联起来,并说明这些行为为何侵犯了其专有权利。

他们还将面对重复问题。一部作品可能出现在多本书、多个网站或多个合集之中。同一基础作品可能涉及多项登记或多个权利人。这些细节可能对赔偿额产生重大影响。

据报道,起诉书在对众多作品适用法定最高赔偿额时,寻求数十亿美元赔偿。这种计算描述的是理论风险敞口,而非预期裁决金额。法院不会自动将每一项被主张作品都乘以最高可得金额。

Anthropic 可以对故意侵权、法律上彼此独立的作品数量,以及每项登记是否支持法定赔偿提出质疑。它还可以主张,部分索赔已过时效、陈述不充分,或缺乏实际模型使用的证据支持。

关于输出的指控也需要单独审视。Claude 在经过精心设计的提示词后生成一段知名歌词,并不能证明普通用户经常会收到侵权文本。频率不会消除责任,但在评估市场损害和产品风险时具有意义。

记忆受保护歌词与模仿艺术家风格之间也存在区别。版权通常保护原创表达,而非单独的风格。模型生成的歌曲可以在文化上令人熟悉,却未必复制了受法律保护的文本。

出版商称,AI 生成的歌词可能构成有害的市场替代品。要证明这种损害,仅展示 Claude 能够创作类似歌曲的文本还不够。他们必须将被质疑的用途与版权所保护的权利联系起来。

此前的音乐案件进一步警示人们不要过早下结论。一名联邦法官拒绝向出版商授予初步禁令,并称核心合理使用问题仍未确定。该决定并未为 Anthropic 正名,但表明法院要求的不只是泛泛的行业担忧。

同样,图书和解并未宣告对受版权保护文本的每一种使用都属违法。Anthropic 强调,相关裁定将模型训练视为转换性合理使用,同时将其与被指控的盗版获取行为区分开来。

因此,新案件可能产生混合结果。法院可能驳回针对训练的广泛主张,同时允许基于特定下载或输出的索赔继续推进。法院也可能缩减作品清单,而不解决全行业规则。

这种不确定性在判决前就带来了实际义务。企业团队不应假定所有 Claude 输出都构成侵权;也应避免假定供应商的通用安全文档已经解决了版权来源问题。

适度的应对始于使用场景。低风险的内部头脑风暴不同于自动发布歌词、营销文案或娱乐内容。包含获得授权的企业文档的检索系统,也不同于基于来源不明公开数据进行开放式生成。

团队应保留记录,说明哪个模型版本生成了输出、涉及哪些提示词和检索文档,以及是否由人工批准发布。这些信息既支持事件响应,也有助于后续的供应商评估。

组织还应审查合同条款,但不应将赔偿保障视为普遍保护。保障范围可能取决于获批准的服务、被禁止的提示词、对输出的修改,以及是否遵守提供商的安全措施。

anthropic google partnership 并未替客户解答这些问题。Google Cloud 可能提供基础设施和访问渠道,而 Anthropic 仍负责模型开发。采购方必须了解每家公司作出了哪些陈述,以及哪份合同适用于特定部署。

三个信号将显示 Anthropic 能否控制风险

下一阶段将由证据、授权行为和合作伙伴治理决定,而不是新闻标题中的赔偿估算。

第一个信号是 Anthropic 对起诉书的正式回应。其法庭文件应揭示该公司是否否认被指控的下载行为、质疑权属,或强调训练具有转换性。按来源逐一反驳,将削弱出版商关于无控制获取行为的叙事。

如果回应主要聚焦合理使用,来源问题就会更加暴露。图书诉讼已经表明,法院可以区别看待训练和获取行为。若要控制更广泛的信任问题,Anthropic 必须同时回应两者。

第二个信号是 Anthropic 是否宣布新的授权协议或更强的数据集文档。推进授权将表明,该公司将来源可追溯性视为产品和采购要求。这也会强化有偿 AI 训练访问的市场。

不过,新授权无法解决过去的行为。Sony 和 Warner 仍可就先前的复制行为寻求赔偿。Anthropic 还需说明,哪些模型或未来训练运行将受益于新获授权的材料。

第三个信号是 Google、Amazon 和企业客户如何调整围绕 Claude 的治理机制。他们无需放弃该模型,也可以要求更清晰的文档。更新采购要求、合同措辞或内容保护措施,将表明合作伙伴把版权视为运营风险。

沉默并不能证明漠不关心,因为许多谈判在私下进行。不过,云服务文档或模型风险流程中可见的变化,将表明该案件在任何判决作出前就已重塑商业行为。

竞争将影响这些决定。OpenAI、Google、Meta 和其他模型开发商也面临各自的版权纠纷或授权问题。Anthropic 并非唯一面对训练数据不确定性的公司。

区别在于历史的累积。Anthropic 已经因歌词、图书和在线内容面临诉讼。其此前的和解让 Sony 和 Warner 能够围绕知情与重复风险构建更有力的公开叙事。

当前的版权指控还涉及具名创始人,增加了个人和声誉层面的压力。这些主张能否在早期动议中存续,将是一个重要的程序性信号。

对于开发者而言,该案件说明不应把模型选择视为永久性的架构决策。应用应保留足够的抽象层,以便比较提供商、调整安全措施,或以不同方式路由敏感任务。

企业采购方应提出供应商能够用证据回答的具体问题。哪些内容类别已获授权?哪些控制措施可防止逐字复现?如何处理下架请求?哪份合同涵盖客户责任?

知识工作者应保持警惕,但不应假定每一条 Claude 回复都隐藏着侵权。生成文本被发布、商业化,或被用作受保护创意作品的替代品时,直接风险便会上升。

anthropic google relationship 会持续还是削弱,取决于的不止一场诉讼。关键考验在于 Anthropic 能否证明,其负责任 AI 承诺包括可追溯的数据获取。

未来三个月请关注法庭回应、授权活动和云合作伙伴治理。这些信号将共同显示,这场纠纷究竟仍是一宗可控的法律案件,还是会成为限制 Claude 企业增长的长期因素。

 
 

免费开始使用

一款本地优先的AI助手

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)和M-Chip Mac 。

你的 AI 工作伙伴

和 remio 一起高效工作

规划、创作、交付

一站式完成

bottom of page