top of page

Anna’s Archive 法院命令:美国法官要求删除 WorldCat 抓取的数据

已更新:6月17日

Anna’s Archive Court Order: US Judge Demands Deletion of WorldCat Scraped Data

Online Computer Library Center (OCLC) 与全球最大的影子图书馆之间的法律斗争已达成一个决定性的(尽管是理论上的)结论。2026年1月,美国俄亥俄州南区地方法院的 Michael Watson 法官发布了一项缺席判决,要求 Anna’s Archive 停止与抓取的目录记录相关的运营。该 Anna’s Archive court order 强制要求删除约 2.2 TB 的 WorldCat 数据,并对该网站发布了永久禁令。

虽然该裁决为 OCLC 赢得了法律上的胜利,但擦除一个去中心化、匿名档案库的实际情况要复杂得多。该网站的管理员并未出庭,而推动该档案库的社区继续通过种子(torrents)和镜像站复制数据。

当前状态:无视 Anna's Archive Court Order 访问数据

在剖析法律论据之前,查看运营现状至关重要。法院可能已下令删除数据,但 Anna’s Archive 的架构使得合规性几乎无法直接强制执行。

镜像站、种子与用户韧性

Anna’s Archive 的主要 URL 端点经常变动。在 .org 和 .se 域名被扣押后,该平台已迁移到 .li 或 .pm 等不同的 TLD。对于关注 Anna’s Archive court order 的用户来说,首要关注点通常是访问的连续性。

诉讼中提到的 2.2TB WorldCat 数据与图书文件本身是分开的。它包含元数据——本质上是全球图书的卡片目录。虽然裁决针对的是这一特定数据集,但更广泛的影子图书馆是在强大的点对点基础上运行的。

  • Torrents: 整个数据库被切分为海量的种子文件。拥有足够存储空间(通常需要企业级配置或大型 NAS 阵列)的用户在全球范围内进行做种。

  • IPFS: 星际文件系统链接允许内容在没有中央服务器的情况下存在,使得单一的拆除令失效。

  • Shadow Mirrors: 当域名被扣押时,后端基础设施通常保持不变,允许新域名几乎立即指向现有的相同数据。

Reddit 等平台上的社区讨论表明,虽然普通用户可能会因链接失效而苦恼,但“高级用户”和数据囤积者已经获取了被针对的 WorldCat data deletion 文件。“史翠珊效应”在此显现:法律压力越大,担心数据被彻底封杀的档案保管员们备份数据的速度就越快。

OCLC 诉讼缺席判决详解

The OCLC Lawsuit Default Judgment Explained

这一裁决的达成极具策略性。OCLC 最初寻求数百万美元的货币赔偿。然而,从利用境外托管和加密货币的匿名运营者手中索取资金极少能成功。意识到这一点后,OCLC 改变了策略。

放弃损害赔偿以换取永久禁令

为了加快进程,OCLC 自愿撤回了经济赔偿请求。这为 Watson 法官发布专注于禁令救济的缺席判决扫清了障碍。其目的不是为了拿到钱,而是为了拿到一张纸——即 Anna's Archive court order——从而可以将其作为武器对付合法企业。

该命令要求 Anna’s Archive:

  1. 停止抓取 OCLC 的服务器。

  2. 删除所有专有的 WorldCat 记录。

  3. 停止向公众分发抓取的元数据。

通过获得该命令,OCLC 现在可以接触第三方基础设施提供商——例如美国域名注册商、Cloudflare 等内容分发网络 (CDN) 或上游 ISP——并迫使它们与该网站切断联系以规避责任。

“动产侵占” (Trespass to Chattels) 与违约

Watson 法官所使用的法律推理对整个科技行业具有重要意义。法院认定抓取活动构成了“动产侵占”——这是一种古老的侵权行为,最初旨在保护实物财产(如牲畜)免受干扰。在数字时代,这意味着抓取者未经许可使用 OCLC 服务器的处理能力,从而“损害”了其服务器。

此外,法官验证了“浏览型协议” (browsewrap) 理论。他裁定,Anna’s Archive作为一个从事大规模自动化抓取的成熟实体,仅通过使用网站就受其服务条款的约束,即使没有点击“我同意”按钮。这建立了一个可能在未来涉及数据收集的案件中被引用的先例。

WorldCat 数据删除的机制

The Mechanics of WorldCat Data Deletion

这场争议核心的具体数据集规模巨大。它代表了数百万条详细记录,说明了哪些图书馆持有哪些书籍。对于 OCLC 而言,这是一个商业产品;而对于 Anna’s Archive,它是绘制人类所有知识图谱的一块拼图。

为什么这些数据很重要

Anna's Archive 抓取这些数据是为了让用户能够解析 ISBN,并定位他们无法下载的图书的实体副本。法院强制要求WorldCat 数据删除旨在堵住这一特定的漏洞。

然而,在去中心化时代,“删除”的定义是模糊的。OCLC 理论上可以强迫 Anna's Archive 中心网站从其搜索栏中移除索引(如果他们能找到服务器的话)。但是,他们无法从分布在俄罗斯、中国和欧洲的数千名独立做种者的硬盘中删除那个 2.2TB 的文件,因为这些人不在俄亥俄州法院的管辖范围内。

争议:影子图书馆 vs. 企业级 AI

在围绕 Anna’s Archive 法庭禁令 的讨论中,一个反复出现的主题是美国法律在对待数据抓取(scraping)时表现出的双重标准。

AI 豁免感知

批评者和用户指出,包括 OpenAI、Google 和 Anthropic 在内的主要 AI 公司经常抓取受版权保护的材料(包括元数据和全文)来训练 Large Language Models (LLMs)。这些公司通常依赖“合理使用”辩护。

这种挫败感源于执法上的不平等:

  • 营利性 AI: 抓取互联网以构建商业产品,通常通过和解诉讼或游说以获得有利的监管。

  • 非营利档案馆: 抓取互联网以提供普遍的知识获取渠道,却面临即时的“侵入”指控和版权判决。

虽然法律细微差别有所不同(AI 转换数据;档案馆分发数据),但 WorldCat 数据删除 命令对学术界和保护主义者群体而言带有惩罚性质,因为这些群体依赖这些资源,且无法负担机构访问费用。

执行:将缺席判决武器化

Implementation: Weaponizing the Default Judgment

由于 Anna’s Archive 的运营者不太可能现身并点击“删除”,该法庭命令的真正效用在于其对中间机构的可执行性。

针对供应链

该判决充当了 OCLC 法律团队的万能钥匙。他们现在可以将此命令送达至:

  1. 域名注册商: 如果 Anna’s Archive 通过美国关联的注册商购买域名,该命令将强制立即暂停。

  2. 托管提供商: 任何位于美国领土上(或由美国实体拥有)且托管镜像的服务器机架,都可能在法律上被强制清除数据。

  3. 搜索引擎: Google 和 Bing 可能会被要求对与 WorldCat 数据相关的特定 URL 进行去索引处理,从而将该存档进一步推向暗网。

这一策略迫使存档退缩到对美国版权法缺乏尊重的司法管辖区内的“防弹”托管环境中,这通常会增加维护网站的成本和技术难度。

影子图书馆的未来展望

这份 Anna’s Archive 法院命令 与其说是致命一击,不如说是一次被迫的进化。该网站已经证明了其生命力,在多次 ISP 封锁和域名扣押中幸存下来。

该判决为数据所有权开创了一个危险的范例。通过成功辩称抓取公开数据属于“侵入”,OCLC 为其他数据垄断者封锁信息建立了一套剧本。然而,技术现实并未改变:只要去中心化网络存在,俄亥俄州的一项法院命令就无法删除存储在雷克雅未克私有服务器上的文件。数据已经外泄,这场猫鼠游戏只是升级到了更高水平的加密与混淆。

FAQ:Anna’s Archive 法院判令与访问相关问题

1. Anna’s Archive 的法院判令会永久关闭该网站吗?

极不可能。法院判令允许 OCLC 向总部位美国的服务器提供商施压以封锁该站点,但该归档库采用去中心化运营,使用国际镜像和 torrent 协议,很难被完全审查。

2. WorldCat 数据删除要求的具体内容是什么?

法官下令删除从 OCLC 数据库抓取的目录记录(元数据),而非实际的书籍文件。这些数据有助于将 ISBN 与图书馆位置关联,但删除这些数据并不会移除该网站上托管的可下载书籍。

3. 在此判决后,用户访问 Anna’s Archive 是否违法?

该判决是针对网站运营者的民事判决,而非针对个人用户。然而,根据您当地的版权法,访问受版权保护的内容仍存在法律风险,尽管用户很少因下载而受到针对性的个人起诉。

4. 针对 Anna’s Archive 的缺席判决是如何运作的?

由于该归档库的管理员从未出庭辩护,法官自动判定 OCLC 胜诉。这使得 OCLC 能够在不经过漫长审判的情况下获得他们想要的禁令。

5. 我还能通过 torrent 下载 WorldCat 数据吗?

可以。虽然主网站可能会被迫删除直接链接或索引,但数据的 torrent 文件(磁力链接)已经广泛分布在互联网上,无法通过法院命令远程删除。

6. 为什么 OCLC 要起诉 Anna’s Archive?

OCLC 起诉是因为 Anna’s Archive 从 WorldCat 抓取了数百万条记录 以建立自己的搜索引擎。OCLC 认为这威胁到了他们的商业模式,并因其服务器过载而构成了“动产侵权”。

 
 

免费开始

一款本地优先的AI助手,具备个人知识管理功能

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

在你的大脑里添加一个搜索栏

Ask remio

记住一切

​无需整理

bottom of page