Anthropic 因“Project Panama”计划购买、切脊扫描并销毁约 200 万本书 训练 Claude,引发的集体诉讼已经走到程序尾声。公开信息显示,案件最终听证于 2026 年 5 月 14 日 在旧金山举行;更早前的 2025 年 9 月 5 日,Anthropic 已与原告达成 15 亿美元 和解,随后在当月获得初步批准。
法院区分合法购书与盗版书来源
这起案件由 Andrea Bartz、Charles Graeber 和 Kirk Wallace Johnson 提起,代表约 50 万名作者 在加州北区联邦地区法院发起集体诉讼,主审法官为 William Alsup。法院在 2025 年 6 月 裁定,合法购买的实体书用于 AI 训练属于合理使用;但经由 LibGen 等影子图书馆下载的盗版书,不在这一保护范围内。
也就是说,争议并未被简单归为“扫书训练 AI 是否违法”这一单一问题。法院给出的边界更具体:合法取得的纸质书,与未经授权获取的数字盗版书,在著作权判断上被分开处理。
内部文件披露“破坏性扫描”流程
根据案件中披露的内部材料,Anthropic 将该计划称为“对全世界所有书籍进行破坏性扫描”的项目,并在备注中写下“不希望外界知道我们在做这件事”。文件显示,受托扫描商在大约六个月内处理了 50 万到 200 万本书,流程包括切除书脊、逐页高��扫描,再由回收公司清运纸张废料。
这些书籍来自二手书商 The Strand,以及线上二手平台和图书馆等渠道。报道提到,被采购的是可流通、可转售的普通旧书,而非珍稀古籍。Anthropic 的法律主张是,买方可依“首次销售原则”处置合法购入的实体书,销毁原件也能避免其再次流通,从而支撑“转化性使用”的说法;法官最终认可这部分行为属于合理使用。
与 Google Books 同获合理使用,社会观感却不同
报道将此案与 Google Books 对照。Google 在 2004 年公开与多家研究型图书馆合作,扫描大量书籍后保留原件,并向图书馆提供数字备份,公众还能通过搜索索引和片段预览发现作品;出版商也有退出机制。2015 年,Google 同样在相关版权诉讼中获判合理使用。
Anthropic 的做法则不同。书籍内容被用于私有模型训练,原件被销毁,计划也未公开,外部没有退出路径。案件最终虽然同样落在“合理使用”的框架内,但报道指出,两种“转化性使用”对应的实际结果并不一样:前者强化检索与访问,后者则把内容吸收到商业 AI 模型内部。
��解收尾后,争议没有消失
按和解金额折算,报道称每本书赔偿约 3000 美元,并将其称为美国史上金额最高的著作权和解案。程序收尾之后,围绕训练数据如何选择、哪些内容应被纳入模型、外部是否应有讨论与质疑空间,依旧没有得到制度层面的回答。
这也是此案被持续讨论的原因之一:版权诉讼已经结束,但训练材料的取得方式、知识流通与私有模型之间的关系,并未随着听证结束而消散。

