404 Media 追踪稀有书籍流向亚马逊设施:扫描后被拆毁用于 AI 训练
独立科技媒体 404 Media 在一批稀有书籍中放入追踪设备,发现这批书最终被送往亚马逊位于拉斯维加斯的设施。报道显示,该团队接收大量纸质书,拆除书脊后快速扫描,书籍在过程中被毁。报道还称,面向 AI 训练的实体书采购已形成供应链,涉及训练数据来源、版权争议和合理使用诉讼。

独立科技媒体 404 Media 在一批稀有书籍中放入追踪设备,发现这批书最终被送往亚马逊位于拉斯维加斯的设施。报道显示,该团队接收大量纸质书,拆除书脊后快速扫描,书籍在过程中被毁。报道还称,面向 AI 训练的实体书采购已形成供应链,涉及训练数据来源、版权争议和合理使用诉讼。

a16z援引一篇于 7 月公布的研究称,Amazon 自助出版小说市场中,含有可检测 AI 生成文字的作品,已占研究样本观察销量约 40%。研究分析了 14,419 本 2023 至 2026 年间销售的自出版类型小说,并结合截至 2026 年 6 月的每日销量数据。研究还指出,AI 带来的核心变化不只是写书,而是以更低成本扩大供给、稀释读者注意力,并让市场替代与版权争议变得更敏感。

AI 音乐公司 Suno 表示,未来几周将为模型生成的音频加入水印,方便合作平台标记或拦截 AI 内容。公司未说明将采用哪种技术,也没有给出具体上线日期和下载额度调整细节。此举发生在 Suno 同时面对美国版权诉讼与德国法院不利裁定之后,外界关注点仍集中在其训练数据来源是否合法。

TechFlowPost 援引 Fortune、《华盛顿邮报》、Decrypt 和 404 Media 报道称,AI 公司对 2022 年前出版纸质书的需求,正在带动一条跨国采购、破坏性扫描和销毁原书的隐秘链条。Anthropic 版权案中的解封文件显示,该公司曾从盗版网站下载超 700 万本书,随后又启动代号“巴拿马项目”的纸书扫描计划。法院对相关案件的裁定,也让“买书后扫描并销毁原件”的做法在执行层面获得了更多空间。

从插画家、小说家到独立音乐人,越来越多创作者正把 Google、Meta、Anthropic 等公司告上法庭,争议集中在 AI 训练是否使用盗版作品、是否构成合理使用,以及平台条款是否被扩大解释。Anthropic 此前以 15 亿美元和解作者集体诉讼,但围绕合法购书扫描训练、YouTube 数据使用和市场损害认定的分歧仍在延续。

Anthropic与部分作者、出版商等权利人达成的15亿美元集体诉讼和解,焦点不在于给AI训练定价,而在于法院将数据取得、资料库建设、模型训练和后续使用拆开审查。文章指出,调用第三方模型、使用RAG或获取公开和付费资料,都不意味着企业当然拥有复制、切片、训练和长期保存权限。对中国AI公司而言,当前更现实的治理路径是先控制新增高风险数据,再清理历史存量,并建立可追溯的数据台账、授权边界和退出机制。

Yuga Labs与艺术家Ryder Ripps达成和解,Ripps被永久禁止使用Bored Ape Yacht Club视觉元素。案件历经多年诉讼,涉及商标侵权与艺术表达边界,最终以和解告终。

Sony Music与AI音乐平台Suno的版权案将于7月在美国麻州联邦法院进入即决判决听证,核心争议是用受版权保护录音训练AI是否构成合理使用。
