Anthropic 报告点名七家中国 AI 公司涉模型蒸馏争议

Anthropic 报告点名七家中国 AI 公司涉模型蒸馏争议

N
News Editor
2026-09-11 09:25:03
Anthropic 在 9 月 10 日发布的最新威胁情报报告中,点名阿里巴巴、月之暗面、DeepSeek、智谱、小米、商汤和 MiniMax,指控其存在未经授权的模型蒸馏活动。报告称,阿里在今年 5 月至 7 月期间被观察到超过 1.51 亿次可归因交互;月之暗面和 DeepSeek 还被指曾将部分用户请求转交给 Claude。到 2026 年 9 月 11 日核验时,七家公司尚未见可核实的正式回应。

Anthropic 再次在威胁情报报告中点名中国 AI 公司。

9 月 10 日,Claude 开发商 Anthropic 发布最新报告,点名阿里巴巴、月之暗面、DeepSeek、智谱、小米、商汤和 MiniMax 七家公司,称其开展了未经授权的模型蒸馏活动。

报告中规模最大的一项指向阿里。Anthropic 称,今年 5 月至 7 月,观察到超过 1.51 亿次可归因于阿里的交互,用于提取 Claude 的推理能力。

另一部分指控涉及用户请求流转。Anthropic 表示,月之暗面和 DeepSeek 曾将部分用户请求转交给 Claude,再把 Claude 的回答返回给用户;还有公司被指将用户对话用于生成训练数据。

这些内容均来自 Anthropic 公布的调查结论。

报告覆盖哪些内容

这份报告覆盖的是 2025 年 12 月至 2026 年 8 月期间,Anthropic 称其发现并阻断的 AI 滥用活动,涉及网络攻击、监控、舆论影响、诈骗、生物领域滥用、常规武器开发和蒸馏七类问题。

报告提到的一个主要观察是,攻击者越来越多地让 AI 直接执行和协调任务,例如自动推进网络入侵,或运营大量虚假交友账号。

与中国 AI 模型直接相关的是蒸馏章节。Anthropic 对七家公司的统计基于不同观察时间,文中也提示,这些数字不能直接当作同一时期的使用量排名。

Anthropic 所说的“非法蒸馏”指什么

蒸馏通常可以理解为让一个模型跟着另一个模型学习:先由能力更强的“教师模型”生成答案或推理过程,再把这些材料用于训练“学生模型”。Anthropic 在报告中承认,蒸馏本身是常见的训练方法。

它在报告里所称的“非法蒸馏”,是指未经授权、以隐蔽方式进行、并达到工业规模的能力提取。按其描述,相关活动可能借助代理“中转站”、虚假账号或被盗凭证绕过访问限制,再大规模收集模型输出。

Anthropic 认为,这轮争议的重点在于模型的推理过程。最终答案只能告诉训练模型结果,推理过程则包含如何分析和完成任务的路径,因此更适合作为训练材料。报告称,相关提取行为主要针对编程、工具调用、数据分析和长流程任务等能力。

按文中逻辑,判断争议不能只看是否使用蒸馏技术,还要看数据来源、访问是否获得授权、是否绕过限制,以及用户是否知情。仅凭使用蒸馏技术,无法直接判断一家公司的具体行为是否违法。

为什么用户数据也被卷入争议

按照 Anthropic 的说法,部分月之暗面和 DeepSeek 用户原本以为请求被提交给自己选择的模型,实际却被转发给了 Claude。

如果这一指控成立,随之而来的问题包括:用户信息经过了哪些服务商,以及这些内容是否被进一步用于模型训练。

不过,Anthropic 在原文中对用户是否获得通知的表述并不完全一致。以月之暗面为例,报告写的是,Anthropic 不知道该公司是否通知了客户。

Anthropic 还提出了一个安全层面的理由:即使提取了模型能力,也未必会连同原模型的安全限制一起复制过去。这也是其将蒸馏列入威胁报告的原因之一。

报告披露的应对措施包括检测异常提取行为、封禁相关账号、以摘要替代完整推理内容,以及加强身份验证。

被点名公司尚未见到可核实正式回应

截至 2026 年 9 月 11 日本文资料核验时,尚未找到上述七家公司针对这份 9 月报告的可核实正式回应。

不过,围绕蒸馏的公开讨论此前已经出现。7 月 24 日,微软发布了一封由 Hugging Face、Meta、Mistral、英伟达等企业共同签署的公开信。

这封公开信主张,政策制定者应区分正常的模型开发技术与不当侵占。信中认为,蒸馏是广泛使用的模型改进方法;对于非法提取闭源模型价值所引发的问题,应通过更有针对性的法律和商业规则处理,而不是把限制扩大为对技术本身的一刀切约束。

业内对蒸馏作用与边界存在分歧

技术层面并没有形成统一看法。

7 月 23 日,TechCrunch 在讨论 Kimi K3 的蒸馏争议时,引用了 AI 研究者 Nathan Lambert 的观点。他表示,随着模型越来越接近前沿水平、训练重心转向强化学习,仅靠监督微调式蒸馏,已经很难解释全部能力提升。

Laude Institute 研究者、Snorkel AI 联合创始人 Braden Hancock 也认为,美国舆论低估了中国团队的技术实力。

这些表态讨论的是蒸馏的技术作用和监管边界,并没有逐项核验 Anthropic 9 月报告中的具体指控。

争议焦点仍待更多信息披露

目前外界看到的主要还是 Anthropic 的单方面调查结论。被点名企业是否会回应相关账号和数据来源、用户请求是否确实被转发、相关训练数据如何获得授权,仍是后续需要观察的重点。

文中提到的几个关键问题也尚未得到公开解答,包括 1.51 亿次交互如何完成归因、用户请求是否经过授权转发、哪些对话被用于训练。

这场争议也把普通用户卷了进来。当用户向一个 AI 产品输入代码、商业资料或私人对话时,背后处理这些信息的是否只有页面显示的那个模型,已经成为此次事件引发的核心疑问之一。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。