白宫科技政策办公室(OSTP)于 4 月 23 日 发布国家安全备忘录 NSTM-4,首次以政府名义确认,中国AI公司正对美国主要模型厂商发起“工业规模”蒸馏攻击。文件称,这类仿制模型在生成过程中被系统性移除安全协议,白宫��同步启动一套四步反制计划。
蒸馏原本是机器学习中的常规方法,用于让小模型学习大模型能力,压缩出更轻量的版本。问题出在未经授权、持续性地从闭源模型提取知识。OSTP助理、总统助理 Michael J. Kratsios 在NSTM-4中表示,情报显示外国实体——主要位于中国——正在刻意锁定美国主要AI厂商进行模型蒸馏。这类模型未必能完整复制原始模型性能,却能让外部行为者以极低成本推出在特定基准测试中看似接近的产品。
白宫称仿制模型被剥离安全协议
OSTP在官方X账号补充称,蒸馏后的仿制模型“剥除了安全协议,偏离中立与追求真相的目标”。文中提到,相关攻击方式包括动用数万个代理账户以及 jailbreaking 技巧,借此系统性暴露闭源模型的专有信息。
这份表态并非孤立事件。素材显示,Anthropic在今年 2 月 已点名 DeepSeek、Moonshot、MiniMax 三家中国AI公司,称对方通过约 2.4 万个欺诈账户,在 Claude 模型上制造超过 1600 万次对话,试图系统性提取其核心能力,范围包括 agentic reasoning、程序编写与数据分析、评分能力以及计算机视觉。按文中说法,这是目前公开记录中规模最大的AI蒸馏攻击指控之一。
四项动作指向情报共享、协同防御与追责
NSTM-4列出四个行动方向。第一,与美国AI厂商主动共享大规模蒸馏攻击情报;第二,协助私营部门强化防御协调机制;第三,与私营部门合作建立更高强度防线,封堵蒸馏攻击的技术入口;第四,探索让外国行为者承担后果的手段。
关于第四项,退役美军四星上将、前NSA局长暨美国网战司令部司令 Paul Nakasone 在采访中提到几种可能路径,包括出口管制、外交抗议以及定向技术限制。素材还提到,NSTM-4发布时点处于川习峰会前数周,这份备忘录已将AI蒸馏攻击上升为美国政府的正式关切事项,而不再只是企业层面的版权争议。
价格差距构成蒸馏攻击的经济诱因
文中还给出一组市场报价,用来说明蒸馏背后的成��逻辑:Claude Opus 4.6 每百万 token 报价 5 美元,ChatGPT-5.4 Pro 为 30 美元,而 DeepSeek V3.2 每百万 token 仅 0.26 美元。这一价差被视为蒸馏攻击的重要经济诱因——以较低API成本换取原本需要长期研发与算力投入才能积累的能力。
从OpenAI的版权指控、美国国会议员提出《AI盗窃法》,到OSTP此次正式发布备忘录,围绕AI知识产权与模型安全的争议正在进入国家安全层面。当前公开信息里,白宫已明确态度,接下来外界关注的焦点将落在“让外国行为者承担后果”的具体落地方式。

