刚发布最强通用模型,转身就喊AI太危险——Anthropic CEO Dario Amodei近日抛出重磅信号。他在长文《Policy on the AI Exponential》中,首次以公司最高领导人身份呼吁政府介入,对"前沿AI模型"的发布制定有法律效力的规范。Amodei引用的类比是商用航空:飞机要过FAA(美国联邦航空总署)安全审核,AI模型也应如此。
三大主张:量化门槛、网络安全、劳动取代
第一项主张是设定强制第三方测试的量化门槛:训练算力超过10^25 FLOPs,或年AI营收超5亿美元、AI研发支出超10亿美元的公司,旗下模型上市前必须通过独立审计。测试聚焦网络安全、生物武器、AI系统失控和自动化研发四个领域。Amodei表示:"前沿AI模型就像飞机,应被要求通过��术测试与审计;若未达高安全标准,其发布应被视为公共安全威胁而遭封锁或撤回。"政府在此框架下将获得法律授权,可封锁、延迟或劝阻部署。
第二项主张将AI定位为网络安全关键基础设施问题。Amodei引用自家模型Claude Mythos Preview——它已能在主要操作系统中找出高严重度漏洞,意味着攻防能力同步提升。框架要求前沿开发者保护"模型权重"(模型训练后存储的核心参数),防止被外部攻击者或内部人员窃取,并建立通报"模型蒸馏攻击"的法定渠道。
第三项主张政治敏感度最高:正面承认结构性劳动取代。经济政策框架明确指出,若AI达到预期能力,将是"劳动力的全面替代品"而非辅助工具。框架沙盘推演了失业率5%、10%甚至更极端情境,并倡议工资保险、全民基本收入(UBI)、主权财富模式等对应机制。为支撑这些主张,Anthropic宣布投入3.5亿美元:2亿成立"经济未来研究基金"用于试点公共政策,1.5亿办理全国奖助计划。Amodei收尾称:"关键挑战不是激励成长,而是找到让每个人都分享利益的方法。"
为什么是现在?FAA类比的逻辑与边界
这一框架选在��时发布,有两层背景。技术节奏上,Amodei认为过去风险轮廓不清晰,现在Claude Mythos Preview已能主动找出系统漏洞,"不够清晰"的理由不再成立。其次,FAA类比有其吸引力,但AI模型的"危险"高度依赖评估者判断框架,"前沿"定义每隔几个月位移一次,第三方测试机构的公信力与独立性尚未建立。Amodei承认,这框架是起点而非终点。
与川普松绑格局的碰撞
美国当前政策主旋律是松绑:川普政府主张让AI产业"野蛮生长",以正面竞争击败中国,甚至主动推平各州地方性监管壁垒。Amodei喊加码管制,方向直接逆风。他在文末尝试寻找跨党派语言:"这些政策构想有跨党派的常识性吸引力,我们愈早行动,每个人就愈能分享AI的好处。"但"常识性吸引力"能否转化为立法动能,在当前华盛顿政治生态下仍待观察。

