Anthropic称Claude已写80%代码,公开呼吁全球AI设“刹车机制”

Anthropic称Claude已写80%代码,公开呼吁全球AI设“刹车机制”

N
News Editor 01
2026-07-23 06:05:15
Anthropic披露,Claude已生成公司超80%的合并代码,并称工程效率较2024年显著提升。同一时间,公司提出建立可验证的全球AI放缓或暂停机制,引发外界对其动机与可执行性的争议。
AnthropicClaude人工智能AI安全IPO

Anthropic研究团队6月4日发布《When AI Builds Itself》时,先抛出了一个最醒目的数字:截至2026年5月,Claude已写出Anthropic产品代码库中超过80%的合并代码��公司同时提出,全球最好具备一种在必要时“可验证地放缓或暂时暂停前沿AI开发”的机制。这两个信息被放在同一篇文章里,迅速引发讨论。

按Anthropic披露,Claude参与写代码的占比,在2025年初Claude Code上线前还只是个位数。到2026年,这一变化已经反映到内部产出上:从工程量化指标看,平均每位工程师每季度合并的代码行数,相比2024年第二季度到2026年第二季度增长了8倍。另一项面向130名研究团队员工的内部调查显示,受访者估算Mythos Preview带来的生产力提升中位数为4倍

独立处理软件任务的时长,从4分钟拉长到12小时

Anthropic用一条时间线说明Claude的能力变化。2024年3月,Claude Opus 3能独立完成一个相当于人类约4分钟的软件任务;到了2025年3月,Claude Sonnet 3.7将这个时长推高到90分钟;再到2026年3月,Claude Opus 4.6已可处理长达12小时的软件任务。

公司称,这不是平缓增长。任务时长的倍增周期已从7个月缩短到4个月。在具体案例里,Anthropic提到,Claude在2026年4月独立完成了800多项API错误修复,并将某一类错误发生率压低1000倍。一名工程师估算,如果把同样工作量交给人类,需要4年。

研究场景里的对比也被放进文章。Anthropic称,两名人类研究员花一周时间,在一个AI安全问题上恢复了23%的性能差距;而Claude代理群累计投入800小时、使用约1.8万美元算力后,恢复了97%。截至2026年5月,Anthropic判断Claude生成代码的质量已经与人类工程师持平。公司原话是,2025年底时Claude写的代码还不如人类,现在已经打平,并预计一年内会严格优于人类。

IPO申请后提出“可验证放缓”,争议随之扩大

在释放上述进展的同时,Anthropic提出应建立全球性的“可验证放缓机制”。素材显示,Anthropic于6月1日9650亿美元估值递交IPO申请,随后在6月4日公开呼吁前沿AI开发在必要时放慢或暂停。时间点靠得很近,外界质疑声随即出现。

共同创办人Jack Clark给出了一个更具体的判断:他认为AI在2028年底前实现递归自我改进的概率为60%。但多名批评者并不接受Anthropic当前的表述。Bentley大学数学教授Noah Giansiracusa对《Scientific American》表示,他不认为Anthropic是真心想放慢速度,并称Dario Amodei的现实立场是全速推进,因为“暂停在现实中根本不可能执行,零概率”。佐治亚理工学院教授Mark Riedl则认为,大型AI公司都在搭乘“递归自我改进”的叙事列车。

争论焦点:更强的编码工具,还是接近自主改进

纽约大学教授Gary Marcus的批评更集中。他认为Anthropic把两件事混在一起讲:一种是AGI,也就是AI能够自主完成人类能做的一切;另一种则是更贴近当下现实的情况——AI作为速度极高的编程工具,大幅放大工程师产出。Marcus指出,Anthropic展示的数据属于后者:Claude确实写了大部分代码,但目标设定、方向选择和结果审查仍由人类掌控。

Anthropic自己的数据,也部分支持这一判断。文章提到,Claude在“选择下一步研究方向”上的正确率,从2025年11月的51%升至2026年4月的64%。这个数字比此前更高,但仍意味着每3次中有超过1次会选错方向。素材中的匿名员工也承认,人类当前的比较优势,仍在于看到更大的图景,思考超出当前任务范围的问题。

全球暂停机制为何难落地

Anthropic把“可验证的全球放缓机制”类比为冷战时期的《中导条约》。但文章同时承认,AI训练设施与核武部署并不相同。核设施可以依赖卫星识别,模型训练却未必能被同样方式发现;算力设施还能远程调用,隐蔽性更高。

公司也加上了一个前提:只有在其他处于前沿位置的开发者也能以可验证方式同步放缓时,Anthropic才会放慢或暂停。这使问题回到博弈结构本身——如果没人相信别人会停,所有参与者就都倾向于继续推进。就素材给出的信息看,Anthropic一边展示Claude在代码生成上的迅速逼近,一边主张建立全球刹车机制,真正引发争议的,正是这两条线在同��时点出现。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。