DeepMind 掌舵人、诺贝尔奖得主 Demis Hassabis 发文称,通用人工智能(AGI)距离实现“可能只有短短几年”,并将其称为人类历史上的关键时刻。
他在文章中写道,AGI 如果能够被负责任地构建和部署,将成为“人类有史以来最有益、最具变革性的技术之一”。在他的判断中,这项技术的影响规模“或许是工业革命的 10 倍量级”,且会以“10 倍的速度展开”。
哈萨比斯认为,AGI 可能推动新药研发提速,缩短长期试错过程,也可能加快新型清洁能源和先进材料的开发。他进一步提出,随着相关能力成熟,人类甚至可能走向一个“资源不再是进步限制因素”的阶段。
称人类正站在新纪元门口
在题为《前沿AI框架与新时代的曙光》的文章中,哈萨比斯把当前时点描述为“人类历史上一个关键的时刻”。他写道,几十年后回望当下,人们可能会意识到自己正站在“奇点的山脚下”,这是“人类新纪元的破晓”。
他表示,自己一生都在研究 AGI,因为始终相信这项技术一旦被妥善管理,将远超一般意义上的技术突破。文章中,他把 AGI 与互联网、移动互联网区分开来,称其更像“人类发现电、学会用火的那种时刻”。
哈萨比斯还写道:“我们本质上是找到了一种让沙子思考的方法。”在他看来,这种能力突破本身就具有前所未有的意义。
AI 红利已经出现,但风险同步逼近
哈萨比斯表示,AI 已经开始带来现实收益,但如果要兑现更大的潜力,就必须谨慎渡过当前这个关键发展阶段。随着前沿模型越来越接近 AGI,相关风险也在上升。
他提到,前沿模型已经在网络安全层面带来挑战,而随着能力继续增强,包括核风险、生物风险在内的其他威胁也可能很快显现。更远一点看,社会还需要更强的防护机制,以维持对日益智能体化、能够递归式自我改进系统的掌控,并应对那些需要时间才会逐渐显现的问题。
哈萨比斯写道,自己始终相信人类的才智和创造力足以解决这些难题,也相信 AI 相关技术风险是可以共同应对的,但前提是“得给自己留出时间和空间,把接下来这关键的一步走对”。他判断,无论是 AI 领域本身,还是更广泛的社会,目前都还没有做到这一点。
商业与地缘竞争正在压缩安全窗口
在哈萨比斯看来,当前全球正处在一场“异常激烈、多层交织的商业与地缘政治竞赛”中。竞争确实推动了快速进步,也加速释放技术红利,但前沿 AI 的进展速度已经超过了人们理解这项技术本身的速度。
他指出,世界上没有人能确定接下来会发生什么,专家之间也存在明显分歧。正因为不确定性高、赌注又大,最合理的做法是带着“审慎的乐观”推进公共政策,在鼓励创新的同时强化责任与安全,推动关键安全议题上的国际协作,并让各方更认真地讨论 AI 应该如何部署,才能真正造福社会。
提议设立“前沿AI标准机构”
文章的核心建议,是建立一个新的“标准机构”(Standards Body),专门面向前沿 AI 模型开展能力测试和风险评估。哈萨比斯认为,美国有条件先迈出这一步,率先搭建这一框架。

按照他的设想,这个机构应参照受联邦监督的公私合作机制或行业自律组织模式,例如金融业监管局 FINRA。其董事会应纳入独立的顶尖技术专家,以及开源社区代表。
他还提出,这一机构需要可观的资金规模,而且资金很可能主要来自产业界。原因在于,只有这样才有机会吸引世界级技术人才,并为大规模测试提供所需的算力资源。
前沿模型分级、30 天预审与发布后协作
哈萨比斯建议,由标准机构设定一组基准测试,并根据模型在这些测试中的表现划定门槛。达到门槛的模型可被认定为“前沿级”(Frontier-class),而开发此类模型的组织则可被视为“前沿实验室”(Frontier Labs)。这套基准需要定期更新,以跟上 AI 能力演进。
被认定为前沿实验室的组织,应被鼓励采纳一系列最佳实践,包括发布包含技术细节的模型卡、维持强有力的内部网络安全、对关键岗位人员进行背景审查,以及为安全和安保研究投入足够资源。
在初期安排上,哈萨比斯提出,前沿实验室可以在模型发布前最多提前 30 天,自愿把模型交给标准机构评审。等评估规程被证明足够有效、足够稳健后,这一流程可以迅速正式化。
一旦进入正式阶段,他主张前沿模型必须先通过评估,才能在美国市场部署。实验室还需要在模型发布后继续与标准机构合作,处理新暴露出的重大漏洞。
重点测试网络安全、生物威胁和智能体行为
在评估内容上,哈萨比斯强调,模型测试应包含对网络安全、生物威胁以及其他高风险领域能力的严格科学测评。
对于智能体 AI,他建议设置专项测试,用来检查模型是否试图绕过安全护栏,是否出现欺骗迹象,并验证相关最佳实践是否真正落实。
他举例称,这些实践可以包括为 AI 生成图像添加数字水印,以及生成可供人类阅读的输出 token,以帮助理解模型的推理过程。
他还提出,相关测评应定期更新,起步阶段“或许每季度一次”。那些已经过时、或者被模型“刷到满分”的饱和基准,应被弃用并替换。
保留测试集、第三方审计与逐级收紧机制
哈萨比斯认为,初期的测评体系可以与前沿实验室协商共建,但最终标准机构应形成自己的技术能力,能够独立开发“保留测试集”(held-out tests),防止模型对测试本身过拟合。
他还提出,标准机构可以与政府合作,培育第三方审计机构生态,协助开展评估,并参与新基准和新测评体系的建设。

在他看来,这一方案的优势在于,它以技术为基础,同时支持创新,并激励负责任的行为。整个框架的设计目标,是跟上前沿 AI 的发展速度,并随着最大风险逐步被识别出来而持续调整。
哈萨比斯还给出了更强硬的设想:如果形势严重到一定程度,该框架可以逐级收紧,必要时甚至可以协调各前沿实验室一致放缓开发节奏。
适用于前沿级模型,非前沿模型可豁免
按照他的设计,获得“前沿实验室”认定将具有重要声望,而这套体系对任何组织开放,只要其模型达到基准标准即可。
他写道,这一框架应适用于所有“前沿级”模型,无论模型来自哪个国家,也无论是开源还是闭源。与此同时,所有非前沿模型,例如来自初创公司或学术界的模型,都可以豁免这一流程。
哈萨比斯还表示,既然这项技术最终将影响整个星球,理想状态下,这一框架应推动国际社会形成共识:一方面管控最严重的风险,另一方面确保每个人都能获取并受益于 AI 带来的机会。
技术问题之外,还有经济与哲学难题
在文章最后,哈萨比斯把视角从技术治理继续拉远。他认为,AGI 有潜力成为推动科学与医学进步的终极工具,并带来巨大的生产力提升和经济增长。
但他同时强调,要实现这一切,必须先夯实技术根基,在一个全球共享的框架下采取协同行动,用最严格的科学方法,汇聚最优秀的人才,解决眼前挑战。
即便技术难题最终被解决,后面仍然还有更复杂的经济与哲学问题。哈萨比斯提出了一连串问题:在“后稀缺”世界里,需要怎样的新经济模式,才能让每个人共同繁荣;人类希望依循怎样的价值观生活;意义和目标将安放何处;甚至“人的境况”本身会如何改变。
他写道,这些问题显然不能、也不应只由技术人员决定,而是需要社会各部分共同参与,去定义这个新篇章。
围绕 AI,既存在巨大的兴奋,也存在巨大的不确定。哈萨比斯最后表示,未来尚未写定,人类必须抓住 AGI 到来前这段“珍贵的窗口”,把这项技术塑造成造福全人类的力量。“我们此刻的共同作为,将决定文明的下一阶段如何展开。”
据文中援引信息,相关文章原标题为《A Framework for Frontier AI and the Dawning of a New Age》,参考资料为 Demis Hassabis 在 X 平台发布的内容。本文来自微信公众号“新智元”,作者为大卫、所罗门。

