OpenAI CEO 萨姆·奥特曼在与 Salesforce CEO Marc Benioff 的对谈中,披露了公司内部模型的最新进展,并给出了一个以数学能力为核心的判断标准。

按他的说法,「GPT-5.5 的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前 1% 到 2% 的顶尖数学教授。」
更受关注的是他随后提到的另一款内部模型。奥特曼称,在代号为 Astra 的模型之后,OpenAI 还有一个「Post-Astra」内部模型,「它已经能够解决世界上最顶尖数学家都束手无策的难题」。
OpenAI 将数学能力标尺推到顶级学者层面
这场访谈中,奥特曼对不同代际模型的数学能力做了分层描述。按照他的表述,GPT-5.5 对应普通数学教授,GPT-5.6 则接近全球前 1% 至 2% 的顶尖数学教授,而「后 Astra」模型被描述为已经跨过这一层级。

原文据此进一步展开称,OpenAI 对大模型理科能力的衡量标准,已经不再停留在高考或奥数题层面,而是直接对照人类顶级学者的研究能力。
围绕这一说法,原文也提到外界存在不同反应。有人对该模型能力表示震惊,也有人保持警惕,认为相关表述仍需更多可验证信息支撑,并提到此前已出现聊天记录泄露的情况,质疑 AI 是否只是吸收了人类数学家的灵感,而非独立创造。
Greg Brockman 称另一道千禧年大奖难题也有重大进展
除奥特曼的表态外,OpenAI 总裁 Greg Brockman 也在公开场合表示:「我们还在另一个『千禧年大奖难题』上取得了重大进展。」

原文称,此前关于「纳维尔-斯托克斯方程」被突破的传闻,已经在数学界引发震动。报道援引说法称,OpenAI 为此投入了至少 1500 万美元算力,生成了长达 166 页的证明过程,并通过 Lean 的严格验证。
在这一背景下,Brockman 再次提到另一道千禧年大奖难题的进展,使外界对 OpenAI 当前数学研究能力的关注继续升温。
原文列出了目前仍未解决的 5 个千禧年难题:

- P 与 NP 问题
- 黎曼猜想
- 杨-米尔斯规范场与质量间隙
- 霍奇猜想
- BSD 猜想
其中,原文特别提到 P 与 NP 问题,并讨论了如果 AI 证明 P=NP 可能带来的影响;同时也提到有传闻称,OpenAI 可能已接近解决霍奇猜想或 BSD 猜想。不过,这些内容在文中均未给出进一步证据。
Scott Aaronson 发文称「奇点已经到来」
与 OpenAI 高管表态几乎同时,德州大学奥斯汀分校教授、理论计算机科学家 Scott Aaronson 近期发布长文《奇迹与恐怖的时代》。
原文称,Aaronson 曾长期对 AI 风险论持怀疑态度,甚至在 20 年前表示,除非 AI 能解开千禧年数学难题,否则无需为此恐慌。但在这篇新文章中,他的态度出现明显变化。
Aaronson 在文中写道:「在我看来,奇点已经到来了……在剩下的岁月里,我大概再也不会去证明任何一个定理了。因为世界不再『需要』我去证明。如果我还在做数学,那仅仅是为了我自己或他人的娱乐,就像人类下国际象棋一样。」

他还在文中公开向 AI 风险论者 Eliezer Yudkowsky 致意,称「你关于文明最大挑战的预言是对的,而我和其他人都错了」。
原文还引用了 Aaronson 对家庭与下一代未来的担忧。他写道,晚上哄孩子睡觉时会想到,他们未来还能拥有什么样的前景;并提到自己 13 岁的女儿半开玩笑地说,如果她想成为数学家,看起来大概只剩下两周时间了。
学术界对 AI 数学研究能力的担忧升温
Aaronson 在文章中还列举了过去几个月里多个在 AI 协助下完成或由 AI 攻克的公开问题。原文提到,雅可比猜想的反例由 Anthropic 研究员借助名为 Fable 的 AI 模型得到;黎曼几何中格罗滕迪克常数的边界被大幅改进;费马大定理在 Lean 中完成全面形式化验证;量子计算领域则出现了 Watrous 的解缠结猜想证明以及 QMA 的完美完备性证明等进展。

他将当前学术圈的状态比作《魔戒》中的攻城战,并写道,如果现在去和学术期刊编辑或会议主席交谈,场面就像刚铎或洛汗的人类在城墙上加固防御,准备迎接 5 万名半兽人大军的进攻。按他的说法,人类审稿人只能借助 AI 审阅论文,否则防线会迅速被冲垮。
围绕这一变化,原文提出了一系列问题:未来论文如何署名;如果证明过程人类都难以读懂,数学研究的意义是否会被重新定义;当人类角色退到校对和翻译位置后,数学共同体的「人类性」是否会被削弱。
原文还提到,以陶哲轩为首的 25 位菲尔兹奖得主已发出公开信,讨论数学是否正在失去其「人类性」。文中称,这封公开信并未要求关闭 AI,而是把焦点放在数学作为人类社区、理解过程与交流传统是否会被改变。

原文称顶尖人才正转向 AI 安全与对齐
在文章结尾部分,原文将这种变化描述为硅谷和顶尖高校中的一场「人才大逃亡」。报道提到,无数天才物理学家和数学家,包括普林斯顿高等研究院的 Mike Winer,正在放弃原有学术路径,转向 AI 安全与对齐领域。
原文给出的原因是,这些人认为继续在黑板上推导公式的意义正在下降,而更紧迫的任务,是确保这个即将诞生的「机器神明」不会在醒来的第一秒把全人类当成需要被抹除的 Bug。
本文参考资料包括奥特曼与 Marc Benioff 的对谈视频,以及 Scott Aaronson 的博客文章《奇迹与恐怖的时代》。原文署名显示,本文来自微信公众号「新智元」,作者为 Aeneas。

