OpenAI被曝接近验证霍奇猜想,BSD 猜想也传出进入冲刺阶段
OpenAI在宣布用 88 小时攻破纳维-斯托克斯方程仅两天后,市场又传出其接近完成对千禧年难题霍奇猜想的验证。《纽约时报》报道称,OpenAI过去五年已在另一道千禧年难题上取得实质性进展,并准备公布结果。报道还提到,OpenAI与 Anthropic 似乎正同时冲击 BSD 猜想,部分工作已进入验证阶段。文章同时梳理了霍奇猜想、BSD 猜想的数学含义,以及千禧年难题最新进展。

OpenAI在宣布用 88 小时攻破纳维-斯托克斯方程仅两天后,市场又传出其接近完成对千禧年难题霍奇猜想的验证。《纽约时报》报道称,OpenAI过去五年已在另一道千禧年难题上取得实质性进展,并准备公布结果。报道还提到,OpenAI与 Anthropic 似乎正同时冲击 BSD 猜想,部分工作已进入验证阶段。文章同时梳理了霍奇猜想、BSD 猜想的数学含义,以及千禧年难题最新进展。

围绕纳维-斯托克斯方程的研究争议持续发酵。纽约大学数学家 Tristan Buckmaster 指控 OpenAI 在获悉研究方向后以大规模算力跟进,并试图主导论文发布与署名安排;OpenAI 研究员 Sebastien Bubeck 否认相关说法。菲尔兹奖得主陶哲轩随后发文称,AI 对有前景研究方向的算力围猎,可能迫使数学家停止公开交流,动摇延续数百年的开放科学传统。

27 岁的 AI 研究员 Jacob Coxon 在离开 Anthropic 后于 X 发文称,OpenAI 和 Anthropic 正朝可自我改进的超级智能加速推进,并把所有人的生命押在这场竞赛上。文中提到,他曾参与 OpenAI 的 GPT-4o 与 GPT-4.5 预训练工作,后来转至 Anthropic。Anthropic 多名研究人员随后公开表示支持,其中有人称未来 10 年内出现相关失控风险的概率高于 10%。

菲尔兹奖得主、UCLA 教授陶哲轩在 Mathstodon 发文称,推理模型和前沿 AI 系统正加速解决数学难题,甚至会因传闻而引发竞速,提前“压平”原本需要长期研究的问题空间。他认为,这种做法可能削弱数学领域对“什么问题值得做”的判断能力,并提出将部分问题标记为“需要分析”的设想,即仅给出答案并不足够,还要附带能启发邻近问题的推理过程。

OpenAI称其内部模型证明了纳维–斯托克斯方程可能出现“爆炸”,并由约1万名AI代理在88小时内完成、经Lean验证。纽约大学数学家Tristan Buckmaster则称,他与Anthropic数学家Levent Alpöge早已取得相关成果,并指责OpenAI试图抢先发布。

一则「Claude 已解决纳维-斯托克斯方程千禧年难题」的传闻在社交平台迅速发酵,源头之一是 Andrew Curran 的预测性帖子,以及陶哲轩此前围绕 AI 数学研究流程的假设性讨论。陶哲轩随后澄清,他并不了解该问题出现任何重大新进展。与此同时,Anthropic 和 OpenAI 近月披露的多项数学成果,也让外界开始更认真地讨论 AI 介入开放数学问题后的验证、知识沉淀与研究分工变化。

Anthropic 宣布其 AI 模型 Claude 耗时 11 天,将已有 350 年历史的数学难题费马大定理转化为 1300 万行代码证明。该证明无需人类信任,可由计算机自行验证。Anthropic 表示,这展示了 AI 在形式验证和复杂逻辑推理中的潜力,有望推动数学证明方式变革。

可逆计算与计算物理学专家 Michael P. Frank 表示,他曾让 GPT-5.6 Sol 连续约 33 小时研究费马大定理是否存在比怀尔斯-泰勒证明更简洁的路径,但任务最终被 OpenAI 系统强制终止。模型事后称,原因可能是会话占用资源过多,或 OpenAI 过去已做过类似尝试。围绕此次中止,外界也出现了保密、监管、常规安全机制和 bug 等不同解读。
