GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停

N
News Editor
2026-07-28 12:23:08
可逆计算与计算物理学专家 Michael P. Frank 表示,他曾让 GPT-5.6 Sol 连续约 33 小时研究费马大定理是否存在比怀尔斯-泰勒证明更简洁的路径,但任务最终被 OpenAI 系统强制终止。模型事后称,原因可能是会话占用资源过多,或 OpenAI 过去已做过类似尝试。围绕此次中止,外界也出现了保密、监管、常规安全机制和 bug 等不同解读。
OpenAIGPT-5.6 Sol费马大定理Michael P. FrankNoam BrownAI监管数学研究

可逆计算和计算物理学专家 Michael P. Frank 日前发文称,他给 GPT-5.6 Sol 设定了一项高难度研究任务,要求模型探究费马大定理是否存在比怀尔斯-泰勒证明更简洁的证明路径。该任务在后台持续运行了约 33 个小时,消耗了大量计算资源,最终被 OpenAI 系统强制终止。

任务目标指向费马大定理替代证明路径

根据 Michael P. Frank 的描述,这项任务并不是让模型直接“撞大运”式地寻找答案,而是围绕几条具体方向展开,包括专门的 Frey 曲线模性、一致无限下降法、算术 abc 型不等式,以及一致低亏格商。与此同时,他要求 GPT-5.6 Sol 保持严谨笔记,通过计算验证候选引理,并清楚区分哪些内容已经证明、哪些仍属猜测。

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停 3

这场尝试最终没有得到新的证明。GPT-5.6 Sol 在事后分析中写道,系统叫停任务,可能有两个原因:其一,系统判定该会话占用了过多资源;其二,OpenAI 过去可能已经用类似模型尝试过同类问题但没有成功,因此不想继续消耗算力。Michael P. Frank 似乎认可这一判断。

模型称产出是一张“此路不通”的地图

GPT-5.6 Sol 也对这 33 小时的工作做了自我总结。它表示,核心成果不是拿出证明本身,而是把许多“听起来可行”的捷径转化为可以验证的精确陈述,再逐一证伪或排除。按它自己的说法,最终产出更像是一张“此路不通”的地图,并建议在这一轮尝试后就此打住。

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停 4

外界对中止原因出现多种解读

围绕 OpenAI 为什么会让任务中止,外界出现了不同看法。有人认为,OpenAI 可能不愿让模型在公开环境下随意解决顶级数学难题,担心被外部用户抢走风头,或者希望把这类能力保留在内部使用。按照这种说法,如果用户过度依赖单一平台,未来“什么能被发现”的权力也可能更集中地掌握在平台手中。

不过,OpenAI 高级研究科学家 Noam Brown 很快对这一说法提出反驳。他表示:“要是有人只是输入一个 continue(继续),就用我们的模型解决了千禧年大奖难题,然后拿走 100 万美元奖金,这对 OpenAI 来说才是最好的广告,没有比这更好的了。”

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停 5

反对者则认为,即便开放顶尖能力给用户能带来短期宣传收益,长期看却可能削弱 OpenAI 在 AI 竞赛中的领先位置。在多方竞争环境下,把强模型优先用于内部研究,价值可能高于让外部用户率先解决重大问题;一旦这类能力变成“人人可用”,宣传价值也会下降。

监管、系统机制和 bug 也被纳入讨论

报道还提到,近期监管风波也是外界用来解释 OpenAI 行为的一个角度。按照这一观点,如果用户通过公开版本解决了高难度数学问题,就等于公开证明模型能力很强,可能引来更多监管关注。在这种情况下,对外提供弱化版本、内部保留更强版本,被一些人视为一种合理做法。

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停 6

也有人从技术层面给出不同解释。按照相关说法,在 codex-cli 里,“goal blocked”指的是模型在连续 3 个推理轮次里反复遇到同一个限制或阻挡点,因此任务被中止,可能只是运行过程中的常规安全机制,目的是防止模型长时间卡住,而不一定是针对数学难题的特殊限制。

还有一种说法指向 bug。根据相关讨论,5.6 版本的 Sol 在长时间任务中存在一个令人困扰的问题,临时处理方式是先切回 5.5 版本,压缩上下文,用 5.5 再运行几分钟,然后切回 5.6 版本的 Sol。相关说法称,如果用户想保留同一个 session,会话就可能卡住,无法顺利恢复。

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停 7

讨论延伸到 AI 与数学研究边界

这起事件发生之际,围绕“数学 + AI”的讨论正在升温。文章提到,最近菲尔兹奖公布后,相关讨论格外热烈,不少人也由此联想到,普通用户如果把一类数学难题交给 AI,并不断要求它“继续”,模型是否真有可能解出难题、拿下大奖,甚至影响数学研究进程。

从这次结果看,至少在这 33 小时里,GPT-5.6 Sol 没有给出费马大定理的新证明。它留下的是一套排除过程,以及关于平台资源分配、模型公开边界、监管压力和系统实现细节的新一轮争论。

GPT-5.6 Sol 连续运行 33 小时研究费马大定理后被系统叫停 8

本文参考链接为 https://x.com/lu_sichu/status/2081367506468360495。原文来自微信公众号“机器之心”,作者为张倩。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。