OpenAI在官方博客披露,下一代主力模型“Astra”的内部版本已经解开10道停滞十年以上的公开数学与理论计算机科学难题。这也是“Astra”这一代号首次公开。OpenAI称,按Sol API费率计算,完成全部10题的token总成本约为2,000美元。
OpenAI介绍,数学研究的推进通常以“年”为单位计算,一篇证明从投稿到同行评审完成,往往需要两三年时间。而这次Astra在同一批次运算中,连续处理了多道长期未解的公开问题。
论证如何验证
OpenAI在官方博客中给出了两层验证机制。第一层是由人类研究者与同一模型协作,把论证整理成一份249页手稿。第二层是模型将每条论证重新形式化,写成Lean证明,使电脑可以逐行验算,不接受跳步。
OpenAI表示,整份Lean证明库已经开源到GitHub,任何人都可以下载后自行验算。每一道题还附有模型自述的思考过程。
10道公开难题覆盖哪些方向
根据OpenAI公布的内容,这10项成果都对应停滞十年以上的公开问题,范围从纯数学延伸到理论计算机科学,包括:
- 高维球体堆积:上界逼近 Cohn,Elkies 门槛
- 二元码与球面码:上界指数级改进
- 非 sofic 群:构造出非 sofic 群,回答群论核心公开问题
- Connes 刚性猜想:证伪,部分群不再被冯诺伊曼代数唯一决定
- 算术电路复杂度:给出 permanent 新下界
- 量子平行重复:证出双人量子赛局的指数平行重复定理
- 最近向量问题(CVP):证明多项式因子近似难度,牵动后量子密码学
- Ehrhart 体积猜想:确定每个维度的最大体积
- 多色 Ramsey 数:超指数下界,解决 Erdős 第 183 题
- 极值图论:一次拿下 Erdős 第 146、180 题
OpenAI此前已公布相关数学成果
OpenAI提到,今年5月,公司曾公布模型证伪Erdős单位距离猜想,并催生至少5篇后续arXiv论文。近期,OpenAI也推出“ChatGPT for Academic Researchers”,向10万名科学家免费开放最强模型。
数学界肯定与疑虑并存
对于这次发布,菲尔兹奖得主Timothy Gowers称其为“AI辅助数学的里程碑”。Erdős问题目录维护者Thomas Bloom则表示,就构造性成果而言,这是“大新闻”。
不过,争议同样存在。今年6月,国际数学家群体发布《莱顿AI与数学宣言》,并获得国际数学联盟背书。该宣言在24小时内获得超过1,000人签署,签署者包括Kevin Buzzard和Peter Scholze。
宣言反对三类做法:未经同意使用论文作为训练数据、绕过同行评审直接向媒体发布成果、未注明成果承袭了谁的工作。OpenAI这次选择通过官方博客直接发布,而不是先投期刊,正好落在宣言批评的模式之中。
对此,OpenAI回应称:“AI 能参与数学研究所引发的问题,不是一家科技公司能独自回答的”,并表示公司会为正确性负责,但论证本身由模型生成。
随着解题速度快过同行评审节奏,争论的焦点也不只停留在模型能力本身,学术共同体如何处理验证、署名与信任机制,正被推到台前。

