OpenAI闭门召集40位数学家,AI做数学引发研究范式之争
上个月刚获菲尔兹奖的 Jacob Tsimerman 宣布将加入 OpenAI 从事 AI 安全研究。8 月初,他与 OpenAI 研究科学家 Sébastien Bubeck 在旧金山召集约 40 位数学家举行闭门峰会,讨论 AI 已在数学研究中取得的突破,以及数学家在验证、解释和理解证明中的位置。围绕公开信、AI 生成成果绕开传统发表流程、以及数学未来角色,与会者和学界仍未形成共识。

上个月刚获菲尔兹奖的 Jacob Tsimerman 宣布将加入 OpenAI 从事 AI 安全研究。8 月初,他与 OpenAI 研究科学家 Sébastien Bubeck 在旧金山召集约 40 位数学家举行闭门峰会,讨论 AI 已在数学研究中取得的突破,以及数学家在验证、解释和理解证明中的位置。围绕公开信、AI 生成成果绕开传统发表流程、以及数学未来角色,与会者和学界仍未形成共识。

Anthropic 本周披露,尚未发布的 Claude 研究版本曾被要求尝试证明黎曼猜想,虽然未能完成证明,但把满足该猜想的 zeta 函数零点比例已知下界从 41.6% 提高到 67.2%。相关结果经过 Anthropic 内部数学家、外部专家审阅,并完成 Lean 形式化验证。研究过程横跨两个工作阶段,累计消耗 3100 万个输出 token。

Anthropic披露,尚未发布的 Claude 研究版本在尝试黎曼猜想时未能完成最终证明,但把黎曼 ζ 函数中已知至少位于临界线上的零点比例下界从 41.6% 提高到 67.2%。该结果由 Anthropic 内部数学家研究验证,并给出 Lean 形式化证明,两位数论学者也已审阅论文。整个实验中,Claude 先后提出约 650 个思路,并调动约 60 个子 Agent,在两轮 Claude Code 会话里累计消耗约 3100 万输出 Token。

DeepMind 联合创始人哈萨比斯将 AI 攻克重大数学难题比作 AlphaGo 当年的“第37手”,称这类突破看起来只是时间问题。报道回顾了 2016 年 AlphaGo 对战李世石的第37手与第78手,并串联 AlphaProof、AlphaGeometry 2、Gemini Deep Think、GPT-5、Claude Fable 5 及 Aletheia 在数学解题和研究中的进展,讨论人类在 AI 时代可能转向提出问题、判断方向与协作研究的角色。

据 X 用户 Leo 爆料,OpenAI 最快可能在下周推出代号 Astra 的新模型系列,内部开发代号为 mewfour,目前已进入测试阶段。ABMedia 报道称,这被描述为全新的预训练基础模型,而非 GPT-5.5、o3、o4 一类基于既有模型的后训练升级。OpenAI 近期研究《Ten advances in mathematics and theoretical computer science》也已提到 Astra,并称其为“下一代主要模型”。Kalshi 上线的相关合约显示,市场对 Astra 在 8 月内发布的预期较高。

一项由前 Google 工程师 Deedy Das 发起的测试显示,Claude Fable 5、GPT-5.6 Sol xhigh 和 Kimi K3 在 IMO 2026 六道题的全自动解题中均获得 42 分满分,AxiomProver 也独立交出满分成绩。测试采用 Lean 4 形式化题面自动判分,结果与过去七年 IMO 人类满分比例形成鲜明对照,也让长链条逻辑推导能力再次成为焦点。

彭博预计到2030年稳定币年支付规模或达56万亿美元。原文据此点名安全、支付与高性能链赛道,并提到DeepSnitch AI、XRP和Solana。

第 67 届国际数学奥林匹克 7 月 13 日至 21 日在上海举行,中国队以全员金牌、团体总分 232 分夺冠,领先第二名美国队 25 分。邓乐言、张柏伦、刘澈以满分摘金。报道同时提到,GPT-5.6 Pro 被称在无人工提示下首次尝试解出 2026 年 IMO 全部 6 题,但截至成绩揭晓尚无官方公开结果。
