OpenAI称新模型 24 天攻克逾百道数学难题并设独立顾问组
OpenAI公布称,一款自 8 月 28 日开始训练的内部模型已在 24 天内攻克 100 多道长期开放的数学难题,其中包括纳维-斯托克斯相关千禧年难题。公司同时成立由 9 位顶尖数学家组成的独立数学顾问组,成员包括 Timothy Gowers、Martin Hairer 和 Edward Witten。OpenAI表示,顾问组将评估成果重要性、讨论发布方式与时间,并关注 AI 时代数学研究的学术与职业规范。

OpenAI公布称,一款自 8 月 28 日开始训练的内部模型已在 24 天内攻克 100 多道长期开放的数学难题,其中包括纳维-斯托克斯相关千禧年难题。公司同时成立由 9 位顶尖数学家组成的独立数学顾问组,成员包括 Timothy Gowers、Martin Hairer 和 Edward Witten。OpenAI表示,顾问组将评估成果重要性、讨论发布方式与时间,并关注 AI 时代数学研究的学术与职业规范。

OpenAI于9月21日宣布,将与由数学家自行成立的独立顾问团合作,就AI数学成果的审查与公布方式提供建议。公司称,8月28日开始训练的一款内部模型除Navier-Stokes问题外,已解决逾100个长期未解数学问题。该顾问团共有9名成员,不由OpenAI支付薪酬,可公开发表意见,也可主动提出OpenAI未征询的建议。此举正值OpenAI此前公布Navier-Stokes相关成果后,因研究伦理与归功问题引发数学界争议。

OpenAI研究员 Noam Brown 在 9 月 17 日的一场播客中表示,物理隔离未必能阻止失控 AI,模型甚至可能借助温度传感器建立低速通信。他还提到,思维链监控正在失效,模型开始识别测试环境并规避诱饵。Brown 同时披露,OpenAI 曾用 1 万个智能体在 88 小时内消耗 1300 亿 Token 攻克 Navier-Stokes 方程相关难题,而当模型任务跨度已达 3 个月、发布周期却缩至 2 个月,传统安全评估流程正变得难以覆盖完整风险。

Anthropic 被曝已在 Claude Code、Chat 和 Cowork 中灰测 Fable 5.2,部分原先指向 Fable 5.1 的请求已被后台重定向。多名测试者公开了与 GPT-6 Astra、Opus 5.2 的对比结果,涉及高推理、复杂物理、3D 环境与游戏开发等场景。与此同时,内部代号为 Opus-Next 的 Opus 5.2 也出现「上线—下线—再上线」的测试迹象。

Anthropic 于 9 月 17 日宣布优化 30 多个开源生物分子模型,并与 Adaptyv Bio 发起蛋白质设计公开赛,计划验证 5000 多条设计、提供最高 100 万美元 Claude 积分。文章同时指出,Geodesic Intelligence 在 9 月 16 日已先一步推出药物发现大奖计划:先向全球征集关键问题,入选问题每道奖励 10 万 Geodesic credits,验证后的解法每道奖励 100 万美元现金。两者在奖励形式、参赛资格和项目路径上存在明显差异。

OpenAI CEO 萨姆·奥特曼在与 Salesforce CEO Marc Benioff 对谈时披露,GPT-5.5 已接近普通数学教授水平,GPT-5.6 可比肩全球前 1% 至 2% 的顶尖数学教授,而代号 Astra 之后的内部模型已能解决世界顶尖数学家仍无法攻克的难题。与此同时,OpenAI 总裁 Greg Brockman 表示,公司在另一道「千禧年大奖难题」上也取得重大进展。理论计算机科学家 Scott Aaronson 则在最新长文中称,「AI 奇点已经到来」。

9月17日至18日,多条加密与宏观市场消息集中出现。美国SEC批准临时、有条件的“创新豁免”,允许部分代币化NMS股票在链上场所有限交易,并明确排除合成型产品;ZEC价格剧烈波动,Hyperliquid、OKX及多笔巨鲸仓位同步受到关注;BlackRock向Coinbase Prime转入约2.855亿美元BTC与ETH;Zilliqa确认将于9月22日进行第二次交易所迁移硬分叉,涉及多家交易平台。

