SemiAnalysis 一档内部播客近日披露,Anthropic 已完成新模型 Mythos 2 的训练,但并未对外发布。播客称,Anthropic 目前正利用 Mythos 2 生成的数据,继续推进 Mythos 3 的研发。
在播客中,分析师 Dylan Patel 和 Jordan Nanos表示,外界所看到的公开模型,并不等同于这些公司内部的最强版本。Jordan Nanos称,在 Mythos 与 Fable 的对比中,这一点已经体现出来,「我根本没法使用 Mythos,我只能使用 Fable,而且有时候我还得客客气气地求它才能用。」
按照节目中的说法,Anthropic 内部保留着名为 Mythos 的更强模型,只有参与「玻璃之翼计划」的企业可以使用。播客将其描述为代表 Anthropic 最强技术的版本,而公开版本 Fable 则是在能力受限和增加过滤后推出的版本。
Patel:Anthropic 曾呼吁监管,如今反受其限
Dylan Patel在节目中表示,Anthropic 多年来一直呼吁加强 AI 监管,但现在其自身也受到发布限制影响。他说,据其了解,Mythos 2 已完成全部训练,但无法发布。

节目将这一局面与 Anthropic 长期强调 AI 安全、推动更严格监管联系在一起。报道提到,以 Dario Amodei 为代表的 Anthropic 管理层过去长期以 AI 安全为重点,推动严苛监管法案。
播客还称,Mythos 2 在代码生成、逻辑推理和网络攻防方面表现强劲,因此触发了最高级别警报。报道援引节目说法称,Anthropic 为该模型投入了数亿美元算力,但目前模型仍被限制在公司内部。
未发布模型,反馈循环成为核心问题
Dylan Patel在播客中指出,模型不发布带来的关键问题,不只是商业化节奏放缓,而是可能影响公司内部的反馈循环。他在节目中说:「现在真正重要的问题是内部的反馈循环。他们是否阻止了自己利用内部的 Mythos 2 去让 Mythos 3 变得更强?或者,他们是否阻止了自己用 Astra 去打造下一代的 Astra Plus One?」

按照节目中的逻辑,过去不少模型进步依赖一个持续循环:模型发布后收集用户真实反馈,再将这些数据用于下一代训练。播客认为,如果 Mythos 2 和 Astra 无法进入真实世界,这一机制就会受到影响。
不过,Patel 同时透露,尽管 Mythos 2 被雪藏,Anthropic 内部推进 Mythos 3 的工作并未停止,公司的重点已经从快速推出新模型,转向更隐秘的内部系统改进。节目称,Anthropic 正在使用 Mythos 2 生成数据、编写代码,以支持 Mythos 3 的开发。
风险报告提及更强内部模型 Model 2
报道还提到,Anthropic 此前曾在风险报告中承认,公司内部运行着一个比 Mythos 5 更强的模型,代号为 Model 2,目前没有对外发布该模型的计划。

根据文中给出的数据,Model 2 在 AEC 上取得 162.79,在 CoBench 上取得 62.8%。报道据此认为,在外部反馈循环放缓的同时,Anthropic 内部仍在把算力转向实验室内的模型迭代。
文章将这种内部迭代概括为三层递归。第一层是数据递归,即更强模型生成训练数据并交给下一代模型使用;第二层是劳动力递归,文中称 Anthropic 生产代码中的绝大多数出自 Claude,研发提速逼近 2 倍预警红线;第三层是测评递归,即由更强模型参与红队、互评和陪练等测评环节。
报道还称,Anthropic 自家评测已出现「饱和」,难以准确衡量模型还在进步多少,但已观察到「加速的早期迹象」。

OpenAI 部分内部模型也被指未公开
在讨论 Anthropic 之外,Jordan Nanos 还在播客中谈到 OpenAI。他表示,外界猜测中的 OpenAI 模型代号「5.6 Sol」,并不是 OpenAI 训练过的最大模型,其规模「根本达不到 4.5T 的量级」。他称,在某个不为人知的地方,OpenAI 还藏着一个更大的模型。
文中同时提到,OpenAI 过去几个月持续宣传全能型多模态 AI 助手 Astra,但该模型的公开发布并不顺利。Dylan Patel在播客中称,OpenAI 曾强调 Astra 的能力,但随后面临无法发布的问题。
报道援引 OpenAI Codex 负责人 Thibault Sottiaux 的表态称,Codex 将接入 Astra。此前,Astra 已经展示出较强的编程能力。

另据文中说法,OpenAI 最近的内部评估发现,Astra 在 Agent 编程和网络安全方面有明显进步,甚至一度无法排除其已经达到「Critical」网络安全能力。OpenAI 因此暂停了部分不符合新安全要求的 Astra 内部活动。
报道还提到,OpenAI 总裁 Greg Brockman 表示,公司正在开发能够编写「超人类水平安全代码」的 AI 模型,以帮助机构基础设施应对 AI 驱动的网络攻击。
关于 Anthropic 动机的讨论
在 SemiAnalysis 的相关内容传播后,社交平台上也出现了对 Anthropic 动机的讨论。报道提到,一种获得较多认同的观点认为,Anthropic 希望政府加强监管,从而获得不公开发布最强模型的正当理由,并将最强 AI 保留为内部能力使用。

文中称,如果 Anthropic 的方向是将最强智能用于生物制药或全自动代码生成,那么其商业重心可能并不在面向普通用户的订阅收入,而在更高价值的内部应用场景。
文章最后提到,围绕 Mythos 2、Astra 以及尚在研发中的 Mythos 3,真正处于前沿的模型能力与公众可接触到的产品之间,可能仍存在明显差距。
参考链接
- https://x.com/firesidealpha/status/2089391264878002260
- https://x.com/firesidealpha/status/2078532739343753400
- https://x.com/gdb/status/2089326994714763665
本文来自微信公众号「新智元」,作者:ASI启示录。

