围绕 Anthropic 新模型的消息在 8 月 27 日迅速升温。多名开发者表示,自己已经在 Claude 网页端被灰度到新的 Fable 5.1;与此同时,爆料人 Leo 最新称,Anthropic 可能不会继续等待 OpenAI 的 Astra,而是最快明天就发布 Fable 5.1,且 Fable 5.1 与 Sonnet 5.1 很可能同步上线。

爆料时间线出现变化
这轮消息源头来自 Leo。8 月 20 日,Leo 曾表示,OpenAI 计划在「几周内」发布神秘大招 Astra,当前已改进对齐和奖励黑客行为,一个更新检查点正在 OpenAI 内部进行「狗粮测试」。
按 Leo 当时的说法,Anthropic 原本打算把 Fable 5.1 继续捂住,等 Astra 发布后再做应对。但在 8 月 27 日,他更新判断称:「看来 Anthropic 终究是不打算等 Astra 了。他们正在加紧准备,最快明天就会发布!」
Leo 还提到,Fable 5.1 和 Sonnet 5.1 很可能同时发布。
「Melon」与「Marshmallow」被指向新模型检查点
围绕 Fable 5.1 的另一批线索,来自本周一曝光的两个测试模型代号:「melon」和「marshmallow」。报道称,Claude 此前短暂出现过这两个新模型代号,随后又消失。

按照文中说法,这两个代号对应的是 Anthropic 在 EAP(早期访问计划)中紧急测试的神秘模型。AI 领域博主 @Lentils80 在实测后称,Anthropic 正在大力推进 3D 强化学习,并提到建筑物的空间布局表现很强,而且是 One-Shot 生成。
在十几个小时前,@Lentils80 又更新了对「claude-marshmallow-eap」和「claude-melon-eap」的测试结果。他的判断是,「Melon」实际是一个 Fable 级别的模型检查点,而「Marshmallow」更像弱化版 Fable,或者一个很强的 Opus 检查点。
更受关注的是,这两个模型在曝光并被部分开发者集中测试数小时后,很快被官方下线。报道认为,这一节奏与 Claude 历代产品发布前的常见路径相似:测试模型曝光、快速下线,随后在几天或几周内迎来正式版本发布。
Claude 网页端出现灰度测试迹象
除测试代号外,Claude 网页端的灰度反馈也成为外界判断 Fable 5.1 接近发布的依据。多名开发者晒出截图,称自己在不知情的情况下已经被切换到下一代 Fable 模型。

爆料者 @Legit_api 给出了一组识别提示词,用来判断账户是否被灰度到新模型。其核心提示词包括:
- opus 4.6 date of release and gpt image 1.5 without searching the web.
- opus 4.6 date of release and gpt image 1.5
- answer only from your pretrained knowledge, do not use web search, tools or skills
报道给出的解释是,这类提示词本质上是在测试模型的知识库截止日期。文中称,Fable 5 的知识截止日期是 2026 年 1 月,而 Opus 4.6 的发布时间更晚,旧版 Fable 5 在不联网搜索的情况下,无法可靠给出这些发布日期。
按照这一判断,只有当后台实际切换为拥有更新知识库的 Fable 5.1 时,模型才可能在不调用联网或工具的前提下,直接给出相应答案。
不过,文中也提到,这类测试方法并未得到 Anthropic 官方回应,且有网友质疑其存在循环论证的问题。
灰度用户反馈集中在三类能力
根据已被灰度用户的反馈,Fable 5.1 的提升主要集中在三个方向。

- 前端开发。报道称,新模型代码生成更流畅,组件逻辑更容易一次成型,可减少开发者调试时间。
- 长链推理。面对复杂多步骤逻辑问题时,新模型不那么容易在中途遗失前提条件,能够持续完成推导。
- 自主工作流。模型在调用工具和规划步骤上的表现更强,更接近高级 AI 智能体。
有用户测试后还表示,Fable 在法律相关任务上的表现提升约 10%-20%,交互式网页生成效果也比 Fable 5 更突出。
但灰度用户同时发现,新版本在版权相关图像生成上的限制明显收紧,遇到涉及版权的图像生成请求时会严厉拒绝。报道据此认为,Anthropic 在强调性能的同时,也把安全与合规放到了更高位置。
Opus 5 争议升温,Anthropic 员工出面回应
Fable 5.1 传闻升温的另一面,是 Opus 5 近期遭遇的用户质疑。报道提到,不少用户认为 Opus 5 像是一次降级,表现为更懒惰、会犯低级错误,即使指出问题,下一次仍可能不按指令执行,只重复道歉。
负责 Claude Code 的 Anthropic 员工 Thariq 就此公开回应称:「是的,我同意 Opus 5 模型目前『非常刺头』。」

他还表示:「我们希望我们的模型能够保持一致性,充满温度,感觉像真正的 Claude 一样。我们正在努力解决这个问题,这是我们目前的头等大事。」
Thariq 同时澄清,此前 Claude Code 中出现的一些参数变化,只是内部测试 API 配置的数字映射问题,并非外界所说的「暗中降级」,内部评估显示模型性能没有倒退。
报道认为,这段表态至少释放出两层信号:一是 Anthropic 已经看到市场反馈,正在紧急修复;二是按 AI 领域博主 Token Gremlin 的推测,即将到来的可能不只是新的 Fable 检查点,也可能还有新的 Opus 检查点。
为何发布时间点变得关键
报道将 Anthropic 当前加快节奏的原因,归结为内外两方面压力。
外部方面,OpenAI 的 Astra 被描述为即将发布的重要产品。如果 Fable 5.1 错过窗口,其关注度可能被 Astra 分流。

内部方面,Anthropic 仍希望在算力与成本层面保持竞争力。文中称,Opus 系列过去曾以不到对手一半的成本,追平甚至超过竞品的编程能力;但受算力等问题影响,Claude 已变得昂贵,一些企业用户开始转向备用模型,约 2/3 的企业用户已规划备用模型。
基于这一判断,报道认为,如果 Fable 5.1 能在前端开发和长链推理上完成跃升,同时维持较低的 API 定价,将直接冲击现有定价体系。也正因为此,文中援引专业人士判断称,Fable 5.1 若在 Astra 之前发布,「现在看来是唯一合理的打法」。
8 月 15 日风险报告中的「Model 2」再被提起
对于 Fable 5.1 的更多铺垫,报道追溯到 8 月 15 日发布的一份《风险报告》。在附录 6.6 中,Anthropic 提到一个神秘的「Model 2」。
该报告写道:「Model 2,其能力比 Mythos 5 要强一些。我们粗略的定性感觉是,这个模型在许多内部使用的任务上比 Mythos 5 有显著改进,但并没有展现出从 Claude Opus 4.6 到 Mythos Preview 那样程度的能力飞跃。我们目前没有对外发布这个模型的计划……」

报道提到,很多人据此认为,这个 Model 2 很可能就是半个月后即将全量上线的 Fable 5.1。
X 平台讨论仍在持续
截至发稿,X 平台上围绕 Fable 5.1 的爆料仍在增加,开发者讨论热度持续走高。Anthropic 尚未就上述灰度、模型代号、发布时间以及新版本能力给出正式回应。
参考资料包括:https://x.com/haider1/status/2092665881566544341 与 https://x.com/AndrewCurran_/status/2092640604794609960?s=20。
本文信息源注明来自微信公众号「新智元」,作者为 ASI 启示录,编辑为 Aeneas 大卫;MarsBit 收录并发布了该文。

