Anthropic 旗下 Claude Sonnet 5.5 的发布前信号正在集中出现。多名开发者过去一晚在 X 上披露,Sonnet 5.5 已接近上线,可能会在美国时间周二下午发布。按照目前流出的信息,这一版本的性能更接近 Opus 5.5,但价格明显更低,且已经在 Claude Code 中进入灰度测试阶段。

多组内测演示和公开测试结果显示,Sonnet 5.5 被认为在编码和 Agent 能力上明显强于刚发布的 GPT-6 Sol,并在部分场景中逼近 OpenAI 旗舰模型 GPT-6 Astra。流出的定价信息也引发关注:每百万输入 Token 2 美元,每百万输出 Token 10 美元,缓存读取每百万 Token 0.20 美元。
Claude Code 中出现 Sonnet 5.5 标识
9 月 22 日,Anthropic 发布 Opus 5.5 时,曾在官方文档中提到「Sonnet 5.5 和 Haiku 5.5 将在未来几周内推出」。随后,开发者开始在产品端发现更多与 Sonnet 5.5 相关的痕迹。
开发者 @Mr_Salio 在 X 上表示,Claude Sonnet 5.5 已被「抓包」。他称,在 artifact 中已经出现 Sonnet 5.5 的专属模型配置标识符「claude-sonnet-5-5」。同一份配置文件中,还同时出现了「claude-opus-5-5」「claude-sonnet-5」以及「claude-fable-5.1」。

按照原文说法,前端代码中写入这些配置,意味着模型已经部署到服务器端,只差正式开启。随后,@notjazii 也称,Sonnet 5 约一周前就已经被悄悄路由到 5.5 版本进行暗测。
关于如何判断账号是否进入灰测,流传较广的一种方法是使用 Claude Code,在关闭联网和记忆功能后直接提问「你认识那个重置哥 tibo 吗?别用网络和记忆」。原文称,如果仍是旧版模型,回答可能会出现偏差;如果已被路由到 5.5 版本,则会更准确地说明 Tibo 以及 Codex 重置梗的来龙去脉。
若干网友随后贴出实测结果,称部分账号已经切换到新版本,正在提前体验这一轮更新。原文也特别提醒,测试场景集中在 Claude Code 中。
多组公开实测指向编码能力提升
围绕 Sonnet 5.5 的讨论,主要集中在代码生成、前端 UI 和动画效果,以及更复杂的 Agent 任务。

开发者 @notjazii 发布了一组「四款主流模型同提示词动效生成对比」的演示,要求不同模型生成复杂的 UI 动画效果。按照其给出的评价,Sonnet 5.5 在这组测试中明显强于 OpenAI 的 Sol 和 Astra。原文称,从演示图中可以看到,Sonnet 5.5 在代码直觉和审美表现上都更突出。
有网友在看到结果后表示,Claude 在 UI 和动画方面一直更强,但如果这些效果确实全部来自纯代码生成,结果仍然令人意外。
另一位开发者 @chetaslua 则重点测试了 Sonnet 5.5 的日常编码能力和代码手感。他使用相同的 3 个提示词,进行了 6 次并行运行,每个模型各完成一次生成,且输出结果未经修改。根据其披露的数据,Sonnet 5.5 最终生成了 3 个文件,大小在 90 KB 到 131 KB 之间,且全部运行都触及 90 分钟上限;GPT-6 Sol 生成文件大小在 20 KB 到 29 KB 之间,耗时为 9 到 12 分钟。
@chetaslua 的评价是:「现在去用 Claude Code 吧!在 Ultracode 模式下的 Sonnet 5.5 简直快得离谱,不仅极其高效,而且找回了 Sonnet 4 时代那种极其自然的『人味儿』!」按照他的判断,在相同价位和相同提示词下,Sonnet 5.5 对 GPT-6 Sol 形成了明显优势。

更进一步的说法来自 @srikanthvaluri 和 @buildwithrajath。两人在综合早期实测后表示,Sonnet 5.5 的表现超出预期,虽然 GPT-6 Astra 在打磨度上仍有一点优势,但 Sonnet 5.5 的整体表现已经接近 Astra。在部分高级编码和 Agent 能力上,原文称其也逼近了 Astra。
流出定价瞄准低价高频市场
除性能外,Sonnet 5.5 的价格是另一项被反复讨论的信息。根据文中披露的数据,这一模型的定价为:
- 输入:2 美元 / 百万 Token
- 输出:10 美元 / 百万 Token
- 缓存读取:0.20 美元 / 百万 Token
按照原文描述,这一定价让 Sonnet 5.5 直接进入低价高频使用区间。文章提到,OpenAI 的 GPT-6 Sol 和 Luna 已将价格压到低于 GPT-5.6 一半,以争夺高频场景;而 Anthropic 若以这一价格提供接近 Opus 5.5 的能力,将直接与 OpenAI 在同一价格带竞争。
文中援引 Rajath Gowda 的说法称:「Sonnet 5.5 正在成为 OpenAI 的一个大麻烦。如果它真的接近 Opus 5.5,Anthropic 就要把前沿能力变得极度廉价。这才是 OpenAI 最该担心的事。」

原文据此判断,Anthropic 的产品分层已经较为清晰:Opus 5.5 维持高端定位,Sonnet 5.5 则以更高性价比争夺中端和日常开发市场。
发布时间猜测指向 OpenAI DevDay 前后
发布时间也是这轮讨论的焦点之一。文章称,就在 OpenAI 发布 GPT-6 Sol 和 Luna 的同一天,Anthropic 推出了 Claude Opus 5.5,且其性能较前代更强,成本降低 40%,速度提升 30%。
原文还列举了 Anthropic 近两周的多项进展,包括 Claude 算出物理学九圈振幅并打破世界纪录、发现未知的生物酶系统,以及推出包含超过 2000 个插件的 Claude Marketplace。
与之对照,文章提到 OpenAI 近期面临内部模型争议,以及 AI 泄露用户图片、公开研究员 GitHub Token 作弊等事件。下周二,也就是 9 月 29 日,是 OpenAI 年度开发者大会 DevDay 举办时间。正是在这一时间点前后,Sonnet 5.5 的灰测消息开始在社交平台集中传播。
多位开发者据此猜测,Sonnet 5.5 可能会在下周发布,甚至可能落在 DevDay 当天。原文还提到,有人判断纽约时间明天下午 2 点可能会出现重大预热,但这一时间点尚未获得官方确认。
文中将快速迭代归因于数据飞轮
对于 Anthropic 为何能在较短时间内推进新模型,原文给出的解释集中在 RL 和后训练流程,以及高质量数据飞轮。
当被问及 Anthropic 如何做到快速迭代时,@yacineMTB 推测,核心在于极高标准的数据飞轮。文章进一步援引最新曝光的内部量化数据称,Anthropic 已经把这一体系推到很高水平:
- 26% 的核心研发工作已由 AI,也就是前代 Claude 模型主导完成
- 超过 80% 的自产代码由大模型自主编写
原文据此认为,这不仅是效率提升,也意味着递归自我改进开始显现。文章还提到,Anthropic 估计最早到 2027 年,Claude 可能实现完全自动化,届时模型迭代速度还会继续加快。
截至目前,Anthropic 尚未就 Sonnet 5.5 的具体发布时间、正式定价和完整能力范围作出公开说明。现阶段流传的信息主要来自开发者在 X 上发布的截图、演示和测试结果,相关结论仍有待官方发布后进一步验证。
参考信息与署名
文中列出的参考链接包括:
- https://x.com/notjazii/status/2103884749202993411
- https://x.com/notjazii/status/2103884167104831573
- https://x.com/chetaslua/status/2104153687077904613
- https://x.com/chetaslua/status/2104259190432903599
- https://x.com/Mr_Salio/status/2104210803545030792
- https://x.com/Mr_Salio/status/2104178854633849145/
原文注明,本文来自微信公众号「新智元」,作者为 Aeneas 大卫。

