Anthropic发布Claude Sonnet 5:性能逼近Opus,API价格低约六成

Anthropic发布Claude Sonnet 5:性能逼近Opus,API价格低约六成

N
News Editor 01
2026-07-22 13:55:13
Anthropic上线Claude Sonnet 5,并设为 Free 与 Pro 用户默认模型。官方数据显示,其多项基准成绩接近 Opus 4.8,API 标准价格较后者低约六成,但新 tokenizer 可能影响实际账单。
AnthropicClaudeAI模型API定价大模型

Anthropic 已正式推出 Claude Sonnet 5,并将其设为 Free 与 Pro 用户的默认模型。按官方公布的 API 标准定价,Sonnet 5 每百万 token 输入 3 美元、输出 15 美元,在 8 月 31 日前 的优惠期为 2 美元/10 美元。对比 Opus 4.8 的 5 美元/25 美元,价格低约六成。

官方基准测试显示多项成绩接近 Opus 4.8

Anthropic 公布的跑分显示,Sonnet 5 与旗舰 Opus 4.8 的差距已经缩小,不过这些数据均来自官方自评,尚未经过第三方独立验证。在 SWE-bench Pro 这一偏向 agentic 程序能力的测试中,Sonnet 5 得分 63.2%,高于前代 Sonnet 4.6 的 58.1%,接近 Opus 4.8 的 69.2%

在 Terminal-Bench 2.1 终端操作测试中,Sonnet 5 为 80.4%,Opus 4.8 为 82.7%。Humanity’s Last Exam 多学科推理项目里,Sonnet 5 搭配工具使用达到 57.4%,与 Opus 4.8 的 57.9% 基本贴近。GDPval-AA v2 知识工作能力测试中,Sonnet 5 取得 1618 分,略高于 Opus 4.8 的 1615

长上下文与桌面���作能力同步提升

电脑操作能力也有提升。OSWorld-Verified 评测中,Sonnet 5 得分 81.2%,高于前代的 78.5%。这一测试关注模型在真实操作系统环境下执行截图、拖拽、跨应用传递数据等任务,难度更接近自动化工作流。

规格方面,Sonnet 5 支持最高 100 万 token 的 context window,最大输出达到 128k token。这意味着模型可以在单次对话中处理大体量文本,并完成跨文件比对、摘要与决策,减少分批处理带来的上下文丢失。

标价更低,不代表实际成本一定下降

Sonnet 5 采用了新版 tokenizer。同样一段输入文本,在新 tokenizer 下产生的 token 数量可能是原来的 1.0 倍到 1.35 倍,具体取决于内容类型。Anthropic 表示,定价已按“大致成本中性”做过调整,但也提醒高流量用户自行进行基准测试,因为实际账单未必会随标价同步下降。

安全性方面,Anthropic 称 Sonnet 5 相比 Sonnet 4.6,幻觉与谄媚倾向更低,对恶意请求的拒绝能力更强。不过从对比结果看,Sonnet 5 在不当行为发生率上仍高于 Opus 4.8,也高于限制更严格的 Claude Mythos Preview。

在与 Mozilla 合作的 Firefox 147 漏洞开发评估中,Sonnet 5 未产出可用漏洞,成功率为 0%;部分成功率为 13.2%,高于 Sonnet 4.6 的 8.8%,但与 Opus 4.8 的 68.8% 仍有明显差距。Anthropic 已默认启用网络安全防护。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
400

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。