Claude Haiku 5.5 上线,四项 API 价格与 OpenAI GPT-6 Luna 相同
Anthropic 于美国时间 10 月 7 日正式发布 Claude Haiku 5.5,并同步上线 Claude Platform、Amazon Web Services、Google Cloud 和 Microsoft Azure。
定价方面,Claude Haiku 5.5 的四个 API 价格栏位与 OpenAI 的 GPT-6 Luna 完全一致:每百万 token 输入 0.10 美元、输出 0.50 美元、缓存读取 0.01 美元、缓存写入 0.125 美元。
作为对照,Google 的 Gemini 3.5 Flash-Lite 标准价格仍为输入 0.30 美元、输出 2.50 美元,其中输出价格是 Anthropic 和 OpenAI 这两款模型的 5 倍。不过,牌价相同并不代表最终账单一定相同。
九成降价有条件:长请求只降一半,token 计算也变多
这次发布中最醒目的数字是降价 90%,但这一降幅有明确条件。
Anthropic 在定价页说明,价格会按提示词长度分成两档。10 万 token 以内,请求的输入和输出价格都是 Haiku 4.5 的十分之一;超过 10 万 token 后,费率变为输入 0.50 美元、输出 2.50 美元,降幅只剩 50%。两档价格之间相差 5 倍。
Anthropic 表示,Haiku 4.5 约 90% 的请求都落在 10 万 token 以内,因此大多数请求可以享受到九成折扣。
不过,实际计费还受到第二个因素影响。Haiku 5.5 使用了新版 tokenizer,也就是文本切分为 token 的规则发生变化。Anthropic 在更新说明中写明,同一段文字在新版规则下,计算出的 token 数量会比 Haiku 4.5 多约 30%。在单价下降、token 数量增加,以及约一成长请求仅降价一半的共同作用下,Anthropic 在公告正文中给出的平均降幅约为 75%。
跑分成绩基于 Max 推理强度,默认档位分数明显更低
除了牌价,effort 也会影响实际成本。Anthropic 将推理强度分为 Low、Medium、High、Xhigh 和 Max 五档,API 默认设置为 Medium。
Anthropic 在公告主表中列出的 Haiku 5.5 跑分,全部是在 Max 档位下取得。这些数字由 Anthropic 自行发布,并非第三方验证。
如果切换到默认的 Medium 档位,多个基准测试成绩会明显下降。操作电脑任务 OSWorld 从 72.4% 降到 53.3%;知识工作基准 GDPval-AA 从 1620 降到 1277;代理式编程基准 Terminal-Bench 从 39.2% 降到 20.3%。
复杂代理式编程仍由 Sonnet 5.5 和 Opus 5.5 负责
在编程场景中,Haiku 5.5 的定位也没有被 Anthropic 描述为全面替代更大模型。
以 Terminal-Bench 为例,Haiku 5.5 Max 得分为 39.2%,但成本比 Sonnet 5.5 High 的 43% 还高约八成。Anthropic 也在公告中直接表示,复杂的代理式编程任务仍应交给 Sonnet 5.5 和 Opus 5.5。
Haiku 5.5 的角色是子代理,面向高频、低成本任务
Anthropic 对 Haiku 5.5 的定位相当明确:它不是用来取代大模型,而是作为大模型的子代理。
所谓子代理(subagent),是由大模型负责拆解任务,再把琐碎、边界清楚的小任务分配给小模型处理。Anthropic 列出的适用场景包括摘要、压缩上下文、查询数据库和分类等高调用量、同时对成本敏感的工作。
速度方面,Anthropic 称 Haiku 5.5 是标准速度下最快的模型,但脚注同时承认,它仍慢于 Opus 的 Fast Mode,公告中也没有给出每秒输出多少 token 的具体数字。
Anthropic 引述客户案例:Rogo 与 AlphaSense 已给出测试结果
金融 AI 公司 Rogo 给出的案例是,大模型负责制作演示文稿,Haiku 5.5 子代理则进入 10-K 年报,提取投影片所需的分部营收数据。Rogo 的 Alex Wang 表示:「它准确到我们愿意放心交给它,又快又便宜到可以大量跑。」
另一则客户引述来自 AlphaSense。该公司表示,其 Ask in Document 功能每周约有 800 万次调用;在 400 笔查询测试中,Haiku 5.5 得分为 0.84,Haiku 4.5 为 0.76。
上述两则客户说法都出自 Anthropic 的公告引述。

