Anthropic 于周三发布 Claude Haiku 5.5,并称这是该公司迄今最便宜、最快、能力最强的小模型。产品定位集中在高频任务,包括文档摘要、数据库查询,以及对响应速度要求更高的实时客服和代用户操作网页浏览器。
API 定价下调至 Haiku 4.5 的一成
对将 Claude 接入自有产品的开发者,Anthropic 给出的定价是:提示词长度在 100,000 token 以内时,每百万输入 token 收费 0.10 美元,每百万输出 token 收费 0.50 美元。报道称,这一价格与 OpenAI 竞争性小模型 GPT-6 Luna 在 9 月 22 日发布时设定的费率一致。
Haiku 4.5 此前的收费为每百万输入 token 1 美元、每百万输出 token 5 美元,因此新价格下调了 90%。对于超过 100,000 token 的提示词,Anthropic 还给出 50% 的额外降价。该公司表示,旧模型大约 90% 的请求都低于这一门槛,而 Haiku 5.5 会将文本切分成略多一些的 token,因此平均节省幅度接近 75%。
面向客服、邮件摘要等重复性任务
Anthropic 表示,Haiku 5.5 主要面向客服对话和长邮件摘要这类工作。按报道中的描述,这类重复性较高、难度较低、对创造性要求不高的任务,是该模型最适合的使用场景。
基准测试成绩高于 OpenAI Luna
尽管定位是小模型,报道提到其基准测试成绩并不弱。在 OSWorld 2.1 中,这项测试用于检验 AI 是否能通过长链条、多步骤任务操作真实计算机,并以部分得分百分比计分。Haiku 5.5 的成功率为 72.4%,高于 OpenAI GPT Luna 的 48.9%。

在 Terminal-Bench 4.0 中,AI 代理需要通过自主输入命令来完成专业任务,评分标准是首次尝试正确完成的比例。Haiku 5.5 的成绩为 39.2%,OpenAI Luna 为 16.4%,Haiku 4.5 为 0%。作为对比,Anthropic 的 Claude Sonnet 5.5 得分为 70.6%。
在 GDPval-AA v2.1 中,这项测试使用借鉴国际象棋的 Elo 评分体系,对 44 种职业中的真实专业工作进行评估。Haiku 5.5 得分为 1620,Luna 为 1437,Haiku 4.5 为 735。
新增可调节 effort 设置
Anthropic 还表示,这是首个加入可调节 effort 设置的 Haiku 模型。这个设置允许用户在成本和更高质量回答之间做取舍。
与此同时,Anthropic 将 Sonnet 5.5 的缓存读取价格下调一半至每百万 token 0.10 美元。缓存读取对应的是模型已经处理过文本的折扣计费。

发布时间线与上线渠道
Haiku 5.5 距离 Opus 5.5 于 9 月 22 日发布过去 15 天,距离 Sonnet 5.5 于 9 月 28 日发布过去 9 天。报道称,这也是 Anthropic 此前承诺推出的 Claude 5.5 三款模型中的最后一款。报道还提到,Opus 5.5 是 CEO Dario Amodei 发表一篇呼吁行业放缓 AI 能力增长文章后的首个发布版本。
Haiku 5.5 目前已在 Claude 官网、Amazon Web Services、Google Cloud 和 Microsoft Azure 上线,模型名称为 claude-haiku-5-5。
Anthropic 本周同步推出 API 月度额度
Anthropic 还在本周推出按月发放的 API 额度:Max 5x 订阅用户可获得 100 美元,Max 20x 用户可获得 200 美元,Team 方案则可获得最高 500 美元,并在用户之间共享。
报道实测:响应很快,但答案并不总是正确
报道还提到,作者用一个简单逻辑问题测试了该模型,响应速度极快,几乎是立刻返回结果。不过,这个回答是错误的。报道据此提醒,不应盲目相信模型输出。

