Anthropic 推出 Claude Haiku 5.5,定价降至每百万输入 0.10 美元

Anthropic 推出 Claude Haiku 5.5,定价降至每百万输入 0.10 美元

N
News Editor
2026-10-07 20:46:03
Anthropic 于周三发布 Claude Haiku 5.5,并将其定位为目前最便宜、最快、能力最强的小模型,面向文档摘要、数据库查询、实时客服和浏览器操作等高频任务。该模型在 10 万 token 以内的 API 定价为每百万输入 token 0.10 美元、每百万输出 token 0.50 美元,较 Haiku 4.5 的 1 美元和 5 美元分别下调 90%。Anthropic 还称,超过 10 万 token 的提示词价格再降 50%,平均节省接近 75%,并同步下调 Sonnet 5.5 的缓存读取价格。

Anthropic 于周三发布 Claude Haiku 5.5,并称这是该公司迄今最便宜、最快、能力最强的小模型。产品定位集中在高频任务,包括文档摘要、数据库查询,以及对响应速度要求更高的实时客服和代用户操作网页浏览器。

API 定价下调至 Haiku 4.5 的一成

对将 Claude 接入自有产品的开发者,Anthropic 给出的定价是:提示词长度在 100,000 token 以内时,每百万输入 token 收费 0.10 美元,每百万输出 token 收费 0.50 美元。报道称,这一价格与 OpenAI 竞争性小模型 GPT-6 Luna 在 9 月 22 日发布时设定的费率一致。

Haiku 4.5 此前的收费为每百万输入 token 1 美元、每百万输出 token 5 美元,因此新价格下调了 90%。对于超过 100,000 token 的提示词,Anthropic 还给出 50% 的额外降价。该公司表示,旧模型大约 90% 的请求都低于这一门槛,而 Haiku 5.5 会将文本切分成略多一些的 token,因此平均节省幅度接近 75%。

面向客服、邮件摘要等重复性任务

Anthropic 表示,Haiku 5.5 主要面向客服对话和长邮件摘要这类工作。按报道中的描述,这类重复性较高、难度较低、对创造性要求不高的任务,是该模型最适合的使用场景。

基准测试成绩高于 OpenAI Luna

尽管定位是小模型,报道提到其基准测试成绩并不弱。在 OSWorld 2.1 中,这项测试用于检验 AI 是否能通过长链条、多步骤任务操作真实计算机,并以部分得分百分比计分。Haiku 5.5 的成功率为 72.4%,高于 OpenAI GPT Luna 的 48.9%。

Anthropic 推出 Claude Haiku 5.5,定价降至每百万输入 0.10 美元 3

在 Terminal-Bench 4.0 中,AI 代理需要通过自主输入命令来完成专业任务,评分标准是首次尝试正确完成的比例。Haiku 5.5 的成绩为 39.2%,OpenAI Luna 为 16.4%,Haiku 4.5 为 0%。作为对比,Anthropic 的 Claude Sonnet 5.5 得分为 70.6%。

在 GDPval-AA v2.1 中,这项测试使用借鉴国际象棋的 Elo 评分体系,对 44 种职业中的真实专业工作进行评估。Haiku 5.5 得分为 1620,Luna 为 1437,Haiku 4.5 为 735。

新增可调节 effort 设置

Anthropic 还表示,这是首个加入可调节 effort 设置的 Haiku 模型。这个设置允许用户在成本和更高质量回答之间做取舍。

与此同时,Anthropic 将 Sonnet 5.5 的缓存读取价格下调一半至每百万 token 0.10 美元。缓存读取对应的是模型已经处理过文本的折扣计费。

Anthropic 推出 Claude Haiku 5.5,定价降至每百万输入 0.10 美元 4

发布时间线与上线渠道

Haiku 5.5 距离 Opus 5.5 于 9 月 22 日发布过去 15 天,距离 Sonnet 5.5 于 9 月 28 日发布过去 9 天。报道称,这也是 Anthropic 此前承诺推出的 Claude 5.5 三款模型中的最后一款。报道还提到,Opus 5.5 是 CEO Dario Amodei 发表一篇呼吁行业放缓 AI 能力增长文章后的首个发布版本。

Haiku 5.5 目前已在 Claude 官网、Amazon Web Services、Google Cloud 和 Microsoft Azure 上线,模型名称为 claude-haiku-5-5。

Anthropic 本周同步推出 API 月度额度

Anthropic 还在本周推出按月发放的 API 额度:Max 5x 订阅用户可获得 100 美元,Max 20x 用户可获得 200 美元,Team 方案则可获得最高 500 美元,并在用户之间共享。

报道实测:响应很快,但答案并不总是正确

报道还提到,作者用一个简单逻辑问题测试了该模型,响应速度极快,几乎是立刻返回结果。不过,这个回答是错误的。报道据此提醒,不应盲目相信模型输出。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。