Anthropic 发布新一代轻量模型 Claude Haiku 5.5,主打低成本、高速度和 Agent 任务。按 Anthropic 的说法,这是公司迄今速度最快、能力最强的小模型。
和 Haiku 4.5 相比,Claude Haiku 5.5 在编程、电脑操作和专业知识任务上的表现明显提升,部分评测成绩超过 GPT-6 Luna。
多项官方评测成绩提升
官方测试显示,Claude Haiku 5.5 在 OSWorld 2.1 电脑操作评测中达到 72.4%,高于 GPT-6 Luna 的 48.9%,上一代 Haiku 4.5 为 15.7%。
在 GDPval-AA 专业工作评测中,Claude Haiku 5.5 获得 1620 分,同样高于 GPT-6 Luna 的 1437 分。
编程能力也有提升。在 Terminal-Bench 4.0 中,Claude Haiku 5.5 的成绩从上一代的 0% 提高到 39.2%,超过 GPT-6 Luna 的 16.4%。
定价下调 90%
价格方面,Anthropic 给出的降幅更大。对于输入不超过 10 万 tokens 的请求,Claude Haiku 5.5 每百万输入 tokens 收费 0.1 美元,每百万输出 tokens 收费 0.5 美元,两项价格都比上一代降低 90%。
对于超过 10 万 tokens 的请求,输入和输出费用分别为每百万 0.5 美元和 2.5 美元。
Anthropic 估算,考虑到实际任务中的 token 消耗变化,Claude Haiku 5.5 的平均运行成本下降约 75%。
新增可调节推理强度
Claude Haiku 5.5 还首次在 Haiku 系列中加入可调节推理强度,允许开发者在性能和成本之间做取舍。
已接入多个平台
目前,Claude Haiku 5.5 已通过 Claude API、AWS、Google Cloud 和 Azure 提供。Anthropic 将其适用场景列为批量摘要、信息检索、浏览器操作,以及为大型 Coding Agent 执行子任务。

