返回多语言

多语言

Fireworks AI
2026-07-22 10:05:11

Fireworks AI:Kimi K3 与 Fable 5 在代理任务测试中表现接近

Fireworks AI 发布测评报告,对开源模型 Kimi K3 与闭源模型 Fable 5 在约 1030 项代理任务中进行对比。两者在 SWE 基准上的准确率分别为 92.4% 和 92.6%,整体差距不大,但在不同细分领域各有优势。报告还称,采用任务级路由策略后,准确率可提升至 93%,而 K3 在长周期代理任务中的成本最低可比 Fable 低 50 倍。

1120
Fireworks AI:Kimi K3 与 Fable 5 在代理任务测试中表现接近