Fireworks AI:Kimi K3 与 Fable 5 在代理任务测试中表现接近

Fireworks AI:Kimi K3 与 Fable 5 在代理任务测试中表现接近

N
News Editor
2026-07-22 10:05:11
Fireworks AI 发布测评报告,对开源模型 Kimi K3 与闭源模型 Fable 5 在约 1030 项代理任务中进行对比。两者在 SWE 基准上的准确率分别为 92.4% 和 92.6%,整体差距不大,但在不同细分领域各有优势。报告还称,采用任务级路由策略后,准确率可提升至 93%,而 K3 在长周期代理任务中的成本最低可比 Fable 低 50 倍。
Fireworks AIKimi K3Fable 5开源模型AI 代理任务7X24快讯

ChainCatcher 消息,Fireworks AI 发布测评报告称,其对开源模型 Kimi K3 与闭源模型 Fable 5 进行了约 1030 项代理任务的对比测试,覆盖 SWE、终端运维、算法、多语言编码及法律等场景。

测试结果显示,两款模型在 SWE 基准上的准确率分别为 92.4% 和 92.6%,整体表现接近。不过在细分领域中,两者各有侧重:K3 在符号数学与开发工具领域领先,Fable 5 则在 Web 与数据可视化方面占优。

在终端长周期任务中,K3 独立完成了 11 项 Fable 5 未能解决的任务。报告同时指出,若采用任务级路由策略,在两款模型之间动态分配任务,准确率可达到 93%,高于任一单一模型。

成本方面,报告称 K3 在 Fireworks 平台上具备明显优势。在长周期代理任务中,其成本可低至 Fable 5 的 1/50。基于上述结果,报告建议将开源模型作为默认选项,并通过路由器持续学习任务与模型之间的最优匹配,以平衡质量与成本。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。