日本 AI 公司 Sakana AI 发布 Fugu Max 和 Fugu Ultra v2。两款产品本质上都是「模型调度器」:先判断任务,再挑选合适的模型分工、相互检查,最后整合输出答案。
Fugu 产品线分成两条
根据快讯内容,第一代 Fugu 曾依靠这套多模型协作方法,让 GPT、Claude、Gemini 等模型组成团队,做到接近、甚至部分超过当时更强的 Fable 5。
这次 Sakana 将产品线拆分为两条。Fugu Max 主打压缩成本,模型池加入更多开放权重和专业模型,并优先选择「够用但更便宜」的模型。官方称,在接近顶级模型性能的情况下,其成本约为对方的 1/2 到 1/6。
Ultra v2 主攻最高性能
相比之下,Fugu Ultra v2 只追求最高性能。官方给出的说法是,它在 8 项评测中有 5 项拿到第一或并列第一,而且 Agent 池中没有 Fable 5、Fable 5.1 和 GPT-6 Astra。
已知限制与未披露数据
不过,多模型之间来回切换,可能会降低上下文缓存复用效率,也会额外产生编排 token 成本。Sakana 目前没有公布 Fugu Max 的缓存命中率和单任务总 token 成本。
快讯还提到,初代 Fugu 曾被用户吐槽响应较慢、额度消耗过快。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

