多个AI模型同时调用,但对外只暴露一个API——日本AI独角兽Sakana AI在6月22日正式发布Sakana Fugu,一套以强化学习训练的协调模型自动分配任务给多个专业Agent的系统。用户无需关心后台有几个模型在跑,也不需要手动设计协作流程,一切由Fugu内部的指挥机制负责分派。
三角分工架构TRINITY
Fugu底层的TRINITY架构将任务拆给三种角色:“思考者(Thinker)”负责规划方案,“执行者(Worker)”负责实现,“验证者(Verifier)”负责找漏洞。三个角色由不同的LLM分别担任,形成相互制衡的工作组。简单来说,不让同一个模型既想方案又批改答案。
7B参数协调模型Conductor
Conductor是系统的核心——一个以强化学习训练的7B参数协调模型,负责决定每次任务要调用哪些Agent、如何让它们沟通,以及如何整合最终输出。该模型不依赖预先设计的工作流程,而是通过训练自己摸索出最有效的协作路径,Sakana称之为“非直观但高效的协作模式”。Agent池的组成可弹性调整:Standard层级允许企业用户排除特定供应商或模型,以符合数据隐私或合规要求,对不允许数据出境的机构而言,这是一个关键的差异化设计。
基准测试比肩顶级模型
Sakana用四个基准测试对比Fugu与前沿模型的表现:SWE Bench Pro(软件工程代码修复能力)中Fugu 59.0分、Fugu Ultra 73.7分;LiveCodeBench(实时编程竞赛)Fugu 92.9、Fugu Ultra 93.2;GPQA Diamond(研究生级跨学科问答)两者同为95.5;Humanity’s Last Exam(极难题库)Fugu 47.2、Fugu Ultra 50.0。Sakana称这些数字“在严格基准测试上比肩Mythos Preview和Fable 5”,但有待第三方机构验证。
分层定价与市场限制
Fugu分为三个订阅层级:Standard每月20美元、Pro每月100美元(10倍用量)、Max每月200美元(20倍用量),三个层级均包含Fugu与Fugu Ultra的使用权限。另有企业Token计费方案:Fugu Ultra每百万输入Token 5美元、每百万输出Token 30美元;超过272,000 Token的长上下文场景,费率调整为10美元输入、45美元输出。
Sakana强调,在任务中协同调用更多Agent并不意味着费用等比增加。定价机制根据活跃Agent池中层级最高的模型采用单一混合费率计算——加入第二个或第三个Agent不会翻倍账单,这与自行串接多家API相比,在复杂任务上有明显成本优势。
目前最明确的限制是地理范围:Fugu不向欧盟与欧洲经济区(EEA)用户开放,官方理由为正在推进GDPR合规认证,时程未定。2026年7月前完成订阅的早期用户可获得第二个月免费。

