AI 初创公司 Prime Intellect 已推出开源自我改进代理框架 Prime Agent,采用 MIT 许可。根据其官方博客,在 Opus 5 驱动下,Prime Agent 在 ARC-AGI-3 测试中获得 95.5%,略高于人类专家 95.4% 的基线。
成绩提升来自外层框架重设计
Prime Intellect 表示,ARC-AGI-3 刚推出时,各个前沿模型的分数都低于 1%。从不到 1% 提升到超过人类专家基线,只用了几个月,关键不在于训练新模型,而是重新设计包在既有模型外面的框架(harness)。
该公司还称,这套框架在多个模型上,相比它们各自的专属框架都有明显提升,并非只对这一项测试有效。
框架建立在两个核心概念上
Prime Agent 建立在两个概念之上。其一是递归语言模型(RLM),把上下文视为可编程变量,并将委派子代理转化为 REPL 环境中的函数调用。
其二是持续框架(Continual Harness),让框架自身状态——包括提示词、技能、记忆和子代理——都成为代理可以自行新增、读取、修改和删除的对象。
Prime Intellect 表示,这套框架也可以直接作为 Claude Code 和 Codex 的外层框架使用。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

