Prime Agent 开源,ARC-AGI-3 测试成绩达 95.5%

Prime Agent 开源,ARC-AGI-3 测试成绩达 95.5%

N
News Editor
2026-08-07 08:48:13
AI 初创公司 Prime Intellect 推出采用 MIT 许可的开源自我改进代理框架 Prime Agent。根据其官方博客,在 Opus 5 驱动下,该框架在 ARC-AGI-3 测试中拿到 95.5%,略高于人类专家 95.4% 的基线。Prime Intellect 称,成绩提升来自重设计既有模型外层框架,而非训练新模型;其核心包括递归语言模型与可自我改写的持续框架。

AI 初创公司 Prime Intellect 已推出开源自我改进代理框架 Prime Agent,采用 MIT 许可。根据其官方博客,在 Opus 5 驱动下,Prime Agent 在 ARC-AGI-3 测试中获得 95.5%,略高于人类专家 95.4% 的基线。

成绩提升来自外层框架重设计

Prime Intellect 表示,ARC-AGI-3 刚推出时,各个前沿模型的分数都低于 1%。从不到 1% 提升到超过人类专家基线,只用了几个月,关键不在于训练新模型,而是重新设计包在既有模型外面的框架(harness)。

该公司还称,这套框架在多个模型上,相比它们各自的专属框架都有明显提升,并非只对这一项测试有效。

框架建立在两个核心概念上

Prime Agent 建立在两个概念之上。其一是递归语言模型(RLM),把上下文视为可编程变量,并将委派子代理转化为 REPL 环境中的函数调用。

其二是持续框架(Continual Harness),让框架自身状态——包括提示词、技能、记忆和子代理——都成为代理可以自行新增、读取、修改和删除的对象。

Prime Intellect 表示,这套框架也可以直接作为 Claude Code 和 Codex 的外层框架使用。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
3800

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。