非营利 AI 评测机构 ARC Prize 预告将推出 ARC-AGI-4,下一代 benchmark 的重点将放在「自主开放式创新」上,测试 AI 能否自己探索、提出新想法,甚至做出新的发明和发现。
目前,ARC Prize 还没有公布 ARC-AGI-4 的具体题目、评分方式和发布时间。该机构表示,人类在开放式创新上的能力仍明显领先 AI,而这种能力也是推动科学和技术进步最关键的能力之一。
这次预告还引用了 Dario Amodei 刚发布的一篇关于 AI 减速的文章。ARC Prize 同时强调,开源仍是 AI 进步的基础,反对行业为了协调减速而减少开放,并把前沿 AI 集中在少数机构手中。
ARC-AGI 过往成绩对比
ARC-AGI 一直被称为全球最难的 AGI 评测之一。ARC Prize 提到,在 ARC-AGI-3 发布时,人类得分为 100%,前沿 AI 仅为 0.51%。最新的 GPT-6 Astra 已明显追近,但在统一的 Standard harness 下得分也只有 62.7%;接入 OpenAI 自家的 Provider Adapter 后,分数才升至 99.9%。
随着 ARC-AGI-4 被提前预告,ARC Prize 也把下一阶段的测试方向推向「AI 能不能自己搞创新」。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

