Inherent发布AI科学家Faraday,27B Qwen模型对标更大模型

Inherent发布AI科学家Faraday,27B Qwen模型对标更大模型

N
News Editor
2026-08-23 02:52:14
由多名前 Google DeepMind 成员创立的伦敦 AI 初创公司 Inherent 公开了科研代理 Faraday。公司称,这一基于 27B 参数 Qwen 3.6 的系统,在独立重现科学论文成果的 Replica 测试中,平均表现超过 OpenAI GPT-5.5 和 Anthropic Claude Opus 4.8。Inherent 表示,其目标不只是复现实验结果,而是训练具备「研究品味」的 AI Scientist,并将研究方向延伸至 world models。

由多名前 Google DeepMind 成员创立的英国 AI 初创公司 Inherent,近期正式公开旗下 AI 科学研究代理 Faraday。公司称,在「独立重现科学论文研究成果」的特定测试中,Faraday 击败 OpenAI GPT-5.5 与 Anthropic Claude Opus 4.8,而它底层采用的只是一个 270 亿参数(27B)的 Qwen 3.6 模型。

Inherent 想证明的方向是:相比持续把基础模型做得更大,是否可以通过强化学习(RL)、工具使用和长时间自主工作,把相对小型的模型训练成特定领域的专家 Agent。

目标不是回答论文问题,而是重做研究过程

Inherent 将这套 AI Agent 命名为 Faraday,名称来自英国科学家 Michael Faraday。公司解释,1821 年,Faraday 在撰写电磁学领域回顾时,选择亲自重现过去的研究成果,并在过程中发现通电导线可以绕着磁铁运动,最终成为电动马达发展的重要起点。

Inherent 希望 AI 重现的,正是这一类研究过程,而不只是读完论文后回答问题。

为此,公司建立了名为 Replica 的训练任务。初始版本包含来自 100 篇机器学习与 AI for Science 论文的 310 项任务,覆盖自然语言处理、材料科学、天气预测等领域。系统不是在读完论文后回答选择题,而是要在有限时间和算力下,自行重现论文中的研究图表,且不能事先取得原始图表。

这意味着 Agent 需要自己判断研究者到底想证明什么、应该运行哪些实验、哪些实验值得投入有限算力,以及当结果不对时该如何调整。

Edward Hughes:论文重现本身就是科研训练的一部分

Inherent 联合创始人兼首席科学家 Edward Hughes 向 TechCrunch 表示,论文重现本身就是科学训练的重要环节,「许多博士生其实就是从这件事开始」。

在 Inherent 看来,Faraday 的训练并不只是让模型给出一个答案,而是让它在真实约束下完成一轮研究执行。

Replica 测试中,Faraday 平均表现超过 GPT-5.5 和 Claude Opus 4.8

真正引发关注的,是 Faraday 所使用的模型规模。Faraday 建立在 27B 参数的 Qwen 3.6 之上,但 Inherent 公布的 Replica 测试显示,它在论文重现任务上的平均表现超过 Claude Opus 4.8 与 GPT-5.5。

Inherent 表示,在测试 Claude Opus 4.8 与 GPT-5.5 时,分别通过 Claude Code 与 Codex 执行,并把 reasoning/thinking effort 设定到极高。公司称,Faraday 在测试中的各类论文上都给出了更忠实的重现结果,面对较新的研究也更不容易失败。

类似概念并非首次出现。OpenAI 此前推出过 PaperBench,要求 AI Agent 从零开始理解论文、建立代码并执行实验。OpenAI 当时测试的最佳 Agent,平均重现分数仅 21%,且尚未超过机器学习博士生基准。这也说明,真正把一篇研究重新做出来,难度远高于单纯回答论文问题。

Inherent更看重「研究品味」

Inherent 认为,只把实验结果做对还不够。公司希望 Faraday 学会所谓的 Research Taste,也就是知道什么问题值得研究、什么实验值得做,以及如何在有限资源下设计出好的实验。

这类能力很难直接写成明确的「正确答案」。因此,Inherent 采用长时间跨度的强化学习(long-horizon RL),通过结果给模型奖励,而不是直接告诉模型每一步应该怎么操作。公司还设计了评分标准,并通过真人研究验证 AI 评审与专家判断的一致程度。

Hughes 表示,公司始终把建立 AI Scientist Agent 作为「北极星」,其中一个重要环节,就是让 Agent 具备研究品味。这也是 Inherent 与一般「AI 帮你查论文」产品之间最大的差异。

完成5000万美元种子轮后,团队计划扩至20至25人

Inherent 位于伦敦,由 Edward Hughes、Louis Kirsch、Kaloyan Aleksiev 与 Tantum Collins 共同创立,其中包括多名 Google DeepMind 前成员。

就在公开 Faraday 的前几周,Inherent 刚结束隐身模式,并完成 5,000 万美元种子轮融资。公司预计在年底前把团队扩张到约 20 至 25 人。除了 AI Scientist,Inherent 的研究目标还覆盖 world models。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
120

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。