Anthropic引入外部评估者驻场,授予接近员工级访问权限

Anthropic引入外部评估者驻场,授予接近员工级访问权限

N
News Editor
2026-09-19 04:23:58
Anthropic 于 9 月 18 日宣布与 Accenture 合作,引入外部评估者进入公司内部,对前沿模型开展独立评估。根据官方公告,双方各自预计在未来五年投入至少 10 亿美元建设相关能力。驻场评估者将在 Anthropic 内部工作,并获得相当于员工的访问权限,职责涵盖红队测试、对齐评估、防护机制测试、训练观察及安全承诺查核等。

Anthropic 于 9 月 18 日宣布与 Accenture 合作,允许外部评估者进入公司内部,对前沿模型进行独立评估。根据官方公告,双方各自预计在未来五年投入至少 10 亿美元,用于建立这方面的能力。

驻场评估者将获得接近员工级权限

这项安排最具体的部分在于权限范围。公告写明,嵌入式评估者将在 Anthropic 内部工作,并拥有「相当于一名员工的访问权限」。

公告列出的工作内容包括:

  • 评估与红队测试模型
  • 进行对齐评估
  • 测试模型的防护机制
  • 在训练过程中观察模型
  • 跟进公司关于模型开发与部署的决策
  • 直接与员工对话
  • 评估公司运营并查核其安全承诺
  • 找出盲点并回报事件

执行这项工作的,是 Accenture 旗下的专业 AI 业务 Faculty。

对应 Amodei 此前提出的主张

Anthropic 在公告中将这项合作与首席执行官 Amodei 的文章《我们必须调控前沿速度》联系起来。该文主张在 Anthropic 内部安置评估者。

换句话说,此前偏向宣示性质的承诺,现在已经出现了明确的执行方和投入金额。文中提到的 10 亿美元,是双方各自的预期投入,周期为五年。

ABMedia 文中提到,链新闻此前曾报道 Anthropic 与 OpenAI 罕见承诺放缓竞赛,这次则是这一路线中首个带有明确数字的动作。

Anthropic强调安全责任仍由自身承担

公告中有一句表述被特别点出:「独立的嵌入式评估者并不会减少我们的当责,而是让它更可被验证。我们模型的安全性仍然是我们的责任。」

这句话回应的是一个可以预见的问题:如果把评估工作交给外部机构,是否也意味着把责任一并转移。Anthropic 在公告中的回答是否定的,并明确表示模型安全责任仍由公司自身承担。

启动时间和后续机制尚未披露

目前公告没有给出合作启动时间。这项合作也并非独家安排,Anthropic 表示,未来几周还会公布其他评估者,并正与 METR 等非营利评估机构展开对话。

公告中没有具名引用任何一位高管的说法。至于评估者发现问题后的处理流程、报告是否会对外公开,以及「查核安全承诺」在实际操作中如何执行,现阶段也都没有说明。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
1200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。