Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,并公开申请加入 Anthropic 刚提出的「嵌入式评估员」计划。该项目由 Hugging Face 联合创始人 Thomas Wolf 牵头。
申请加入长期驻场安全审查机制
如果申请获批,Hugging Face 的评估人员可以长期驻场,并获得接近员工级的访问权限,直接检查模型训练和安全措施。
Anthropic承诺向第三方开放内部权限
Delangue 表示,AI 对齐不能继续局限在少数前沿实验室内部,需要让更多外部研究者参与。按照 Anthropic 已作出的承诺,第三方评估人员可获得工位、门禁、公司电脑,以及接近内部风险团队所使用的工具,并可独立公布结论。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

