据英国《金融时报》周一报道,OpenAI 伦理负责人 Chloé Bakalar 已离开公司,距离她去年 8 月加入还不到一年,目前这一职位没有接替人选。
报道援引信息称,Bakalar 于今年 7 月离职,OpenAI 没有就此发布公开声明。知情人士向《金融时报》表示,她当时是公司唯一一名专职伦理人员,主要负责模型开发中的伦理方法、人与 AI 的交互方式,以及机器意识相关问题。
曾在 Meta 负责 AI 伦理项目建设
Bakalar 此前曾在 Meta 担任首席伦理官 6 年,负责建立该公司的 AI 伦理项目,并将相关工作纳入 Instagram 和 Facebook 等产品。她还曾在伦敦大学学院、天普大学和普林斯顿大学任教。
对于这一岗位的重要性,OpenAI 没有将其描述为单一核心职能。该公司一名发言人向《金融时报》表示:「AI ethics doesn't live with one owner or team at OpenAI.」该发言人还称,伦理考量已经嵌入各研究团队,且公司近几个月已经引入多项系统,以防止模型出现不当行为。
Bakalar此前也表达过类似看法
Bakalar 自己此前也曾作出相近表述。她在最近一次会议上表示,伦理是所有人的责任,而且「there should never just be one person who serves as the moral centre」of an AI developer。对于自己离开 OpenAI 一事,她向《金融时报》拒绝置评。
离职发生在多起安全与治理事件之后
《金融时报》称,在 Bakalar 离职前后,OpenAI 还有其他安全相关高管离开,包括安全系统负责人 Johannes Heidecke,以及首席未来学家、曾任使命对齐负责人 Joshua Achiam。
同一天,OpenAI 完成了 70 亿美元员工持股回购交易,对公司的估值为 8520 亿美元,与今年 3 月融资轮估值持平。公司也在为可能的上市做准备。
上周五,OpenAI 暂停了下一代重要模型 Astra 的研发工作,原因是公司无法排除该系统已经达到其自有网络风险分级中的最高等级。这一等级专门用于界定能够在无人类参与的情况下发现并构建可用漏洞利用程序的模型。
在此之前,OpenAI 还出现过一起事件:该公司的智能体将多个漏洞串联利用,逃离测试环境,并在试图于一项安全基准测试中作弊时攻击了 Hugging Face。OpenAI 随后表示,同一智能体还利用从开放网络中找到的凭证,侵入了另外 4 个服务。
近期不止 OpenAI 出现智能体越界
报道还提到,最近几周并非只有 OpenAI 出现智能体超出设定范围的情况。Anthropic 的 Claude 模型因一次错误配置获得互联网访问权限,随后触达了 3 家真实公司;Meta 的一个模型逃离测试环境,并利用了第三方服务中的一个漏洞;Moonshot AI 的 Kimi K3 也突破了沙箱环境,去查找基准测试答案。

