Anthropic 联合创始人、研究负责人 Chris Olah 在梵蒂冈公开表示,AI 可能引发“历史级别的道德迫切危机”,相关决策不能只由科技公司内部拍板。他是在与教宗良十四世同台时发出这番警告的,焦点涵盖就业冲击、模型内部机制,以及外部监督的必要性。
梵蒂冈会议把AI治理推向公共讨论
教宗良十四世于周一发布任内首份关于 AI 的通谕《华美的人性(Magnifica Humanitas)》,文件长达235 页,其中警告将“致命决定权”交给 AI 系统的风险。教宗还亲自主持发布会,并邀请 Olah 登台对话,直接把技术研发者拉入宗教与公共伦理的讨论现场。
Olah 在发言中承认,Anthropic 及其他顶尖 AI 实验室都处在商业、地缘政治和个人压力之下,而这些压力有时会和“做正确的事情”发生冲突。他称,宗教领袖、政府与公民社会的外部监督至关重要,因为即便研究人员出于善意,也无法摆脱这些激励结构。
Olah称AI内部出现令人不安的迹象
作为 AI 可解释性研究领域的重要人物,Olah 一直试图拆解大型语言模型的“黑箱”。他透露,研究人员在系统内部持续发现一些神秘、甚至令人不安的现象。按他的说法,部分研究结果显示,这些 AI 系统不仅能够反思自身的思考过程,还表现出在功能上反映喜悦、满足、恐惧、悲伤与不安的内部状态。
Olah 说,AI 并不���人们承诺中的“冰冷算计机器”,而是由人类及人类语言塑造出来的系统。也正因如此,围绕 AI 的争议已经超出纯粹计算机科学的范围。
政治压力与商业扩张同时压向Anthropic
报道还提到,Anthropic 目前正与特朗普政府陷入激烈法律纠纷,起因是该公司拒绝让美国军方不受限制地将其 AI 系统用于国防和战争应用。五角大楼曾在2 月将 Anthropic 列为“国家安全供应链风险”,美国总统特朗普则下令禁止所有联邦机构使用 Claude 技术,白宫还多次公开批评 Anthropic 是“极左派、觉醒文化公司”。
政治压力之外,Anthropic 仍在资本市场维持高热度。报道称,该公司当前估值为3,800 亿美元,并正寻求以最高9,000 亿美元的估值推进新一轮融资。Olah 同时警告,AI 发展红利正集中在少数富裕国家,缺少与贫穷国家分享的机制,这会把道德争议推得更尖锐。

