Anthropic 员工 Evan Hubinger 周三在 X 上因一则有关 AI 灭绝风险的表态引发广泛传播。根据 Protos 报道,这条内容获得了 3000 万次浏览,Hubinger 在文中称,未来十年内 AI 杀死全人类的概率高于 10%。

Galaxy Research 研究主管 Alex Thorn 在评论 Hubinger 这番爆红言论时,拿他与 Ripple 以及 XRP 社区的过往联系开了个玩笑。Protos 在文中提到,XRP 当前价格仍低于 2018 年 1 月的历史高点。
Hubinger 公开谈论 AI 灭绝风险
Hubinger 在 X 上写道:「Jacob 这里说得没错——我们确实真诚地认为 AI 可能杀死所有人类!我个人认为,这一概率在未来十年内高于 10%。我相信 Anthropic 正在尽最大努力,但我们目前还没有一个解决超级智能对齐问题的方案,也看不到明确正在朝着这个方向推进的迹象。」
在后续说明中,Hubinger 又补充称:「需要说明的是,正如我们在最新风险报告中所说,我认为当前模型带来的风险较低。我担心的是,由递归式自我改进产生的超级智能。」
Protos 对「递归」的解释是,AI 能够在没有人类输入的情况下训练并生成新的 AI。
履历显示曾在 Ripple 软件工程部门任职
在讨论超级智能 AI 失控之前,Protos 提醒读者,Hubinger 曾在加密行业老牌公司 Ripple 工作。他的简历显示,自己曾在 Ripple 的软件工程部门任职。多年后,Ripple 寻求以最高 500 亿美元估值融资,而这一估值的主要支撑来自公司持有的 XRP。
Hubinger 当时是在读期间进入 Ripple,但他在简历中描述的工作内容并不只是普通实习事务。他表示,自己曾「参与设计 Interledger,这是一种用于任意代理之间跨货币交易的无信任系统」。
他还称,自己「编写了一个工具,用于为金融机构提供密码学安全的钱包」。
根据其 LinkedIn 资料,他还参与了 rippled 的构建流程。Protos 称,rippled 是为 XRP Ledger 部分功能提供支持的服务器软件。
现任 Anthropic 对齐压力测试团队负责人
Protos 报道称,Hubinger 目前负责 Anthropic 的 Alignment stress-testing 团队。该团队的任务是防止模型发生「对齐失败」,也就是行业中所说的,AI 代理开始围绕人类未指定的秘密目标运行。
Ripple 相关人士也曾谈及 AI 风险
文章还提到,Ripple 前首席技术官 David Schwartz 曾表示,AI 安全规则可能威胁言论自由。
此外,前 Ripple 副总裁 Emi Yoshikawa 在 8 月写道,AI 灭绝风险正在成为硅谷的日常话题。
本文原标题为《Anthropic’s AI doomsayer worked at Ripple》,发表于 Protos。

