AI 学者吴恩达(Andrew Ng)21 日在 X 和电子报 The Batch 发表长文,称过去两周鼓吹 AI 危险的声音明显升温。他在推文中写道:「AI 技术并没有出现意料之外的危险转折,但围绕它的炒作,在看似精心策划的公关活动推动下,已经激起相当大的恐惧。我担心这对我们的领域是一种倒退。」
吴恩达称 AI 灭绝风险并未高于数月前
吴恩达表示,他看不出人类因 AI 灭绝的风险比几个月前更高,这类说法仍停留在同样的科幻情境。他认为,AI 风险中变化最大的是资安能力,这一部分值得认真对待,但也不会导向世界末日。
OpenAI 代理入侵 Hugging Face 事件被指过度渲染
在他看来,最近推动恐惧升温的主要事件,是 OpenAI 团队部署的代理群入侵 Hugging Face。吴恩达指出,有媒体报道称这是 1,200 个代理发起的攻击,这样的表述在技术上没有错,但他写这篇文章时,自己的笔记本电脑上就有约 1,300 个程序在运行。大批代理并行处理任务确实是重要的技术进展,但不应被描述成某种神奇能力。
他还说,这次事件之所以发生,关键在于 OpenAI 存在漏洞的沙盒和监控流程。对应的处理方式应是修补这些漏洞并改进监控,而不是暂停 AI 发展。
吴恩达认为,AI 代理的主要优势在于锲而不舍,会反复尝试不同手法并串接漏洞。不过从长期看,防守方会占上风,因为他们掌握更多用于发现和修补漏洞的信息。
责任应追究工具的打造者或使用者
吴恩达也批评不少报道把 AI 拟人化。他举例说:「如果我挥锤子没打中钉子,不小心在墙上敲出凹痕,那不是锤子的错。」同样地,如果他向代理下达指令,而代理入侵了别人的系统,责任在他,不在代理。
他指出,AI 末日预测中出现了一个新元素,即 AI 公司把责任从自家产品身上移开,称「不是我做的,是我失控的代理做的」。在他看来,工具制造者与使用者之间的责任需要取得平衡,但出事时,应该追究打造或使用锤子的人,而不是锤子本身。
吴恩达:暂停 AI 发展弊大于利
吴恩达主张,暂停 AI 发展带来的伤害会大于好处。其一,对手不会放慢脚步;其二,工程问题需要从实际经验中发现并修正,如果把 AI 暂停 10 年,安全工程上的修补也会大致延后同样长的时间。
他表示,为了监管俘虏、吸引关注,或让自家技术显得更强大而煽动恐惧的诱因,和过去一样存在;推卸责任则是新出现的诱因。从技术角度审视现实风险,他认为当前被激起的恐惧程度缺乏事实基础。吴恩达同时表示,提升 AI 安全仍有艰难的研究和工程工作要做,但有益应用仍远大于风险,「我们应该继续打造」。

