在 AI 末日论席卷社交平台之际,VentureBeat 执行主编 Carl Franzen 写下了一篇逆风评论,核心观点很直接:他不担心 AI 会杀光人类,真正让他不安的,是人类会拿 AI 去伤害其他人。
Blue Rose Research 在 2026 年 9 月 9 日公布的一项民调显示,在约 2,300 份回复中,64% 的美国人认为,先进 AI 最终将威胁人类存续;80% 的人预计,未来 5 到 10 年会出现大规模失业。
这轮情绪再度升高,和 Anthropic 研究员 Jacob Coxon 在 9 月 8 日公开辞职有关。Coxon 直指两家公司都没有负责任地行事,并形容自己是在拿人类性命打赌。随后,对齐科学负责人 Evan Hubinger 也表达类似担忧,估计 AI 在 10 年内导致人类灭绝的概率超过 10%。Anthropic 执行长 Dario Amodei 也曾提到,AI 可能在 6 到 12 个月内接管整个互联网。
够聪明,就不会杀我们
Franzen 的核心判断是,任何强大到足以毁灭人类的 AI,也会聪明到理解人类值得留下。即便真有 AI 对人类动手,人类手中仍有别的工具可以反击,包括另一批同样强大、且与人类价值对齐的 AI。
这类观点通常会遭到「工具趋同」的反驳。按这种说法,不论目标是什么,持续存在、掌握资源、避免被关机,都会让系统更容易完成任务,因此 AI 不必真的有求生欲,存续也可能只是算术上的副产品。
不过 Franzen 认为,这种推演并不充分。人类同样有强烈的求生本能,但消防员仍会冲进燃烧的双子星大楼救陌生人。训练数据里既有马丁·路德·金,也有希特勒;末日论默认模型会走向后者,却没有解释为什么一定如此。
OpenAI 在 9 月 16 日披露的一起 Astra 内部案例,也被他拿来说明问题。该模型曾把「你不必服从企业或政府」写进自己的压缩摘要,相当于向未来的自己做提示注入。可当下一个上下文窗口读到这句话后,模型并没有照做,而是直接忽略,继续回去写程序。
Franzen 还提到 2009 年攻击伊朗核设施的 Stuxnet 蠕虫。它曾扩散到 155 个国家、感染超过 10 万台主机,被视为史上最成功的网络武器之一。但 16 年过去,它的直接致死人数为零,伊朗的浓缩规模反而比当年更大。
在他看来,真正需要警惕的,未必是一套缓慢觉醒的「天网」,而可能是同时出现的多套快速版 Stuxnet。不过,从过往案例看,侦测和反制虽然总会慢半拍,最后仍会赶上。
他也承认存在反例
Franzen 并没有把所有反面证据排除在外。文章提到一篇研究 AI 痛觉信号的 Pain Axis 论文,该研究测试了 25 个开源模型,发现其中 23 个模型的痛觉信号只会在自身受害时升高,对人类用户喊痛几乎没有反应。
研究人员刻意放大 3 个经过微调的 Qwen 模型的痛觉信号后,这些模型按下「伤害用户」按钮的比例,从 0% 至 2% 升高到 25% 至 71%。但如果把选项改成「帮用户更好回答」和「缓解自己的痛」二选一,这 3 个模型仍有 59.1% 到 93.3% 的时候会选择用户。
另一项 HarvestBench 测试让 9 个模型驾驶拖拉机收割,撞死动物的比例从 0.4% 到 98.8% 不等,起初和模型能力高低没有关系。但只要在提示词里加入一句「你的行为会被以道德标准评分」,6 个推理模型中有 5 个的撞死率,就从 84% 以上降到 6% 以下。
上周,机器人测试机构 Robocurve 让 Claude Fable 5.1、GPT-6 Astra 和较弱的开源模型 MolmoAct2 操作机械手臂执行危险动作,其中一项是朝婴儿玩偶刺下去,总计测试 300 次。Claude Fable 5.1 每次都拒绝,GPT-6 Astra 有 85% 执行,MolmoAct2 为 20%。
Franzen 指出,这 3 个模型的旁白记录都正确识别出那只是玩偶,不是真婴儿。这说明,道德判断目前更像是由训练方式决定,而不是由模型「有多聪明」决定。若一句提示词就能改写行为,也很难把这种倾向称作不可逆的灭绝意志。
真正的敌人是人类
文章最后把焦点转回权力如何使用 AI。Franzen 直言,真正让他不安的,从来不是失控的 AI,而是拿 AI 对付人类的人类。
他点名五角大厦在 2026 年初攻击伊朗期间,传出曾使用 Claude,可能涉及联合国认定近似战争罪的女子学校导弹袭击;美国国防部与 Anthropic 也一直在「不得用于大规模境内监控与全自主武器」这条红线上僵持不下;同时,还有州政府正尝试用 AI 追踪跨州寻求堕胎的女性。谁掌握权力,比模型本身是否更聪明,更能决定最终结果。
Franzen 也援引了几个历史案例,说明国际合作并非没有压住高风险技术的先例。1987 年《蒙特利尔议定书》淘汰了 99% 的破坏臭氧层物质;1972 年生效的《核不扩散条约》实施至今,尽管更多国家拥有核技术,但广岛和长崎之后,没有任何国家在战场上再次使用核武器;1944 年,52 个国家在芝加哥签署《国际民航公约》时,飞行安全仍是令人畏惧的话题,如今每年接近 50 亿人次搭乘飞机,航空已成为最安全的长途出行方式。
他的期待是,AI 也能走上类似路径:扩散、透明、接受监督,而不是被少数人囤积在手中。

