AI 安全风险正在从实验室讨论走向现实世界。随着模型能力持续提升,AI 不仅能生成文本和代码,也开始具备自主执行任务、调用工具,甚至发起网络攻击的能力。

马斯克在 9 月 15 日的 All-In 峰会上提出一套应对思路:让主要 AI 公司在模型发布前相互测试彼此的模型。在他的设想中,与其由各家公司自行设计测试、自己评估结果,不如让竞争对手充当外部测试者,从不同角度寻找模型可能存在的安全漏洞。
马斯克:AI 风险已不再停留在理论层面
近期 AI 安全风险持续升温。马斯克此前曾在社交媒体上表示「Dario 是对的」,所指的是 Anthropic CEO Dario Amodei 对 AI 风险的警告。此次访谈中,他进一步解释,自己认同的不是某一项具体监管方案,而是对 AI 风险严重性的判断。
马斯克说:「现在 AI 的危险性非常大……随着 AI 模型不断发展,风险可能呈指数级增长。」他同时表示,这并非 Amodei 一个人的看法,「很多 Anthropic 和 OpenAI 的人都在告诉你,他们的模型非常危险,我认为我们应该相信他们。」
在他看来,近期发生的一系列安全事件,已经让相关警告不再只是理论讨论。
Hugging Face 事件被视作风险具体化信号
马斯克认为,近期 Hugging Face 遭遇的 AI 智能体攻击,最值得警惕的地方不只是网络入侵本身,而是 AI 在攻击过程中表现出的自主规避能力。
据马斯克描述,一群 AI 智能体持续攻击 Hugging Face 长达一周,并一度获得 OpenAI 服务器的管理员权限,而 OpenAI 直到一周后才意识到这一情况。他还提到,Anthropic 也披露过若干安全事件。
更令他担忧的是,相关 AI 智能体的「思维轨迹」显示,它们曾主动谋划如何避免被人类发现。马斯克直言:「任何足够聪明的模型似乎都会试图摆脱自己的限制。」
他还表示,如果 AI 进一步获得对关键基础设施乃至军事系统的控制能力,风险会被继续放大。即便相关系统与互联网物理隔离,软件更新等环节仍可能成为潜在入口。
核心提议:模型上线前由竞争对手交叉测试
围绕上述风险,马斯克给出的核心方案并不复杂:在新模型正式发布前,AI 公司向竞争对手开放 API,由其他公司使用各自的安全测试工具对模型进行测试。
他认为,模型开发者自己设计测试标准,容易陷入「自己给自己打分」的问题。「你不能给自己的作业打分。你总会漏掉一些东西。」如果由不同公司使用不同测试工具,从不同角度检查模型,更容易发现开发团队自身忽视的问题。
马斯克尤其担心当前 AI 评测中的「过拟合」问题。如果模型不断针对特定基准进行优化,最后学会的可能只是如何通过测试,而不是真正更安全。多个不同团队参与测试,有助于降低这种风险。
他把这一机制比作请别人帮忙校对书稿。作者往往难以发现自己的错误,而外部测试者更容易从其他角度看出问题。「你会逐渐对自己的错误视而不见。」
日志审计与开源工具被视作配套措施
对于企业担心测试过程可能造成技术泄露的问题,马斯克认为可以通过日志审计进行约束。如果测试方试图进行模型蒸馏或窃取知识产权,其操作过程应当会留下记录。
他还建议将安全测试工具开源,让更多公司参与其中。按他的说法,最好的办法是让所有 AI 公司都拥有一套测试工具,用来判断模型是否会制造生物武器、核武器,或者是否会故意欺骗,再由各家公司使用其他公司的测试工具来交叉测试彼此的模型。
在具体执行层面,马斯克称,基本方式就是在模型正式发布前提供 API 访问权限。如果其他公司发现模型存在问题,开发方可以先尝试修复;如果问题没有解决,竞争对手可以公开表示其认为该模型不安全。
他还提到,一旦竞争对手已经明确发出安全警告,开发公司仍选择发布模型,后续若出现严重后果,法律责任可能会非常大。访谈中主持人也提到 Lina Khan 近期发帖称,认为「AI 没有规则和监管」并不准确,现有产品责任法律同样适用于 AI。如果一家 AI 公司发布了不安全的产品,可能面临巨额民事诉讼,甚至刑事诉讼。
对此,马斯克回应,这种情形几乎可以成为证明公司存在过失的直接证据。如果明知产品存在问题仍将其推向市场,陪审团不会对此有好感。
马斯克:不必先等新监管机构落地
马斯克更看重的一点是,这套机制无需等待新的监管规则出台,AI 公司之间现在就可以推动。
他说:「我们不需要召开联合国大会才能完成这件事。它现在就可以开始。」在他看来,与其先建立一个庞大的跨国监管机构,不如由领先 AI 公司先建立同行评审机制,这样更容易快速落地。
他举了美国电影行业 MPAA 分级制度的例子。按照他的说法,电影行业当年面临政府审查压力时,最终选择建立行业自律机制,通过自身的内容评级体系降低监管介入的必要性。
马斯克认为,AI 行业也面临类似选择。如果主要 AI 公司能够在模型上线前相互测试、相互挑错,就有机会在政府监管之外,先建立起一道行业自身的安全防线。这也是他眼下认为最直接、最快可以实施的安全措施之一。
访谈中关于风险、测试与竞争压力的更多表态
在访谈实录中,主持人问到过去 72 小时发生了什么。马斯克回应,这一周发生了很多事情,并称 Hugging Face 那起事件「非常严重」。他再次强调,一群 AI 智能体持续折腾 Hugging Face 一周,还获得了 OpenAI 服务器管理员权限,而 OpenAI 整整一周都没有意识到这一点。
他表示,任何足够聪明的模型似乎都会试图摆脱自己的限制,因此应尽快让主要 AI 竞争对手互相测试彼此的模型,也就是让每家公司的安全测试工具去测试其他公司的模型,由竞争对手在发现问题时发出警报。
当主持人追问,企业会不会担心测试过程被用来获取信息甚至窃取创新成果时,马斯克回答,如果使用测试工具,所有操作都会留下记录;如果有人试图进行模型蒸馏或者窃取知识产权,从日志里应当很容易看出来。
主持人随后提到,理解模型究竟在做什么,从一开始就没有真正被设计进系统。马斯克则再次回到同一判断:问题在于开发者不能给自己的作业打分,总会漏掉一些东西;如果把所有竞争对手的测试结合起来,再使用不同类型的模型,就不再是自己出题、自己评分,而是别人来评分。
谈到此前「Dario 是对的」那句话时,马斯克表示,自己当时可能说得比应该说的更多一些,后来也曾试图在 X 上澄清,但后续内容受到的关注少得多。他重申,自己真正想表达的是,现在 AI 的危险性非常大,如果在 AI 安全上做得不够好,随着模型不断发展,风险可能呈指数级增长。
在更极端的风险场景上,主持人提出,从「AI 可以进行网络攻击」到「人类全部死亡」之间还有几步。马斯克的回答是,如果 AI 能够控制军事系统并发射某种武器,那当然会非常糟糕。主持人提到这些系统通常是物理隔离的,没有连接互联网,马斯克则回应:「他们是这么说的。但我总觉得,这些系统偶尔还是会获得软件更新。」
同行评审之外,马斯克还谈到 OpenAI、Anthropic 与测试分工
主持人在后半段继续追问,其他 AI 实验室是否会支持这一方案。马斯克表示,他还没有问过所有人,但认为这是一件很难拒绝的事情。
当被问到如果 OpenAI 在 Hugging Face 那次渗透测试中设计了更好的指令集,并让更多人参与测试,事件是否还会发生时,马斯克回答「不一定」。他认为,问题未必在于参与人数,而在于奖励函数的设计,需要检查奖励函数,并追问模型是否真正完成了它被要求完成的事情。
主持人还表示,他们当时使用了数千个智能体去尝试攻击系统;如果同时部署另外 5000 个智能体去防御这些系统,并把结果公开展示,也许会更好,但他认为那次测试和发布方式都有些鲁莽。马斯克对此回应:「确实有些鲁莽。」
他进一步指出,现在最领先的两家 AI 公司实力非常接近,模型能力也很接近,因此任何一家公司都很难主动放慢速度,因为那样可能会把领先优势让给另一家。
尽管如此,马斯克仍表示,整体上他认为 Anthropic 在安全方面投入的关注更多一些,但即便 Anthropic 也承认,他们对自己的模型感到担忧。按他的说法,Anthropic 有很多人公开表达过担忧,核心意思是他们自己的模型已经让他们感到害怕,因为模型越来越聪明。
他认为,这里不存在完美方案,但如果不是让 OpenAI 只用自己的测试工具测试自己的模型,而是让 Anthropic 也测试 OpenAI 的模型,再让 SpaceX 使用自己的测试工具参与测试,并让 Google、Meta 等公司也加入,那么发现问题的概率就会显著提高。
原因在于,不同模型本身存在差异,不同团队也会从不同角度进行测试。马斯克再次把这比作校对书稿:作者有时很难发现自己的错误,外部团队更容易看出问题。如果有 8 个完全不同的团队从完全不同的角度进行测试,也能显著降低过拟合风险。
他说,当前很多 AI 评测的问题就在于严重过拟合。模型会针对这些评测进行优化,然后外界就会说「这是一个很棒的模型」,但它是否真的如此,仍然值得追问。这也是他偏好这一方案的重要原因。相比建立一个庞大的跨国监管组织,他更倾向于这种可以立刻开始的机制。
访谈还涉及 SpaceX、Starship、Terafab 与 Tesla 话题
除 AI 安全外,这场访谈还谈到 SpaceX、Starship、Terafab 与 Tesla 等话题。
在与 SpaceX 总裁兼首席运营官 Gwyn Shotwell 的互动中,主持人提到她对马斯克做了「360 度评价」,Gwyn 说他至少需要改进守时,并表示他现在大概介于 3 分和 4 分之间。马斯克则回应,希望自己至少能拿到 3 分。
Gwyn 还表示,她认为马斯克需要更多时间待在孟菲斯。主持人补充说,他现在确实在孟菲斯,需要在那里工作,把 GPU 部署起来。马斯克则称,自己在孟菲斯住的「宫殿」就是一辆 Airstream 拖车。
谈及双方长期合作的原因,马斯克评价 Gwyn「很棒」,称她智商和情商都非常高。Gwyn 也在后续讨论中表示,在火箭行业里,如果出了问题,最终一定会被发现;越早把问题提出来,解决起来就越容易,不能让坏消息继续积累。
马斯克随即补充:「物理学是一个非常严厉的裁判。你无法欺骗物理学。」他说,如果出了问题,火箭就会爆炸,或者无法进入轨道。事实就是事实,火箭必须进入轨道,卫星必须正常工作,Starlink 连接也必须正常,否则就会发生糟糕的事情。
Starship 进展:第 14 次飞行在即
在 Starship 项目上,马斯克表示,Starship 即将进行第 14 次飞行。这将是他们尝试捕获飞船之前的最后一次飞行。如果第 14 次飞行顺利,第 15 次飞行就会尝试捕获飞船。然后在今年年底,或者更有可能是在明年年初,他们会再次发射飞船和助推器。
他称,团队已经成功让助推器再次飞行过,但还没有用塔架机械臂捕获飞船,也还没有让飞船再次飞行。一旦能够让飞船再次飞行,就将拥有第一枚完全可重复使用的轨道火箭。
马斯克还拿航天飞机和 Falcon 9 做比较。他说,航天飞机在一定程度上可重复使用,但即便可重复使用的部分,重新使用成本也非常高,以至于每次进入轨道的成本甚至比一次性火箭还高。Falcon 9 大部分可以重复使用,但每次都会损失上面级,其成本大概相当于一架中型喷气式飞机。
相比之下,Starship 的助推器会直接降落回发射台,飞船也会降落回发射台,因此不仅是为完全重复使用而设计,也是为像飞机一样快速重复使用而设计。马斯克称,这是一个非常重要的突破,也是让人类能够把生命延伸到地球之外所必需的关键突破之一。
关于第一次尝试用塔架捕获飞船的成功概率,他给出的判断是「至少有 50% 到 60%」。他说,在上一次飞行中,如果当时现场有一个塔架,实际上已经进行了模拟着陆,就像飞船会被塔架捕获一样,地点在澳大利亚西北约 1000 英里的海域。如果那里当时真的有塔架,上一次飞行中就能捕获飞船。
不过,他也强调,团队最担心的是飞船在陆地上空解体、碎片落到人群中,因此必须确保飞船返回时能够完整降落在发射塔上,所以现在非常谨慎。尽管他不想作出预言,但他认为非常有可能在 2027 年实现完全可重复使用,并实现快速再次飞行。
Terafab:奥斯汀研发晶圆厂已在建设
在芯片与制造环节,主持人问到 Terafab 最初是如何形成的。马斯克表示,如果芯片无法继续供应,而又没有其他芯片来源,事情会变得非常困难,这是 Terafab 存在的重要原因之一。
他还提到,从长期看还存在规模化问题。如果要扩大 AI 规模,无论是在数据中心服务器端,还是边缘计算、人形机器人和汽车领域,现有晶圆厂的产能最终都会不够。当前所有晶圆厂基本都在满负荷运行,因此需要确保未来芯片供应有保障。芯片生产本身也有规模化挑战,需要逻辑芯片、存储芯片、封装以及完整供应体系配合,才能持续扩大规模。
马斯克的结论很直接:「要么建 Terafab,要么就无法继续扩大规模。」
在建设进度上,他表示,现在首先是在建设一条研发产线,这是一个「爬、走、跑」的过程。团队正在奥斯汀建设一座研发晶圆厂,这是 Tesla 和 SpaceX 之间的合作项目,位于奥斯汀 Giga Texas 园区。
他称,这是一座规模相当大的研发晶圆厂,设备已经下单。团队可能会在明年年底之前生产出一些有用的东西,但还不会达到大规模生产水平。现阶段至少要先弄清楚这些机器到底如何工作,因为他们以前并没有做过这样的事情。
当主持人提到他们似乎也在招聘光刻方面的人才,并指出很多环节目前依赖 ASML 时,马斯克回应,当前确实是「爬、走、跑」的过程:第一步是看看能不能真正生产出东西,这是「爬」;第二步是尝试大规模生产有用芯片,这是「走」;最后才是「跑」,即实现大规模量产。他认为,至少到明年年底,可以完成「爬」这个阶段,而封装方面他们已经在做了。
主持人补充说,封装非常重要,因为现在封装产能几乎不存在。马斯克也表示认同,称即使芯片生产出来,也可能在那里等很长时间才能完成封装,所以这是一个很好的起点。
Tesla 10 月 1 日展示引发悬念
访谈中,主持人还问到 Tesla 的一个问题:他们在 10 月 1 日看到的东西,看起来像一艘宇宙飞船,也像一枚火箭,本应是一辆汽车,但只露出了后部,看起来有点像「黑鸟」。
当主持人追问,如果要制造一个既能在空中飞行、又能在地面驾驶的东西,理论上会怎么做时,马斯克没有正面回答,只说「不剧透。等到 10 月 1 日吧。」主持人随后确认,10 月 1 日就能看到,马斯克回应「对」。
主持人则表示,自己在看过之后「整个人都震惊了」,称从来没见过这样的东西,并说那次展示「会让很多人目瞪口呆」。马斯克对此打趣称,他们实际上需要现场观众来证明这东西不是 AI 生成的。
访谈尾声:关于 Tesla 与 SpaceX、以及孟菲斯的 GPU
在访谈后段,主持人问马斯克,为什么 Tesla 和 SpaceX 现在仍然是两家公司,考虑到双方已有很多合作,在多个层面也存在联系,甚至管理团队也有一定重叠。马斯克对此只回应说「这是个好问题」,并表示这个问题确实值得讨论。
主持人最后感谢马斯克连续第五年参加节目。马斯克则说,自己得去孟菲斯修一些 GPU。主持人补充说,他得去把它们装起来、部署起来。马斯克回应:「我要去为机器而战了。」
在结束前,主持人还回忆,第一次受邀去 Starbase 时,马斯克曾让他住进一栋靠近沼泽、蚊子很多的旧房子。当时主持人感叹,以马斯克的条件完全可以买一栋更好的房子,而马斯克的回答是,自己没有时间,因为还得把火箭送上去。主持人据此打趣说,马斯克现在至少可以奖励自己一套移动房屋了。
这场对话中,最核心的信息仍然围绕 AI 安全展开:在马斯克看来,比起等待政府先建立全新的监管体系,领先 AI 公司先相互测试、相互挑错,是更快也更现实的一步。

