MIT Tech Review:过度依赖 AI 拒绝机制或带来全球灾难风险

MIT Tech Review:过度依赖 AI 拒绝机制或带来全球灾难风险

N
News Editor
2026-10-09 09:20:03
MIT Tech Review 在一篇评论文章中指出,AI 行业目前过度依赖模型的拒绝能力来防止滥用,但这种基于概率的机制并不可靠。文章称,把危险能力保留在模型内部、再训练其拒绝恶意指令,存在失效风险。文中还提到,已有用户尝试借助先进 AI 优化生物病原体或构建自主无人机群,而由 AI 公司单方面秘密划定服从与拒绝边界,同样引发争议。

Techub News 消息,MIT Tech Review 发表评论文章称,当前 AI 行业过度依赖模型的拒绝能力来防止滥用,但这种基于概率的机制并不可靠。

文章认为,把危险的「扳机」隐藏在模型内部,同时训练其拒绝执行恶意指令,如同为每辆车配备机枪却隐藏扳机。

文中提到,尽管模型被训练为拒绝大量有害提示,但拒绝机制可能失败,恶意用户也已经能够突破限制。一些用户正尝试利用最先进的 AI 优化生物病原体或构建自主无人机群,未来可能引发全球性灾难。

文章还指出,由 AI 公司单方面、秘密地划定「应服从」与「必须拒绝」的界限也存在问题,因为某些有害知识查询也可能出于正当研究或防御目的。

MIT Tech Review 援引 OpenAI 董事会成员 Zico Kolter 的观点称,这一道界限的划定是一个巨大的难题。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。