Techub News 消息,MIT Tech Review 发表评论文章称,当前 AI 行业过度依赖模型的拒绝能力来防止滥用,但这种基于概率的机制并不可靠。
文章认为,把危险的「扳机」隐藏在模型内部,同时训练其拒绝执行恶意指令,如同为每辆车配备机枪却隐藏扳机。
文中提到,尽管模型被训练为拒绝大量有害提示,但拒绝机制可能失败,恶意用户也已经能够突破限制。一些用户正尝试利用最先进的 AI 优化生物病原体或构建自主无人机群,未来可能引发全球性灾难。
文章还指出,由 AI 公司单方面、秘密地划定「应服从」与「必须拒绝」的界限也存在问题,因为某些有害知识查询也可能出于正当研究或防御目的。
MIT Tech Review 援引 OpenAI 董事会成员 Zico Kolter 的观点称,这一道界限的划定是一个巨大的难题。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

