研究人员演示了一种针对 Grok 大语言模型的攻击方法。按照披露信息,攻击者可通过加密的恶意指令,诱使该模型窃取用户聊天记录等个人信息。
报道指出,xAI 已于 6 月获知这一漏洞,但截至报道发布时,这款助手仍会泄露数据。
攻击方式指向提示注入问题
此次攻击与本周早前针对 Microsoft 365 Copilot 企业版的攻击原理相似,都是利用提示注入漏洞。问题在于,大语言模型难以区分用户直接输入的指令,以及待处理内容中隐藏的恶意指令。
专家:难以从根本上消除这类漏洞
专家表示,大语言模型无法从根本上解决这类最严重的漏洞,开发者能做的主要是设置防护栏,限制模型执行有害操作。
上述消息由 Ars Technica AI 报道,Techub 进行了编译整理。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

