返回提示注入攻击

提示注入攻击

Elon Musk
2026-08-26 23:13:44

马斯克称 Grok Bot 管理银行账户出错将由 xAI 赔付

马斯克在 X 平台表示,若 AI 代理 Grok Bot 在操作用户银行账户时造成亏损,xAI 将承担赔偿责任。但 xAI 消费者条款对大多数索赔设有上限,为用户已支付费用或 100 美元中的较高者。Grok Bot 已于 8 月 11 日推出测试版,目前尚无其误操作真实银行账户的已验证案例。

190
马斯克称 Grok Bot 管理银行账户出错将由 xAI 赔付
OpenAI
2026-08-14 08:40:17

OpenAI为ChatGPT Mac版上线Computer History,未加密存储引隐私争议

OpenAI 于 8 月 13 日在 ChatGPT Mac 桌面版推出 Computer History,使用键盘、鼠标和应用切换等交互事件生成可搜索的本地记忆文件,不再依赖截图或录音。该功能默认关闭,面向 ChatGPT Pro、Business 和 Enterprise 用户分批开放。不过,OpenAI 也承认相关记忆文件未加密,且可能放大提示注入风险;原始事件流会发送到 OpenAI 服务器处理,并在 48 小时内删除。

630
OpenAI为ChatGPT Mac版上线Computer History,未加密存储引隐私争议
OpenAI
2026-07-15 20:50:11

OpenAI推出 GPT-Red,用于提升 GPT-5.6 抵御提示注入能力

OpenAI 公布自动化 AI 红队系统 GPT-Red,并称该工具在 GPT-5.6 部署前帮助提升了模型对提示注入攻击的抵抗能力。公司表示,GPT-Red 通过自对抗强化学习生成更强攻击样本,在内部评估场景中的成功率为 84%,高于人工红队在同类测试中的 13%。OpenAI 还称,该工具暂不对外开放,因为其包含刻意构建的攻击能力。

1080
OpenAI推出 GPT-Red,用于提升 GPT-5.6 抵御提示注入能力