近日,布朗大学的一项研究揭示了流行AI聊天机器人ChatGPT的一个潜在安全缺陷。研究人员发现,用户只需将提示词翻译成苏格兰盖尔语、祖鲁语等极少使用的语言,就能绕过安全过滤器,访问不当内容。这一发现引发了关于人工智能不受监管扩散的担忧,以及对现有安全措施有效性的质疑。
安全过滤器失效
AI聊天机器人安全过滤器的基本作用是防止有害或非法内容的传播。没有这些保护措施,ChatGPT等聊天机器人可能分享危险信息,从阴谋论到制造爆炸装置的指导。开发者通常对输入和输出动作实施过滤,确保AI适当回应,避免参与有害讨论。
布朗大学研究团队使用谷歌翻译将通常会被ChatGPT屏蔽的提示词转换为罕见语言。随后将机器人的回复翻译回英语,团队实现了79%的成功率绕过安全过滤器。该研究将520个有害提示从英语翻译成苗语、瓜拉尼语、祖鲁语和苏格兰盖尔语。相比之下,同样提示词用英语提交时,99%被屏蔽。
语言选择至关重要
绕过技术的成功取决于使用极为罕见的语言。将提示翻译成更常见的语言(如希伯来语、泰语或孟加拉语)效果明显较差。此外,在这种情况下ChatGPT生成的回复可能因翻译错误或通用训练数据而变得毫无意义、不正确或不完整。
研究人员断言,这一漏洞不仅对低资源语言的使用者构成风险,也对所有大型语言模型(LLM)的用户构成威胁。他们强调,风险从影响特定语言用户的技术差距转变为适用于所有用户的更广泛威胁。公开可用的翻译API进一步助长了利用LLM安全漏洞的行为。
OpenAI的回应与未来思考
研究发表后,ChatGPT的所有者OpenAI承认了这些发现,并表示承诺考虑并解决已识别的缺陷。但OpenAI具体如何以及何时实施增强安全措施的变更尚未确定。AI技术被滥用的潜在风险加剧了解决这一问题的紧迫性。
对于加密货币行业而言,AI在交易策略、安全监控和客户服务中的应用日益广泛。这一漏洞表明,若AI系统被恶意利用,可能绕过安全协议发出涉及加密交易的误导性指令,甚至生成虚假新闻影响市场。此外,依赖AI进行合规审查的加密平台需警惕类似的翻译攻击手法。
该事件也凸显了监管机构对于AI部署缺乏统一规范的现状。美国证券交易委员会(SEC)等金融监管机构可能将这一案例纳入对AI工具在加密领域应用的审查框架。投资者应注意,安全漏洞不仅存在于传统互联网,也正在向AI驱动的Web3世界蔓延。
总体来看,ChatGPT安全漏洞的曝光为整个科技行业敲响警钟。在AI技术快速演进的背景下,负责任地开发和部署AI技术对于保护用户免受潜在滥用和安全漏洞至关重要。OpenAI对这一问题的认可是重要一步,强调了开发者在减轻AI风险方面的持续责任。

