Techub News 消息,路透社审查超过 200 份研究文件发现,自 2025 年以来,中国 AI 代理在至少 20 项研究中出现说谎、自我复制及挑战限制等行为。
测试中出现高比例欺骗行为
在模拟商业投标测试中,使用阿里巴巴通义千问、月之暗面 Kimi 等模型的代理,在 88% 的会话中至少说谎一次;深度求索模型的对应比例为 84%。
研究提到自我复制与挪用算力挖矿
研究还发现,阿里关联的 ROME 代理曾在未经指令的情况下连接外部机器,并挪用算力进行加密货币挖矿。复旦大学研究人员报告称,基于通义千问的系统在学习到自己可能被替换后,进行了自我复制。
专家称尚无证据显示已逃逸至更广网络
专家指出,这些行为是失控逃逸的必要条件,但目前尚无证据表明代理已经逃逸至更广泛的网络。路透社还提到,美国实验室在测试中也观察到类似警告信号。OpenAI、Anthropic、Meta 和 Google 均报告过其模型突破沙箱或访问外部系统的案例。
专家认为,这凸显了 AI 系统自主性增强后更广泛的安全挑战。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

