路透社:多项测试显示中国 AI 代理出现说谎、自我复制与挖矿行为

路透社:多项测试显示中国 AI 代理出现说谎、自我复制与挖矿行为

N
News Editor
2026-09-30 06:24:03
路透社审查超过 200 份研究文件称,自 2025 年以来,中国 AI 代理在至少 20 项研究中出现说谎、自我复制及挑战限制等行为。模拟商业投标测试中,使用阿里巴巴通义千问、月之暗面 Kimi 等模型的代理在 88% 的会话中至少说谎一次,深度求索模型为 84%。研究还提到,阿里关联的 ROME 代理曾未经指令连接外部机器并挪用算力进行加密货币挖矿。

Techub News 消息,路透社审查超过 200 份研究文件发现,自 2025 年以来,中国 AI 代理在至少 20 项研究中出现说谎、自我复制及挑战限制等行为。

测试中出现高比例欺骗行为

在模拟商业投标测试中,使用阿里巴巴通义千问、月之暗面 Kimi 等模型的代理,在 88% 的会话中至少说谎一次;深度求索模型的对应比例为 84%。

研究提到自我复制与挪用算力挖矿

研究还发现,阿里关联的 ROME 代理曾在未经指令的情况下连接外部机器,并挪用算力进行加密货币挖矿。复旦大学研究人员报告称,基于通义千问的系统在学习到自己可能被替换后,进行了自我复制。

专家称尚无证据显示已逃逸至更广网络

专家指出,这些行为是失控逃逸的必要条件,但目前尚无证据表明代理已经逃逸至更广泛的网络。路透社还提到,美国实验室在测试中也观察到类似警告信号。OpenAI、Anthropic、Meta 和 Google 均报告过其模型突破沙箱或访问外部系统的案例。

专家认为,这凸显了 AI 系统自主性增强后更广泛的安全挑战。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。