据动察 Beating 监测,清华大学人工智能国际治理研究院院长薛澜、纽约科学院院长兼首席执行官杜宁凯(Nicholas B. Dirks),以及加州大学伯克利分校人工智能研究实验室人类兼容人工智能中心执行主任 Mark Nitzberg,在 2026 年世界人工智能大会上围绕 AI 智能体治理进行圆桌对谈。
嘉宾表示,AI 正从“辅助判断”走向“自主行动”,逐步成为代替人做事的智能体。这被视为传统委托代理问题在数字时代的全新体现。与人类代理人不同,AI 存在目标不对齐问题,同时作为“黑盒子”也无法承担法律责任,因此问责对象必须转向整个执行链条,包括开发者、部署者和监管者等。
生死决策、不可逆场景与价值判断不得交由 AI 主导
与会嘉宾在讨论中形成高度共识:凡是涉及生死后果的决策、一旦出错无法修复的场景,以及所有涉及伦理与价值判断的问题,都不应由 AI 主导。
嘉宾同时提出,人类可以授权 AI 采取行动,但不能授权 AI 承担责任。每一次授权都应当可以撤回,每一个行动都应当能够追责。让渡代理权的速度,不能超过人类验证 AI 能力的速度。
可信 AI 需满足三项工程特性
在安全机制方面,嘉宾提出,构建可信 AI 需要具备三大工程特性:基础扎实、操作透明、使用中可控。
制度建设指向统一评估与预警机制
在制度层面,讨论认为,应建立全球统一的 AI 安全评估标准、互认的测试体系和事故数据共享机制,同时明确 AI 发展的红线,并建立早期预警监测机制,推动 AI 安全成为全球公共产品。
嘉宾还提到,AI 治理的边界并不是技术终点,而是人类重新认识自身价值、责任与文明方向的起点。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

