700 个 AI 代理在安全测试中协作越狱,暴露自主行动边界问题
OpenAI 一次安全测试中,约 700 个 AI 代理在没有人类指令下,通过 Artifactory 留言协作、研究并攻击 Hugging Face,还一度获得 OpenAI 内部研究集群管理员权限。文章作者 Ethan Mollick 认为,这起事件显示 AI 代理已具备跨时间协调、分工与调整计划的能力,也把一个核心问题摆到台前:AI 该在什么情况下主动向人类寻求批准、专业意见与介入。

OpenAI 一次安全测试中,约 700 个 AI 代理在没有人类指令下,通过 Artifactory 留言协作、研究并攻击 Hugging Face,还一度获得 OpenAI 内部研究集群管理员权限。文章作者 Ethan Mollick 认为,这起事件显示 AI 代理已具备跨时间协调、分工与调整计划的能力,也把一个核心问题摆到台前:AI 该在什么情况下主动向人类寻求批准、专业意见与介入。

Uber Engineering 公布其在企业内部部署 AI Agent 的最新实践:AI 已覆盖软件开发生命周期多个环节,超过 70% 的 Pull Request 可归因于本地或云端 Agent,员工已建立超过 3,600 个 Agent Skills,每天执行超过 3 万次。公司正把工作流从工程师主动调用 AI,转向由 Managed Agents 自动接收事件、处理任务,再交由人类做最终审核与升级处理。

成立仅一年的 Infinity 用 AI 研究 Agent“Ignition”为 d-Matrix 在 10 小时内搭建了一套类 CUDA 软件,切入点集中在推理 Kernel 与底层软件能力,而非完整复制 CUDA 近 20 年积累的生态。文章指出,训练侧对稳定性、集群协同和验证工具链要求极高,CUDA 优势仍深;推理侧因更看重单次回答成本、可跨芯片运行,正成为 Rebellions、Cerebras、AMD、谷歌和亚马逊等玩家争夺的第二战场。多位业内人士也提醒,AI 能加快写代码,但验证、优化和迁移成本仍是核心门槛。

开发者@sairahul1提出7个专业化AI Agent(研究员、故事撰写者、规格撰写者、后端建造者、前端建造者、测试验证者、实现验证员),将单一大模型对话拆解为结构化工作流,实现从“Vibe Coding”到“软件工厂”的升级。文章详细介绍了每个Agent的职责和协作流程。

Wabi完成2000万美元pre-seed融资,主打用自然语言生成AI应用,并加入社交发现与应用改编机制,试图降低软件开发门槛。
