OpenAI 宣布收购 AI 安全平台 Promptfoo,并将其技术整合进企业平台 OpenAI Frontier。这家成立于 2024 年 的公司,主要聚焦大型语言模型(LLM)的漏洞测试与红队演练,目标直指企业��部署 AI Agent 时最难处理的一类风险:被越狱、敏感数据误传,以及工具权限被滥用。
Promptfoo能力将并入Frontier平台
按照 OpenAI 公告,Promptfoo 的安全测试能力会成为 Frontier 的原生功能。企业在 Frontier 上构建代理系统时,可直接使用自动化安全测试和红队演练工具,识别并修复多类风险,包括提示注入、越狱、数据泄露、工具滥用,以及超出既定策略的代理行为。安全不再停留在上线前的单次检查,而是嵌入开发和运行流程中。
OpenAI 同时提到,Frontier 还会把风险识别、调查和修复所需的流程做更深层整合。配套的报告与可追溯能力,也将用于记录测试结果、跟踪系统变化,满足 AI 治理、风险和合规方面不断增加的要求。
AI Agent获得执行权限后,风险从“说错”变成“做错”
这笔收购对应的是 AI 使用场景的变化。AI 正从聊天机器人走向具备执行权限的“AI 同事”。在这种模式下,企业面对的风险已经不只是模型回答失准,而是代理在理解意图时出现偏差,或者被隐藏指令误导,继而触发错误汇款、删除关键文件等不可逆���作。问题更重,也更接近真实业务系统。
若多个 AI 代理协同工作,一个代理的逻辑错误还可能形成连锁反应。素材提到,Agent 时代的安全重点正在从信息封锁转向行为监控,即通过明确权限边界、复核机制和可追踪记录,降低自动化系统失控的概率。
23人团队加入OpenAI,曾获2300万美元融资
Promptfoo 目前的开源工具已被 超过 25% 的《财富》500 强企业采用,拥有 35 万名开发者用户。公司团队规模仅 23 人,此前累计融资 2300 万美元,并在 2025 年 7 月 最近一轮融资后达到 8600 万美元估值。
Promptfoo 联合创始人 Ian Webster 与 Michael D'Angelo 将带领全体团队加入 OpenAI。对 OpenAI 来说,这次收购不是单纯补一项安全工具,而是把针对 AI Agent 的安全测试、审计和问责能力直接塞进企业产品栈里。

