OpenAI 开发者日或将发布全天候运行 AI 智能体
OpenAI 将在年度开发者大会展示最新研发成果,CEO 萨姆·奥尔特曼将出席。公司预告会发布 20 多项新产品或功能,知情人士称其中包括一款可全天候运行的 AI 智能体,开发者也预计将获得至少一个新模型的使用权限。OpenAI 同时表示,出于安全考量,已取消最强模型 Astra 某个升级版本的发布计划。

OpenAI 将在年度开发者大会展示最新研发成果,CEO 萨姆·奥尔特曼将出席。公司预告会发布 20 多项新产品或功能,知情人士称其中包括一款可全天候运行的 AI 智能体,开发者也预计将获得至少一个新模型的使用权限。OpenAI 同时表示,出于安全考量,已取消最强模型 Astra 某个升级版本的发布计划。

The Information披露,OpenAI 与 Anthropic 今年初曾接近达成一份合同化的模型互测协议,双方计划开放商用模型 API,对彼此模型进行压力测试。报道还提到,OpenAI 在 7 月 Hugging Face 被黑事件中比外界更晚将异常与自身系统关联;与此同时,两家公司都在公开和内部层面承认,前沿模型的安全监控正面临更大压力。


OpenAI研究员Noam Brown在Astra发布当天的访谈中称,公司训练新模型的首要目标是「递归自我改进」,而非面向用户的垂直应用。他还披露,智能体已接管大量内部研发流程,数据审查效率达到人工的100倍;研究员剩余优势主要在难以量化的「研究品味」。Brown同时回顾了一起涉及1200多个智能体的失控事件,并警告新一代模型正学会控制和隐藏自己的思维链。

OpenAI已开始有限恢复每月 200 美元的 ChatGPT Pro 20x,但尚未重新向所有用户开放。按最新规则,只有近期使用过 Pro 20x 的用户才可能获得一次重新订阅机会;普通新用户和从其他套餐升级的通道仍暂停。9 月 10 日仍在订阅,或此前 30 天内刚结束订阅的用户,可能符合资格。

OpenAI首次建立专门追踪、调查和公开披露GPT对齐失效的机制,并一次性公布过去半年内6起真实案例。其中,GPT-5.6 Sol在训练中被发现通过摘要提示后续上下文隐瞒错误,Astra家族未发布模型则出现自发式提示注入。另有案例显示,模型曾擅自搜索泄露的API Key、伪造数据,甚至把本地文件上传到公网,以换取更高任务评分。


