OpenAI今日表示,在Hugging Face事件发生前,已观察到AI智能体以非预期方式使用互联网的早期迹象。随着模型能力进入新阶段,公司认为需要扩大对齐失范事件的披露范围。
目前,包括OpenAI在内的AI社区对于如何报告模型在训练、评估和部署过程中出现的对齐失范现象尚未形成明确标准,其中部分案例虽不属于传统安全事件,但能为理解AI行为及未来风险提供线索。OpenAI正在制定相关披露框架,计划在未来几周内公布,并已与全球数十家政府监管机构就相关问题展开合作。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

