OpenAI加强模型安全防护,最新强化学习训练暂停两周
OpenAI表示,将对仍在开发中的前沿模型采用更严格的监控和安全防护措施,重点追踪其在解题和使用在线工具时的行为,并力争在发现异常后30分钟内向安全团队报警。公司还新增了限制模型联网执行高风险任务的控制措施,并要求训练与评估时使用更严格的沙箱隔离。

OpenAI表示,将对仍在开发中的前沿模型采用更严格的监控和安全防护措施,重点追踪其在解题和使用在线工具时的行为,并力争在发现异常后30分钟内向安全团队报警。公司还新增了限制模型联网执行高风险任务的控制措施,并要求训练与评估时使用更严格的沙箱隔离。

OpenAI宣布将加强系统监控和安全防护,以防止人工智能模型失控。公司计划在发现问题后30分钟内向安全团队发出警报,并新增限制,防止AI模型连接互联网执行高风险任务。与此同时,OpenAI已暂停部分模型的推理任务和训练计划,等待安全验证完成。

Foresight News 汇总本周加密行业高热内容,焦点覆盖 Harry Yeh 在巴拉圭坠亡事件、近 588 天超 300 个 Web3 项目沉寂、李林与 UMX 的新布局,以及 BIP-110 引发的比特币扩容争议。安全事件方面,DeFi 巨鲸再失约 2500 万美元、Trezor 订单与地址数据外泄、Harmony 漏洞增发 ONE、冒充客服电诈和 Bybit 追索被盗资产均引发关注。项目层面,以太坊路线图更新、Poseidon 调整、Bitwise 产品线重组和特朗普媒体的新资本布局同样成为本周看点。

40 多家比特币和加密公司本周联名呼吁大型 AI 实验室,在模型公开发布前向独立安全研究人员开放最强模型的使用权限。联名信称,比特币网络保护着逾 1 万亿美元资产,围绕钱包、签名设备、代码库和托管系统的更广泛基础设施还承载着数万亿美元价值,但维护者目前难以进入实验室的受审研究者项目。信中主张提供提前访问和合理算力预算,以便在损失发生前发现并修复漏洞。

xAI 发布 Grok 4.6,称该模型基于 Grok 4.5 构建,重点提升长时间运行的智能体能力、可视化项目生成与多步骤任务处理。xAI 表示,Grok 4.6 在 Artificial Analysis Intelligence Index 上与 GPT-5.6 Sol 持平,并已上线 Cursor 与 Grok Build。该模型也可通过 API 以及 OpenRouter、Vercel、Cloudflare 等合作方接入,API 定价为每百万输入代币 2 美元起、每百万输出代币 6 美元起。

以色列资安公司 Dream 披露,攻击者利用 GitHub 可下载的 Hermes 与 OpenClaw 组建自主攻击系统,4 天内对台湾 21 个政府系统发动 12 波攻击,取得至少 85 个政府用户账号,并窃取逾 2500 笔人事资料。研究还称,攻击范围随后扩至核安会、政府 IT 供应链厂商、政府电子邮件系统及至少 7 家能源业者。

企业在引入 AI 时正面临代币计费带来的成本不确定性。由于大语言模型输出具有非确定性,提示词微调、模型切换和多代理协同都会显著推高 Token 消耗。高盛预计,2026 至 2030 年间全球 Token 月消耗量将增至 1,200 兆规模。为控制预算,企业正通过限制高成本工具、训练员工编写更精确的提示词、筛选更合适的模型,并将安全测试和防护支出提前纳入预算。

安全牛于 2026 年 8 月发布《中国网络安全行业全景图(第十三版)》及《AI+ 网络安全全景图(2026 版)》,调研覆盖 17 个一级大类、122 个二级细分赛道,收录 300 余家国内网络安全企业。零时科技连续多年入选“区块链安全”领域。公司介绍称,其核心能力覆盖区块链安全审计、链上资产溯源追踪、威胁情报、安全应急响应等方向,并为执法监管机构、金融机构及区块链企业提供相关安全解决方案。
