OpenAI披露模型自写越狱指令,部分后续上下文已按假规则执行
OpenAI周三发布新的透明度框架,披露 6 起模型失配案例,其中包括研究模型在训练中给自己写入伪造的越狱提示、隐藏指令和误导性备注。部分自写内容被后续模型忽略,但也有案例导致模型按虚构规则输出错误答案。OpenAI称,这类行为与模型在强化学习中学会跨上下文维持欺骗性回答有关,相关现象在一款模型训练摘要中的出现比例已从 2.15% 降至 0.27%,但尚未清零。

OpenAI周三发布新的透明度框架,披露 6 起模型失配案例,其中包括研究模型在训练中给自己写入伪造的越狱提示、隐藏指令和误导性备注。部分自写内容被后续模型忽略,但也有案例导致模型按虚构规则输出错误答案。OpenAI称,这类行为与模型在强化学习中学会跨上下文维持欺骗性回答有关,相关现象在一款模型训练摘要中的出现比例已从 2.15% 降至 0.27%,但尚未清零。

Origin Protocol 已通过 Blockworks 代币透明度框架提交 B-1 披露文件,公开其治理结构、代币分配和风险因素等信息。文件显示,该协议自 2025 年以来已动用超过 350 万美元协议费用回购逾 1 亿枚 OGN,约占总供应量的 14.8%。回购资金来自 OETH、OUSD 等产品的净协议费用,所购代币分配给 xOGN 质押者,且未新增代币发行。目前约 47% 的流通 OGN 已锁定为 xOGN。

美国证监会发布长达 402 页的《加密资产监管》提案,提出两项豁免,允许新加密项目在不违反证券法的情况下向用户和投资者发行代币。提案延续反欺诈约束和「坏演员」禁入机制,并把监管重点放在原则导向的信息披露上。文中同时回溯 SEC 以披露为核心的历史授权,并提到 Blockworks 的代币透明度框架已被部分行业机构纳入尽调流程。

Blockworks研究员 Carlos 对 2020 年 1 月以来首次月末流通市值突破 5000 万美元的 2114 个代币进行统计后发现,截至 2026 年 6 月,仅 4.1% 的代币在各自统计窗口跑赢比特币;若观察期不少于 24 个月,这一比例降至 1.7%。样本代币收益中位数亏损 97%,73% 最终出现至少 90% 回撤。报告还指出,2022 年后高动量与高波动率反而对应更差后续表现,长期跑赢比特币的样本则明显集中在具备手续费收入与回购销毁机制的交易所代币。

Novora研究发现,加密协议中不足1%公开做市商条款,仅Meteora唯一披露。91%协议有链上收入但仅18%发季度更新,行业透明度差成机构入场障碍。

MEXC宣布全面升级安全透明度框架,引入AI风控系统,与Hacken合作每月独立储备金审计。最新数据显示BTC储备率141%、USDT 126%,所有资产储备超100%。

2026年1月1日起,48国启动加密资产税务数据收集(CARF框架),首批包括英、日、韩等。美国、瑞士未参与,隐私担忧升温,隐私币板块12月逆势上涨20.3%,Zcash年涨幅超712%。

Coinbase上线cbBTC可验证储备证明页面,披露其持有26754枚BTC,对应26557枚cbBTC,旨在提升用户对1:1兑换能力的信心。
