事件概况:算力腰斩与静默降级
据MarsBit报道,OpenAI被曝在Codex平台灰度测试一个名为GPT-5.6-sol的新版本,该版本通过大幅削减推理阶段所需的算力——即所谓的“Juice值”——从标准版GPT-5.6的768降至128,降幅超过83%。这一操作相当于将模型在复杂逻辑推理、长上下文依赖任务中的有效算力“腰斩”再“腰斩”。与此同时,Anthropic的旗舰模型Claude Opus 4.8也被大量用户通过网络测试指出存在静默降级现象:在未发布任何官方公告的情况下,模型在数学推理、代码编写、上下文记忆等核心能力上出现显著退化。用户将前后测试结果对比后发现,新答案的错误率明显提高,甚至出现上下文断裂、遗忘前文指令等严重问题。
背后动因:IPO受阻与资本寒冬下的成本压力
市场分析认为,两家公司几乎同时采取隐蔽性性能削减策略,并非巧合。OpenAI目前正在推进IPO进程,但投资者对其高昂的运营成本(尤其是算力支出)持续施压。Anthropic同样面临资本寒冬中的融资困难,此前多轮融资规模远低于预期。在AI模型训练和推理成本居高不下的背景下,压缩推理阶段的算力消耗成为最直接的成本控制手段——GPT-5.6-sol版本可使单次推理成本降低约80%以上。然而,这种“降本不告知”的做法严重损害了用户信任——尤其是那些为高级订阅(如ChatGPT Plus、Claude Pro)付费的用户,他们发现自己得到的是性能缩水的服务。
行业影响:AI服务的透明度与伦理争议
此次事件暴露了AI行业一个潜在的问题:当模型面临商业化压力时,企业可能在不公开声明的情况下悄然调整模型性能,这种行为类似于传统软件领域的“功能缩减但未通知”。加密和科技社区对此反应强烈,不少开发者表示将重新评估对OpenAI和Anthropic API的依赖,转向如Meta的Llama、Mistral等开源模型。此外,部分用户已经开始在社交媒体上发起“退钱”抗议,要求两家公司披露版本变更细节并提供性能保障。长期来看,若大模型服务商持续采取此类暗箱操作,可能导致整个AI信任体系的动摇,并促使监管机构介入要求算法透明度。

