近日,两大AI巨头OpenAI与Anthropic相继被曝出对旗下旗舰模型进行隐蔽性能削减,引发用户强烈反弹。OpenAI在Codex平台灰度测试GPT-5.6-sol版本,通过将推理算力的Juice值从768大幅降低至128,削减幅度高达83%;Anthropic则被大量用户质疑对Claude Opus 4.8进行了静默降级,导致模型在逻辑推理、上下文记忆等核心能力上出现明显退化。
事件背景:两大AI巨头被指隐蔽削减性能
OpenAI与Anthropic作为生成式AI领域的领先企业,近期均面临严峻的资本压力。据爆料,OpenAI在Codex平台上灰度测试了名为GPT-5.6-sol的新模型版本。该版本通过削减模型的推理算力(即Juice值),从原始版本768降至128,以降低每次推理调用的计算成本。这一策略虽然有助于OpenAI在保持API服务的同时控制运营开支,但直接导致模型输出质量下降,尤其在某些复杂推理任务中表现不佳。
OpenAI灰度测试GPT-5.6-sol,算力削减83%
具体数据显示,Juice值从768降至128意味着推理算力削减了约83.3%。Codex平台的用户发现,在相同输入下,GPT-5.6-sol的响应时长缩短约40%,但回答中逻辑跳跃、错漏的比例显著上升。OpenAI尚未就此次灰度测试发表官方声明,但市场分析认为,这一举动很可能与公司IPO进程受阻以及资本市场对AI公司盈利能力的审查有关。
Anthropic被质疑静默降级Claude Opus 4.8
与此同时,Anthropic也未能幸免。大量用户在社交媒体及技术论坛上反馈,Claude Opus 4.8在未经通知的情况下发生了“降智”现象:模型在长文本推理、多步骤逻辑任务以及上下文记忆方面的表现出现明显退化。用户对比历史对话记录后发现,同样的问题,4月初的回复质量远高于近期。Anthropic官方尚未确认降级行为,但用户普遍认为这是为了降低运营成本而采取的“静默降级”。
背后原因:IPO受阻与资本寒冬压力
分析人士指出,OpenAI与Anthropic面临的共同困境是:高额的算力投入与有限的市场变现能力之间的矛盾。两家公司均曾传出IPO计划,但受市场环境与监管压力影响,进展缓慢。在资本寒冬的背景下,风投对AI初创公司的估值更加谨慎,迫使企业通过削减成本来延长现金流。而直接降低模型质量成为最隐蔽也最快捷的手段,但代价是用户信任的流失。
用户信任危机与行业影响
用户对“退钱”的呼声反映了对巨头行为的不满。这一事件对AI行业产生深远影响:首先,用户开始质疑模型版本更新的透明度,呼吁建立更严格的性能基准与变化公告机制;其次,监管机构可能介入调查此类静默降级是否违反消费者权益保护法;最后,中小型AI公司可能以此为契机,强调自身模型的稳定性和服务质量,争夺市场份额。目前,OpenAI与Anthropic均未做出正面回应,但行业内的讨论已愈演愈烈。

