OpenAI 为 GPT-6 Astra 新增了配置更新(configuration_update),允许在 Responses API 的同一段长对话中,随时调高或调低 reasoning effort,同时不改写已经缓存的 Prompt 前缀。这意味着,在长对话中,用户可以根据任务难度灵活切换思考强度,而无需重建缓存,从而实现了无损换挡。
此前,这是一个很隐蔽的烧钱坑。reasoning effort 作为上下文开头的指令,一旦中途切换到新的思考档位,会导致大量缓存无法继续复用。有 Codex 用户实测,切换档位后缓存命中率从 98.5% 掉到 65%,下一轮重新建立缓存后才恢复到 97% 以上。这种缓存重建不仅增加了响应时间,也带来了额外的计算成本,尤其在长对话中影响显著。
现在,用户可以在处理难题时临时将 reasoning effort 设为 High 或 xhigh,简单任务再降回 Low,而前面的长上下文依然可以继续复用。对于长时间运行的 Agent 来说,这个改动十分实用,不会因为换挡就让前面几十万 Token 的缓存重新按普通输入处理,从而大幅提升了效率和经济性。这一更新解决了此前开发者面临的一个隐性成本问题,使得长对话中的推理强度调整不再需要牺牲缓存效率。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

