GPT-6 Astra新增无损换挡功能,长对话可灵活调整推理强度

GPT-6 Astra新增无损换挡功能,长对话可灵活调整推理强度

N
News Editor
2026-09-05 11:41:18
OpenAI为GPT-6 Astra新增configuration_update,允许在长对话中随时调整reasoning effort而不丢失缓存。此前切换档位会导致缓存命中率从98.5%骤降至65%,重建后恢复至97%以上。该更新使难题用High或xhigh、简单任务降回Low,长上下文缓存持续复用,大幅提升长时间运行Agent的效率。

OpenAI 为 GPT-6 Astra 新增了配置更新(configuration_update),允许在 Responses API 的同一段长对话中,随时调高或调低 reasoning effort,同时不改写已经缓存的 Prompt 前缀。这意味着,在长对话中,用户可以根据任务难度灵活切换思考强度,而无需重建缓存,从而实现了无损换挡。

此前,这是一个很隐蔽的烧钱坑。reasoning effort 作为上下文开头的指令,一旦中途切换到新的思考档位,会导致大量缓存无法继续复用。有 Codex 用户实测,切换档位后缓存命中率从 98.5% 掉到 65%,下一轮重新建立缓存后才恢复到 97% 以上。这种缓存重建不仅增加了响应时间,也带来了额外的计算成本,尤其在长对话中影响显著。

现在,用户可以在处理难题时临时将 reasoning effort 设为 High 或 xhigh,简单任务再降回 Low,而前面的长上下文依然可以继续复用。对于长时间运行的 Agent 来说,这个改动十分实用,不会因为换挡就让前面几十万 Token 的缓存重新按普通输入处理,从而大幅提升了效率和经济性。这一更新解决了此前开发者面临的一个隐性成本问题,使得长对话中的推理强度调整不再需要牺牲缓存效率。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。