返回长对话

长对话

GPT-6 Astra
2026-09-05 11:41:18

GPT-6 Astra新增无损换挡功能,长对话可灵活调整推理强度

OpenAI为GPT-6 Astra新增configuration_update,允许在长对话中随时调整reasoning effort而不丢失缓存。此前切换档位会导致缓存命中率从98.5%骤降至65%,重建后恢复至97%以上。该更新使难题用High或xhigh、简单任务降回Low,长上下文缓存持续复用,大幅提升长时间运行Agent的效率。

20
GPT-6 Astra新增无损换挡功能,长对话可灵活调整推理强度
Meta
2026-09-03 13:23:19

Meta发布 Muse Spark 1.3,跑分与低价同时冲击谷歌 Gemini

Meta 发布新模型 Muse Spark 1.3 后,围绕前沿模型的性能与价格竞争迅速升温。文中披露,该模型在 DeepSWE v1.1、MRCR 512K-1M、Artificial Analysis 等指标上取得高分,并维持每百万 token 输入 1.25 美元、输出 4.25 美元的定价。与此同时,BridgeMind 等声音也对行业「刷榜」现象提出质疑,认为基准分数大涨并不等于真实体验同步提升。

140
Meta发布 Muse Spark 1.3,跑分与低价同时冲击谷歌 Gemini
Codex
2026-09-01 12:49:14

Codex新增_context工具,酝酿长任务“外部记忆”机制

Codex在代码库中新增了_context工具,并配合工作注释与历史查询能力,显示Codex CLI可能正在测试新的长任务记忆方案。按现有线索,系统在上下文窗口接近上限时将切换到新窗口,同时保留完整历史记录供查询。OpenAI官方文档截至发稿仍将compaction列为长任务上下文管理机制,文中判断这更像是准备转向或测试阶段,而非已全面上线。

100
Codex新增_context工具,酝酿长任务“外部记忆”机制
小米
2026-07-23 23:05:15

小米发布MiMo V2.5多模态AI,性能匹敌GPT-5.4,成本降42%

小米推出MiMo V2.5系列多模态AI模型,整合文本/图像/音频/视频处理。Pro版SWE-bench解决率57.2%,匹配Claude Opus 4.6和GPT-5.4,token消耗比Kimi K2.6低42%。基础版速度更快价格更低,均支持1M上下文窗口。

300
小米发布MiMo V2.5多模态AI,性能匹敌GPT-5.4,成本降42%