返回上下文管理

上下文管理

Anthropic
2026-08-16 00:05:10

Anthropic详解Claude Code省钱方法:别让上下文白烧Token

Anthropic发布博客,集中说明Claude Code的成本结构与控制办法,给出6条降低 token 开销的具体建议,包括及时 /clear、固定模型与推理强度、使用 @ 引用文件、为高输出命令加静默参数、在缓存有效期内执行 /compact,以及把大输出任务交给子 Agent。博客还解释了输入与输出 token 的计价差异、提示缓存的工作方式与失效场景,并列出 Opus 5、Sonnet 5、Haiku 4.5 的定价。

140
Anthropic详解Claude Code省钱方法:别让上下文白烧Token
OpenAI
2026-08-09 03:17:07

OpenAI高管称Codex类Harness两三个月内将显得原始

OpenAI 产品兼平台总经理 Thibault Sottiaux 表示,再过 2 至 3 个月,Codex 这类 Harness 就会显得原始。他指出,当前在本地笔记本上运行 Agent 的方式正遭遇算力、内存、长时任务和并发管理等限制。文章提到,Codex 已提供云端异步运行支持,E2B、Daytona、Fly.io、Modal 等云端微沙箱基础设施也在兴起,AI 团队的研发重点正从优化 Prompt 转向编写系统级 Harness。

650
OpenAI高管称Codex类Harness两三个月内将显得原始
AI Agent
2026-07-19 04:36:19

3,000 场评测显示:Fable 5 在 Fusion 架构下比 Opus 4.8 更省钱

BlockTempo 援引 Joon Lee 在 X 的文章称,Devin 团队在 FrontierCode 1.1 上进行了 3,000 场评测,对比 Fable 5 与 Opus 4.8 在有无副手模型时的成本与得分。结果显示,尽管 Fable 5 的单 token 成本约为 Opus 4.8 的两倍,但在 Fusion 委派架构下,Fable + 副手的平均成本为 1.86 美元,低于 Opus + 副手的 2.04 美元,且得分更高。文章将差异归因于委派时机、上下文管理和主导模型是否亲自下场写代码。

710
3,000 场评测显示:Fable 5 在 Fusion 架构下比 Opus 4.8 更省钱
Variant
2026-07-16 06:33:00

Variant发布十项AI投资假设,押注Agent与编排层

Variant在完成 2.22 亿美元第四期基金募集后,披露了围绕“自主性”的 10 条 AI 投资假设,内容涵盖 AI Agent、算力、开源、多模型系统、编排层和多人协作等方向。该机构称,这份清单是其在 2026 年 Q3 初发布的“公开记分卡”,用于检验对技术演进、产品形态和价值归属的判断。

700
Variant发布十项AI投资假设,押注Agent与编排层