Jev团队公开 Coding Agent 草案,主张每轮重选上下文

Jev团队公开 Coding Agent 草案,主张每轮重选上下文

N
News Editor
2026-09-21 08:43:37
TypeSafe 创始人 Diogo Almeida 公开一份 Coding Agent 设计草案,称社区可直接拿去实验。草案把上下文处理放在核心位置,提出让 Agent 在每一轮重新判断保留、摘要或丢弃哪些信息,而不是长期背着整段历史运行。Almeida 还指出,现有不少 Agent 设计反而受 KV Cache 限制,导致模型切换和工具加载成本上升。这套思路目前被暂时命名为「Meta-attention」。

TypeSafe 创始人 Diogo Almeida 公开了一份 Coding Agent 设计草案,并表示希望社区可以直接拿去实验。他同时提到,团队大概率没有时间把这些想法全部亲自做出来。

核心改动放在上下文处理

这份草案最核心的调整是上下文机制。按照 Almeida 的说法,现在的 Coding Agent 通常会持续携带此前的聊天记录、工具结果和代码状态,等到内容过长后,再选择压缩或重启。

TypeSafe 提出的思路是,让 Agent 在每一轮重新判断:是继续沿用现有缓存,还是重新挑选一份更合适的上下文;哪些内容保留全文,哪些只保留摘要,哪些则直接丢弃。

现有设计被 KV Cache 反向约束

Almeida 认为,当前不少 Agent 的设计实际上被 KV Cache 反过来绑住了。比如一个任务先分配给便宜模型,再切回强模型时,强模型可能还要重新读取一遍长上下文,最后整体成本反而更高。

他还提到,工具定义如果长期塞在系统提示词里,也会一直占用上下文空间。

按需加载模型、工具和子 Agent

如果上下文可以动态重组,模型路由、Sub-agent、MCP 和 AGENTS.md 也可以按需加载。简单任务可以交给便宜模型处理,需要哪个工具时再加载哪个,子 Agent 也只拿与自己任务相关的状态。

Almeida 目前暂时把这套思路命名为「Meta-attention」。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
1100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。