TypeSafe 创始人 Diogo Almeida 公开了一份 Coding Agent 设计草案,并表示希望社区可以直接拿去实验。他同时提到,团队大概率没有时间把这些想法全部亲自做出来。
核心改动放在上下文处理
这份草案最核心的调整是上下文机制。按照 Almeida 的说法,现在的 Coding Agent 通常会持续携带此前的聊天记录、工具结果和代码状态,等到内容过长后,再选择压缩或重启。
TypeSafe 提出的思路是,让 Agent 在每一轮重新判断:是继续沿用现有缓存,还是重新挑选一份更合适的上下文;哪些内容保留全文,哪些只保留摘要,哪些则直接丢弃。
现有设计被 KV Cache 反向约束
Almeida 认为,当前不少 Agent 的设计实际上被 KV Cache 反过来绑住了。比如一个任务先分配给便宜模型,再切回强模型时,强模型可能还要重新读取一遍长上下文,最后整体成本反而更高。
他还提到,工具定义如果长期塞在系统提示词里,也会一直占用上下文空间。
按需加载模型、工具和子 Agent
如果上下文可以动态重组,模型路由、Sub-agent、MCP 和 AGENTS.md 也可以按需加载。简单任务可以交给便宜模型处理,需要哪个工具时再加载哪个,子 Agent 也只拿与自己任务相关的状态。
Almeida 目前暂时把这套思路命名为「Meta-attention」。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

