草案:每轮重新判断上下文留什么、丢什么

TypeSafe 创始人 Diogo Almeida 公开了一份 Coding Agent 设计草案,希望社区直接拿去实验,还说团队大概率没时间做完。 草案最核心的改动在上下文:现在的 Coding Agent 通常一直带着聊天、工具结果和代码状态,太长就压缩或重启;TypeSafe 想让 Agent 每轮重新判断——哪些保留全文、哪些只留摘要、哪些直接丢掉,而且不放弃已有 KV Cache,会比较"继续复用"和"重新构造"哪个更划算。 Almeida 认为很多别扭设计是被 KV Cache 反绑出来的:先把任务切给便宜模型、再切回强模型,强模型可能要重新处理一遍长上下文,路由反而更贵;工具定义长期塞在系统提示词里也一直占空间。 上下文能动态重组之后,模型路由、Sub-agent、MCP 和 AGENTS.md 就能按需加载:简单任务给便宜模型,需要哪个工具再加载哪个,子 Agent 只拿跟自己相关的状态。他们暂时叫它「Meta-attention」。 边界:这是草案不是实现,作者自己都说希望社区去试、也接受被打脸;"每轮重判上下文"听着优雅,代价是每轮多一次判断调用,判断错了就是上下文抖动,稳定性只能实测。
话题来源 @0xLogicrw 66.4K阅读 ❤️307 x.com/…↗ 已改写,非原文转载
17 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单