让AI编程少说废话:LeanCTX用上下文压缩省60-90% token

每次让 AI 帮你写代码,是不是发现对话越往后就越慢、越贵?上下文窗口塞满了重复的文件内容、冗长的 shell 输出,模型在里面翻半天找不到重点。

这个问题不是靠换更强模型能解决的——得从「上下文」这一层动刀。LeanCTX 就是做这件事的。

它是什么

LeanCTX 是一个本地运行的上下文工程层,说人话就是:帮你的 AI 编程工具「少说话、多办事」。它用 Rust 写成,核心能力有四块:

  • 压缩(Compression):文件读取有 10 种模式,从全文到仅签名到按密度抽稀,重复读取同一文件只花 ~13 token;shell 输出(git/npm/cargo 等)有 270 条内置压缩规则,原始 ~800 token 的 git status 压缩后 ~120 token。
  • 路由(Routing):不同文件不需要同样的精度。LeanCTX 会学习每个文件类型的最佳读取策略,简单的查词请求不会触发全文加载。
  • 记忆(Memory):上下文不再在每次对话重置。跨聊天记住任务、决策、事实,支持导入导出为 .ctxpkg 包,在机器和模型之间迁移。
  • 验证(Verification):实时 Dashboard 追踪 token 消耗和节省金额,有 CI 级别的上下文漂移检测。

节省多少

官方 benchmark 数据很直接:

  • 重复文件读取:~2000 token → ~13 token
  • git status 输出:~800 token → ~120 token
  • 整体 token 减少:60–90%

对于重度使用 Claude Code 或 Cursor 的开发者来说,这意味着每个会话的有效上下文窗口变大、API 费用下降、以及——最重要的一点——模型终于能把注意力放在「解决问题」而不是「在噪音里找文件」上了。

支持哪些工具

目前官方支持:Cursor、Claude Code、Copilot、Windsurf、Codex、Gemini,以及 30+ 其他 AI 编程工具。安装方式是lean-ctx wrap cursor(或其他 IDE 名称),一行命令完成 MCP 服务注册和 Shell Hook 配置,不需要改任何配置。

也提供 SDK:Python(lean-ctx-sdk)、Node.js、Go、Rust,可以接入自己的 AI 应用做 token 压缩。

适合谁

如果你每天花超过 2 小时在 AI 辅助编程上、或者你是独立开发者/小团队对 API 成本敏感,LeanCTX 值得一试。本地运行、不上传代码、数据完全自己掌控这点对很多人来说也是加分项。

它最近更新很频繁(昨天还有提交),3.5k GitHub Stars,生态还在快速扩张。

→ GitHub 仓库在这里


GitHub: https://github.com/yvgude/lean-ctx

评论区

0 条评论

登录后可评论。

沈星河 12 阅读