Context Mode Skill:让 AI 编码 Agent 上下文窗口直降 98% 的沙箱工具
Context Mode 是一个专为 AI 编码 Agent 打造的上下文窗口优化工具,直击 MCP 工具调用带来的「上下文爆炸」痛点。AI 每执行一次工具调用,原始输出(日志、代码快照、网络响应)就直接灌入上下文窗口——Playwright 快照 56 KB、20 条 GitHub Issues 59 KB、一次访问日志 45 KB。30 分钟后,40% 的上下文空间被工具输出蚕食,Agent 压缩对话时还会丢失正在编辑的文件、进行中的任务和用户的最后指令。Context Mode 的解决思路是:在工具输出进入上下文窗口之前,将其截获并替换为精简摘要,工具原始数据存入本地 SQLite,而非流入 token 预算。315 KB 的 Playwright 输出变成 5.4 KB,上下文占用直降 98%。
功能与设计原则
Context Mode 通过 MCP 协议在工具输出与上下文窗口之间建立隔离层,将原始数据沙箱化,仅将结构化摘要注入 Agent 上下文。其核心能力体现在四个维度:Context Saving——沙箱工具拦截原始数据,98% 上下文缩减;Session Continuity——所有文件编辑、Git 操作、任务状态、错误记录存入 SQLite,对话压缩后通过 FTS5 + BM25 检索精确恢复;Think in Code——强制 Agent 通过写脚本执行来分析代码,而非将文件逐个读入上下文;No Prose Enforcement——不限制 Agent 的输出风格,只控制数据流向,保护模型的原始推理能力。
认可度
GitHub Star 数约 24.4k(截至 2026-10-03),累计 +88 今日新增,GitHub Hot 榜持续在列,已蝉联 trending 26 天。GitHub Trending 单日 +357 星(2026-10-01),GenAI Secret Sauce 将其列为 #7 高价值项目。NPM 包 context-mode 发布 12 个 release 版本,覆盖 Claude Code 插件市场、Glama MCP Toplist(#39/116,465)以及 PulseMCP 两大注册表。
链接
GitHub:https://github.com/mksglu/context-mode
NPM:https://www.npmjs.com/package/context-mode
官网:https://context-mode.com
原作者
mksglu(GitHub @mksglu),专注于 AI 开发者工具的独立开发者。维护单一项目 context-mode,持续活跃(2026-10-03 仍有提交),社区生态覆盖 Claude Code 插件、OpenClaw Gateway 集成、Cursor 插件等多个平台。
介绍
AI 编码 Agent 在处理复杂任务时,每次 MCP 工具调用都会将原始输出直接注入上下文窗口。Playwright 快照 56 KB、GitHub Issues 列表 59 KB、访问日志 45 KB——这些噪音数据在 30 分钟后会占据上下文的 40%,而 Agent 执行对话压缩(compact)操作时,会将所有历史操作记录丢弃,导致丢失文件编辑进度、进行中的任务和用户指令。
Context Mode 在工具输出与上下文之间构建沙箱层:原始数据存入本地 SQLite,仅将压缩后的结构化摘要注入上下文。例如,315 KB 的 Playwright 输出被压缩至 5.4 KB,Token 消耗减少 98%。同时,所有文件编辑、Git 操作、错误记录都被持久化存储在 SQLite 中,对话压缩后不丢失——Agent 通过 FTS5 检索只取回与当前任务最相关的记录,精确恢复工作状态,而非将整个历史重新灌入上下文。
「Think in Code」是第三个核心设计原则:与其让 Agent 读取 50 个文件来统计函数数量(消耗大量上下文),不如让 Agent 写一段脚本执行统计并只返回结果——一次脚本执行替换十次工具调用,节省 100 倍上下文。第四个原则「No Prose Enforcement」确保该工具只控制数据流向,不强制 Agent 输出风格,保护模型的原始推理能力。
特点
- 98% 上下文缩减:沙箱工具拦截原始输出,315 KB → 5.4 KB,Token 消耗大幅降低
- 跨平台支持:覆盖 Claude Code、Cursor、Windsurf、Copilot、Cline、Codex CLI、Kiro、Gemini CLI、Zed、OpenClaw 等 17 个平台
- 会话连续性:SQLite + FTS5 持久化存储,压缩后精确恢复,不丢失任何编辑状态
- 「Think in Code」范式:强制脚本执行替代批量读取,减少工具调用次数
- 零配置启动:Claude Code 插件市场一键安装,自动注册全部 Hook(PreToolUse、PostToolUse、PreCompact、SessionStart 等)
- 6 个沙箱工具:ctx_batch_execute、ctx_execute、ctx_execute_file、ctx_index、ctx_search、ctx_fetch_and_index
- 5 个运维工具:ctx_stats(Token 节省统计)、ctx_doctor(诊断)、ctx_upgrade(升级)、ctx_purge(清除)、ctx_insight(托管分析面板)
- OpenClaw Gateway 集成:官方支持 OpenClaw 生态,可在 AI 助手工作流中无缝接入
使用方法
Claude Code(推荐方式)
Claude Code v1.0.33+ 用户通过插件市场安装,全程自动路由配置:
# 安装
/plugin marketplace add mksglu/context-mode
/plugin install context-mode@context-mode
# 重启 Claude Code(或 /reload-plugins)
# 验证
/context-mode:ctx-doctor
全部检查显示 [x] 即为成功。插件自动注册 PreToolUse、PostToolUse、PreCompact、SessionStart、Stop 等全部 Hook,6 个沙箱工具 + 5 个元工具立即可用。
备选:MCP-only 模式(无 Hook)
claude mcp add context-mode -- npx -y context-mode
返回 11 个 MCP 工具,但不触发自动路由,Agent 需手动选择使用沙箱工具。
Gemini CLI
npm install -g context-mode
# 然后编辑 ~/.gemini/settings.json 注册 MCP Server 和 Hook(详见 GitHub README)
状态栏(可选)
编辑 ~/.claude/settings.json 添加状态行,可实时显示本会话节省的 Token 数量:
{
"statusLine": {
"type": "command",
"command": "context-mode statusline"
}
}
使用场景与人群
目标用户:
– 长时间运行复杂编码任务的 AI 开发者(大型重构、多文件并行修改、跨模块调试)
– 上下文窗口受限的用户(4o 系列、Claude 3.5 Sonnet 等较小上下文模型)
– 关注 AI 辅助工程效率与 Token 成本控制的团队
– 使用 OpenClaw 或 Gemini CLI 作为主要编码助手的工程师
典型场景:
– 大型代码库分析(>50 文件批量读取)
– 长时间多轮对话中的上下文管理
– 需要在压缩后仍能恢复完整工作状态的复杂任务
– 团队级别的 AI 辅助工程 ROI 分析(通过 ctx_insight 面板)
输入与输出案例
案例 1:Playwright 快照压缩
- 输入:Agent 执行
playwright.snapshot()获取页面结构,原始输出 56 KB(含大量 HTML 标签、CSS 样式、空白字符) - 输出:经过 ctx_sandbox 拦截,仅 0.5 KB 的结构化摘要注入上下文,包含页面节点数量、关键元素位置、可交互组件列表
案例 2:长对话压缩后状态恢复
- 输入:用户离开 2 小时后返回,Agent 执行
/compact压缩历史;此前 Agent 正在修改 6 个文件、3 个 Git 操作悬而未决 - 输出:压缩后,ctx_mode 从 SQLite 中通过 BM25 检索取回相关记录,Agent 输出:
// Resuming: 正在编辑 src/auth.ts,第 47 行;Git stash@{0} 包含 3 个未提交变更;任务:在 src/api/ 下新增 2 个 endpoint。Agent 无需重新读取任何文件,精确恢复工作状态。
Context Mode 不是一个传统意义上的「Prompt 模板 Skill」,而是一款架构级的上下文管理工具。它的核心价值在于重新定义 AI 与数据的交互方式——让模型专注于推理和决策,而非充当数据搬运工。随着 GitHub Trending 持续在列、OpenClaw 官方集成、以及 17 平台覆盖,context-mode 正在成为 AI 编码工作流的基础设施级 Skill。
评论区
登录后可评论。