ARTICLE · 1157104
Context Mode:给 AI 编程助手装上「上下文节流阀」,Token 消耗暴降 98%
"
AI 编程助手的上下文危机,正在吞噬你的 Token 预算。
—— Jasper
每天用 Claude Code、Codex 或 Cursor 写代码的你,一定经历过这样的时刻:让 agent 读 50 个文件统计函数数量,context window 瞬间被 700 KB 的原始数据塞满;跑一个 npm test 的 fix 循环,30 分钟后 40% 的上下文已经耗尽;等对话被压缩释放空间时,agent 忘了正在编辑哪个文件、什么任务在进行中、你上次问了什么。
这就是 Context Mode 要解决的核心问题——AI 编程助手的「上下文危机」。

— Context Mode 架构示意图:Coding Agent 通过 Context Mode 连接到模型 API,实现 Save、Protect、Remember 三大功能
Context Mode(mksglu/context-mode)是一个 MCP(Model Context Protocol)服务器,它坐在你的编程 agent 和模型 API 之间,在请求发出前、工具执行前、结果返回时三个关键节点进行干预。上线仅 8 个月,已经狂揽 26,320 颗 GitHub Star,被 Microsoft、Google、Meta、Amazon、NVIDIA、ByteDance、Stripe、Datadog、Salesforce、GitHub、Cursor 等 17 家头部科技公司采用,Hacker News 登顶 #1(570+ 分)。
— Microsoft、Google、Meta、Amazon、NVIDIA、ByteDance、Cursor 等公司都在使用 Context Mode
📌 本文看点
01
四大核心机制拆解
02
实测省钱数据
03
17 平台全支持
MECHANISM
四大核心机制,从根上解决上下文浪费
Context Mode 通过四个互补的机制,系统性地解决了上下文浪费的问题:
1. Context Saving:沙盒化输出,98% 的惊人压缩率
这是 Context Mode 最直观的价值。每个 MCP 工具调用原本会把原始数据全部 dump 进 context window——一个 Playwright 截图 56 KB,20 个 GitHub Issue 59 KB,一条访问日志 45 KB。Context Mode 的做法是把这些原始数据「沙盒化」:315 KB 的原始输出被压缩到 5.4 KB,压缩率达 98%。
关键设计在于:原始数据并没有被丢弃,而是被完整存储在本地 SQLite 数据库中,通过 ID 按需读取。模型只看到精简后的摘要,但需要时可以随时调取完整内容。
2. Session Continuity:对话压缩后不丢记忆
当 agent 压缩对话释放上下文空间时,通常会丢失关键状态——正在编辑的文件、进行中的任务、用户的最后指令。Context Mode 的解决方案是:把每次文件编辑、git 操作、任务、错误和用户决策都追踪记录到 SQLite 中,并用 FTS5(全文搜索)建立索引。
当对话被压缩后,Context Mode 不是把数据 dump 回上下文,而是通过 BM25 搜索只检索当前相关的信息。模型能精确地「捡回」中断前的状态。如果你不使用 --continue,前一次会话的数据会被立即删除——全新的会话意味着干净的起点。
3. Think in Code:让 LLM 做代码生成者,而非数据处理器
这是 Context Mode 最具范式创新的一点。与其让 LLM 读 50 个文件到上下文中来统计函数数量(47 次 Read 调用 = 700 KB),不如让 agent 写一段脚本来做计数,只把 console.log() 的结果返回(1 次 ctx_execute() = 3.6 KB)。
// Before: 47 × Read() = 700 KB. After: 1 × ctx_execute() = 3.6 KB.
ctx_execute("javascript", `
const files = fs.readdirSync('src').filter(f => f.endsWith('.ts'));
files.forEach(f => console.log(f + ': ' + fs.readFileSync('src/'+f,'utf8').split('\\n').length + ' lines'));
`);
一个脚本替代十次工具调用,上下文节省 100 倍。这是 Context Mode 在全部 17 个支持平台上强制推行的范式:停止把 LLM 当作数据处理器,把它当作代码生成器。
4. 不强制简洁文风:路由只管「数据去哪」,不管「模型怎么说」
与一些激进压缩工具不同,Context Mode 不会 dictating 模型如何写最终答案。简洁性、完整性、格式——这是你的模型的决定(或通过你自己的 CLAUDE.md / AGENTS.md 来控制)。研究表明,激进的简洁性提示会降低编码/推理基准表现(Moonshot AI 在 kimi-k2.5 上的实验已证实这一点)。Context Mode 的路由块只关注数据流向,而非模型的说话方式。
BENCHMARK
实测数据:真金白银的成本节省
Context Mode 团队用 Claude Opus 5.5 和 Claude Haiku 4.5 做了系统性基准测试,覆盖了 6 种典型场景:
总计 168 对测试中,155 对成本更低,168 对任务成功率相同——省钱不牺牲质量。
PLATFORM
17 平台全面支持,一键安装
Context Mode 支持 17 个主流 AI 编程平台,按安装复杂度分为两类:
Hook 能力平台(自动路由强制):Claude Code(插件市场一键安装)、Gemini CLI、VS Code Copilot、JetBrains Copilot、Cursor、Kiro、Antigravity CLI/DE、OpenCode、OpenClaw。
非 Hook 平台(一次路由文件复制):Codex CLI、Copilot CLI、Pi Agent、Zed。
以 Claude Code 为例,安装只需两步:
/plugin marketplace add mksglu/context-mode
/plugin install context-mode@context-mode
重启后运行 /context-mode:ctx-doctor 验证,全部检查项显示 [x] 即安装成功。
COMPARISON
与同类方案的对比
Context Mode 的独特定位在于:它是唯一一个同时具备跨平台统一配置、工具输出折叠、调用前检查、跨 Agent 记忆共享,且专为编程 Agent 设计的方案。
LICENSE
开源协议与商业化
Context Mode 采用 Elastic License 2.0(ELv2)开源协议——你可以自由使用、修改、分发,但不能将其作为托管服务提供给第三方。项目由 Mert Koseoglu 创立的 MKSF LTD 运营,提供 Free(1000 次请求/月免费)、Pro、Team、Enterprise 四个层级,所有功能在所有计划中可用,按请求量计费。
EPILOGUE
对开发者的意义
如果你每天使用 AI 编程助手,Context Mode 几乎是必装的基础设施:
省钱:实测 22%-65% 的 API 成本降低,对一个重度用户来说每月可能省下数百美元
省时:98% 的上下文压缩意味着更少的对话压缩、更少的状态丢失、更少的重复操作
安全:Protect 功能可以在工具调用到达 shell 之前拦截危险操作(如 git push origin main、cat .env、terraform destroy)
跨平台:一套配置在所有机器和所有 Agent 上生效,团队可以统一管理策略
GitHub Trending 上的 26,320 颗星不是偶然的——它解决的是一个每一个 AI 编程用户每天都在经历的痛点。当你的 Claude Code 或 Codex 再次因为上下文爆满而「失忆」时,也许该给它们装上这个节流阀了。
👉 GitHub:https://github.com/mksglu/context-mode
我是 Jasper,专注人工智能前沿动态的垂直资讯,每日更新全球AI行业快讯、技术深度解读、商业化落地思考与行业观点评论。
如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见。