Context Mode:给AI编程助手省下98%的上下文(MCP插件)
聊到一半AI就"失忆",忘了刚改过哪个文件?Context Mode 在 MCP 协议层把工具输出拦进沙箱子进程,原始数据不进上下文窗口,官方实测能削减 98% 的占用,曾冲上 Hacker News 榜首。

上下文为什么会爆掉
让AI助手抓一次网页快照,可能就要吃掉五十多 KB 的上下文;读二十个 issue 又是将近六十 KB。半小时不到,窗口就被塞满了。
一旦触发压缩,AI 就会忘掉之前改过哪些文件、报过什么错,于是你只能一遍遍重述需求,效率断崖下跌。
问题的根子不在模型,而在"原始数据全部涌进上下文"这个架构。
它怎么做到省98%
Context Mode 在 MCP 协议层做拦截:工具返回的原始数据留在沙箱子进程里,只有AI真正需要的那一小段摘要进入上下文窗口。
同时它把会话记忆持久化保存,并在支持的平台上挂上钩子(hooks),在工具调用前后做强制路由与拦截。
结果就是:同样一次长任务,上下文占用大幅下降,AI 在中后段仍然记得住之前的结论。
安装与启用
点下方绿色按钮下载 npm 插件包(1.11MB),它本质上是一个标准 npm 包。
在项目目录里安装它,或直接把它注册为 MCP 服务器(不同客户端命令略有差异,包内说明有对应写法)。
在你的AI编程工具的 MCP 设置里启用它,然后重启客户端。
新会话里正常干活即可,不需要改变你的提问习惯;想验证效果可以观察长任务后AI是否还记着前面改过的文件。
使用提醒
本文整理自公开资料并附上配套资源;涉及产品的功能与价格以官方页面为准。资源仅供学习交流,请遵循来源许可。
⬇ 点击下载:Context Mode v1.0.169 · MCP 插件包(npm tgz)(1.11MB)
取自 npm 官方仓库的正式发布包,兼容 Claude Code、Gemini CLI、VS Code 等 MCP 客户端。