

你好,我是枫哥,10 多年码龄。 终身课题:偷懒,但不降质。 这里聊效率工具、AI 热点、技术干货、编程实战,主打少踩坑、多产出。 关注我,一起偷懒,一起进步。
字数 3099,阅读大约需 16 分钟
昨天(8 月 13 日),DeepSeek 在 GitHub 上开源了一个新仓库:deepseek-harness。
没有预热,没有发布会,但热度一点不含糊——发布当天 Star 数就冲破了 3.7 万,到我写稿时已经超过 6 万。

同一时间,DeepSeek V4 Pro 正式版刚刚发布并官宣涨价:缓存命中价直接涨了 12 倍,高峰期输出价格来到 27 元。
模型刚提完价,转头就开源一个「Agent 底座」——这不是巧合,这是一套组合拳。
而这个仓库的定位,只有一句话:
Everything is a Plugin,一切皆插件。
所以,它到底是什么?为什么叫 Harness 不叫 Code?值不值得装?这篇文章一次讲清楚。
一、什么是 Harness:Agent = Model + Harness

在 DeepSeek 官网上,有一条很重要的公式:
Agent = Model + Harness
这个公式最早是 LangChain 在聊 Agent Harness 时提出的:一个好的 Agent,必然由模型(Model)和智能体框架(Harness)共同构成。
你天天在用的 Claude Code、Codex、WorkBuddy,本质都是 Harness——模型是引擎,Harness 是车身,只有引擎没有车身,车是开不起来的。
那么一个 Harness 里到底装了什么?工具调用、技能(Skill)系统、会话管理、沙箱、存储、Agent 循环、调度、子 Agent、工作流……东西非常多。
在过去,这些东西全部被厂商封装进一个以软件为名的壳里,比如 Codex。用户能自定义的,其实只有 Skill、MCP 之类的外围配置;核心机制你看不见,也改不了。
而 DeepSeek Harness 做了一个反常识的决定:把所有东西全部拆开,做成插件,你全都可以自定义。
就像当年的模块化手机——屏幕、电池、摄像头随便换。DeepSeek Harness 就是 Agent 界的模块化手机。
所以,为什么叫 Harness,不叫 Code、不叫 Build?
因为 DeepSeek 做的根本不是一个 Agent 产品,而是一套 Agent 基建。这也是它叫「开发者预览版」的原因——它需要全世界开发者进来,一起插拔、一起造插件,把生态做起来。
二、核心架构:Cordis 内核与「自进化」
DeepSeek Harness 的架构里,真正的核心只有一个:Cordis 内核。
这个内核的作者已经加入了 DeepSeek。这次开源,他们还配套发了一篇 88 页的论文《A Programming Paradigm for Spatiotemporal Composability》(一种面向时空可组合性的编程范式)。
Cordis 内核做的事情极其克制:只负责插件的加载、卸载和依赖管理,其他什么都不管。
但就是这份克制,支撑起了两个非常关键的特性:
• 时间可组合性(Temporal Composability):一个插件被卸载之后,它之前产生的副作用能不能被完整撤销? • 空间可组合性(Spatial Composability):插件 A 依赖插件 B,当 B 出现、消失、改变时,A 能不能动态地重新处理自己的依赖?

这两个特性意味着什么?
意味着 Agent 可以在运行过程中,随时给自己安装、卸载插件,而且运行状态不崩。更进一步——Agent 可以给自己开发新插件,插到自己身上,再继续干活。这就是某种意义上的「自进化」。
所以与其说 DeepSeek Harness 是一个 Agent 产品,不如说它是一个为了展示 Cordis 内核、预置了 100 多个第一方插件的科研成果。
仓库本身也很有看头:50 多个 npm 包的 monorepo,core、session、sandbox、skill、mcp、subagent、workflow、plan、goal 一应俱全,还有 Python SDK、CLI / ACP、原生沙箱(native sandbox),文档中英双语齐备——工程完成度,不像一个「预览版」。
三、上手体验:一条命令,四种模式
说一千道一万,不如上手跑一遍。安装只需要一条命令:
npx @deepseek-ai/dsh web看不懂这条命令?没关系,把命令扔给任何一个本地 Agent 产品,让它帮你装。装好后会自动弹出一个本地地址,浏览器打开就是 Web UI(默认 http://127.0.0.1:3080)。

如果发现 npx 命令长时间卡住,可以尝试切换一下 npm 镜像地址。
npm config set registry https://registry.npmmirror.com/
第一次运行会让你填 DeepSeek API Key,去 platform.deepseek.com 申请一个就行(记得充值)。然后选模型:Flash 和 Pro 可选,也能调思考强度。
小知识:Harness 并没有把你锁死在 DeepSeek 模型上——支持自定义 Provider、Base URL 和协议,你完全可以接 GLM、Qwen 或者任何 OpenAI 兼容端点。
接着点击「选择工作区」,添加一个项目目录,这就是你的 Agent 能操作的文件范围。

接下来,就是 DeepSeek Harness 最有特点、也最让人懵的部分:四种模式。
记住一个前提:这四种模式不是底层机制,而是官方给你预设的四种模板,方便开箱即用。
| 标准模式 | ||
| PTC 模式 | run_code 里组合多个工具操作,把原本多次模型往返的读取、搜索、筛选压进一次执行 | |
| 极简模式 | ||
| 创造模式 |

一张表把四种模式说清楚了,但其中有一个值得单独展开:创造模式,这是 DeepSeek Harness 最特别的地方——它能让 Agent 检查自己正在运行的 Cordis 环境、在内存里试验插件,直接改造自己。
你可以告诉它:「帮我做一个只允许读代码、不允许改文件、专门负责安全审计的模式。」
也可以告诉它:「帮我做一个接入公司内部搜索、固定使用某个模型、拥有三种专属 Skills 的研究 Agent。」
甚至可以先让 Agent 检查自己身上已有的插件和能力,发现缺什么,直接创造一个插件,然后挂到自己正在运行的流程里。
用一个比喻:Agent 发现自己没有扳手,于是现场造了一把扳手,插到自己手上,接着用这把扳手继续干活。
这就是整个 DeepSeek Harness 最核心的特点,也是 Cordis 内核最棒的体现。
四、杀手锏:会话 = 一份只追加的事件日志
还有一个对开发者极其友好的设计,很多人没注意到:会话 = 一份只追加的事件日志。
模型看到的系统提示词、用户消息、推理内容、工具调用和结果、权限变化、上下文注入、压缩、子 Agent 调度——所有这些,都会成为日志里的事件。下一轮模型看到的历史,也是从这份日志重新推导出来的。
这件事的价值很大。以前 Agent 跑挂了,你只能看到「任务失败」或者死循环,根本不知道它从哪一步开始跑偏。而在 Harness 里,轨迹视图可以按来源查看每一次运行。

可观测、可审计、可复现——对调试、对研究,都是降维打击。
五、插件生态:社区已经卷起来了
插件,是 DeepSeek Harness 的灵魂。官方第一方插件预置了 100 多个,设置页里直接可见即用。觉得缺什么?创造模式自己造。
更让人意外的是,社区生态已经跑起来了。开发者整理了一份 Awesome 清单(awesome-dsh-plugin[1]),目前已收录 138 个插件,按用途分成七大类:UI 增强、会话与消息、工具与能力、工作流与自动化、通知与集成、开发与运行时,以及「纯属好玩」。

安装插件也很简单,一条命令:
dsh plugin add <插件名>每个插件都声明了自己的 dsh.bundle 清单,命令行装上就能用。新手可以先装一个 dsh-find-plugin,之后直接在对话里让 Agent 帮你在清单里搜插件。
挑几个代表性的:
• dsh-genui:模型在回复里直接渲染图表、表格、表单、Diff、Mermaid、交互面板 • DSH-better-sidebar:VS Code 式侧边栏工作台,文件管理、真实终端、Git、Diff、内嵌浏览器全部塞进去 • ModLens:给纯文本模型补上视觉能力,配置好视觉通道后直接贴图,模型就能读图 • dsh-polyglot:把 Harness 指向任意 OpenAI 兼容端点,GLM、Qwen 随便换——正好呼应前文说的「模型不锁死」 • dsh-automation:定时任务,让 Agent 在全新会话里按计划干活 • dsh-at-file:输入框直接 @调用文件
除此之外,有人在折腾终端 UI(TUI),有人做会话导入导出(把 Claude Code、Codex 的历史聊天搬进来),有人做微信遥控 Agent,甚至还有人做了桌面宠物和五子棋。连这个 Web UI 本身都是插件,已经有群友随手做了皮肤插件。
这大概就是 DeepSeek 想要的局面:内核做对,剩下的交给全世界。
六、争议与冷思考
毫无疑问,这是一个「二极管」产品。喜欢的人觉得这就是未来,不喜欢的人觉得这玩意太糙、毫无用户体验、谁用得明白啊。
客观说,普通用户被劝退的点是真实存在的:过多的开发者术语、过高的使用门槛、过少的功能、过差的用户体验——每一步都在劝退。
还有定价的阴影。DeepSeek V4 Pro 涨价后,缓存命中价直接涨了 12 倍,高峰期输出价格来到 27 元,和 GLM、Qwen 相比,性价比优势肉眼可见地收窄。好在 Harness 支持接入别家模型,一定程度上缓解了这个问题——但「用 Harness 配 GLM」,听起来多少有点魔幻。

我的判断是这样的:
从产品看,它对普通用户确实不友好,现阶段更像开发者的玩具;
从战略看,这是 Agent 从「封装产品」走向「开放系统」的一个明确信号。DeepSeek 做的不是应用,是地基。它赌的是生态——内核做对,插件交给全世界。
这很符合 DeepSeek 一贯的气质。就像他们的 Slogan 说的:
探索未至之境。
七、结语
DeepSeek Harness 是一个很特别的系统。「一切皆插件」的理念很酷,自进化的想象空间也很大,但现阶段它确实更属于愿意折腾的开发者。
无论如何,这是一个值得上手试一次的东西。一条命令,装起来看看,不亏:
npx @deepseek-ai/dsh web仓库地址:https://github.com/deepseek-ai/deepseek-harness
你更看好 Harness,还是觉得「一切皆插件」只是极客自嗨?评论区聊聊。
如果觉得这篇文章有用,点个赞、在看、转发三连,也欢迎星标关注,第一时间收到推送。我们下次再见。
我还会继续折腾 DeepSeek Harness、Codex 和各种 AI 工具。
如果你也在研究这些东西,欢迎加我微信交流。添加时备注「公众号」即可。

夜雨聆风