夜雨聆风学习资料网

ARTICLE · 1076756

DeepSeek把AI助手的『身体』开源了:什么都能换,包括它自己

DeepSeek把AI助手的『身体』开源了:什么都能换,包括它自己

PART

01

先接受一件反直觉的事:大模型什么都不会做

你手机里那个能改代码、能查资料的 AI 助手,它的核心其实只会一件事——接话。

你给它一段文字,它预测下一段最可能出现的文字。就这样。

它不能打开文件,不能执行命令,甚至不知道今天几号。

那它是怎么帮你改代码的?因为有人围着它转:把信息当文字喂给它,听它的回答,替它动手,再把结果喂回去。它接话,人跑腿。

记住这句话,后面所有内容都是从它长出来的:AI 从不亲自动手,它只是提出要求。

真正读文件、跑命令的,是模型外面那一层软件。

这层软件有个专业名字:Harness——原意是「马具」,套在马身上,把它的力气导向有用的方向。

打个比方:模型是大脑,Harness 是身体。

同一个大脑,接上不同的身体,能做的事天差地别。你现在用的每个 AI 助手,差别主要不在大脑——在身体。

这个身体负责五件事:什么时候问模型、给它什么工具、记住哪些事、不许做什么、东西存在哪。

DeepSeek 刚把自己这副「身体」开源了,叫 DeepSeek Harness(下面简称 DSH),GitHub 上 23.5 万星。

这篇讲三件事:它是什么、怎么工作、跟 Claude Code 们性格差在哪。

PART

02

拆开看:一副什么都能换的身体

先给几个数:4 种运行模式、58 个内置工具、50 多个可独立替换的功能模块、MIT 协议 100% 开源。

它最核心的主张一句话:不把产品形态锁死,给你一套「组装规则」,你可以改成任何你想要的样子。

仓库是 8 月 13 日建的,42 天 23.5 万星、2.8 万 fork。

16,511 次提交出自 58 位贡献者——平均每天 180 次,周末还贡献了近 19%。

官方自己说这是早期版本,还会有较大变动。

同一颗大脑,四种活法

标准模式,全能型选手:读写文件、执行命令、检索资料、拆任务、派分身,先出方案等你批准再动手。日常开发用它就够了。

PTC 模式,让 AI「写程序」干活。

普通模式 AI 是一步步调用工具:读一个文件、再看一个、再改一处。PTC 模式下它直接写一段程序,让程序去批量调工具。

好比不是一步步指挥,而是写好一张清单交给助手,一口气做完。

极简模式,反着来:把几乎所有能力都拿掉,只留一个命令行终端。

系统提示一句话固定不变,行为完全可预测、可复现——官方叫它「固定的双工具训练配置」,给研究和训练场景用的。

创造模式,最有意思的一个:它能看到自己的「内部构造」,并且现场改动。

查询自己装了哪些模块、临时给自己挂个小功能试试、复制一个配置改成新模式。

这意味着「这个 AI 助手能变成什么样」,不再由厂商单方面决定——使用者,甚至 AI 自己,都能参与定义。

四种模式看着像四个产品,拆开一看:注册表、安全策略、存储、模型接入全是共用同一套。

不同的只有最上面薄薄一层——给 AI 看哪些工具、写什么提示词。

既然形态只由一层配置决定,那它就可以被自由改写。这就引出了 DSH 最特别的地方。

一切功能都是积木,包括主循环

DSH 的口号是 Everything is a Plugin。

文档里有句狠话:「没有一个需要打补丁的特权核心——你要扩展它,就在旁边挂一个新零件。」

模型接入是积木,工具是积木,安全策略是积木。

连「请求模型→执行工具→再来一轮」这个主循环本身也是积木——不满意可以整块换掉。

而且每块积木拆走之后,它占的位置自动恢复干净,不留残渣。

这套拼装规则来自它脚下的开源插件框架 Cordis。

每块积木向共享上下文注册能力,声明依赖自动排序;积木之间靠类型化事件互相监听——压缩、审批都挂在事件链上。

实际能做的事就多了:换一家模型,其它照旧;把「本机执行」换成「远程沙箱」,终端、文件操作、代码编辑一起搬过去。

因为 DSH 把能力拆成了接口、实现、使用者三个角色——使用者只认接口,不认背后是谁。

PART

03

和 Claude Code 们比,性格差在哪

不比功能多少,比三个底层问题的答案:对话怎么管、安全怎么守、帮手怎么派。

对话记录的角色不一样。

聊久了装不下,各家都会压缩成摘要,也都在本地留原始记录。但别家的记录是「副产品」——旧消息被就地改写成摘要,转录文件只是顺手存的。

DSH 的日志是「事实源」:AI 每一步看到的上下文,都从日志计算得出。压缩也只是往日志追加一笔,日志一字不动。

有条硬规矩叫「模型可见,即已记录」——模型看到的每个字,都必须能在日志里找到出处。回放、分叉、审计,全建立在这上面。

安全靠围墙,不靠讲规矩。

有的助手用规则判断该不该做——灵活,但规则本身可能被绕过。DSH 交给操作系统内核限制:不管程序怎么写,都出不了那个圈。

文件操作也一样被关在圈里,不只是命令行。

最硬的一点:围墙装不上时,它拒绝运行,而不是裸奔。

当然 AI 确实需要越界时也有口子:必须写清楚理由、只能往更宽的方向提、只对这一次操作有效。

永远需要人点头——没有「以后都允许」这个选项。

一张表放平四家:

默认姿态
隔离方式
授权粒度
opencode
默认全放行
靠规则匹配
可「本会话一直允许」
Claude Code
默认会问你
系统级,只管命令行
可记住「以后别再问」
Codex
先隔离再问
系统级,默认开启
分档授权
DSH
限定范围+会问你
系统级,文件和命令都管
永远一次性,从不记住

派帮手:能把别家 AI 当手下,但还嫩。

DSH 的子代理不是拼命令行——Claude Code 走官方 Agent SDK、Codex 走 app-server 协议。

版本钉死自带,不用你操心兼容。

但每次委派等于全新线程、一轮对话,只带回最终答案,中途不能追问;子代理权限启动即锁死,没有申请批准的通道。

桥是正经桥,调度面还薄。

PART

04

值不值得关注

两个词概括 DSH 的性格:开放——没有什么是不能换的;严谨——每一步留痕、每次授权问你、围墙装不上宁可不跑。

这两点看着矛盾,其实是同一件事的两面:正因为规则定得足够清楚,才敢把自由放得足够大。

对号入座。

需要定制 AI 工作流的人,可组装性是它最大优势。

在意安全边界、要求可审计的团队,日志事实源设计是现成的地基。

想做个 AI 产品嵌进自己系统的,可以拿它当运行时。

但如果你只是想找个顺手的助手写代码——它现在还有点「重」,面向的是想自己定义形态的人。

而且它真是早期版本,官方原话「会有较大变动」,尝鲜可以,先别押上生产流程。

你最想换掉 AI 助手身上的哪个零件,评论区聊聊。

点赞

在看

转发

相关学习资料