乐于分享
好东西不私藏

模型只是插件之一:DeepSeek 开源 Harness,把智能体的身体拆成了乐高

模型只是插件之一:DeepSeek 开源 Harness,把智能体的身体拆成了乐高

最近,DeepSeek 干了一件看起来不像是 DeepSeek 会干的事。

他们没发新模型,发了一个叫 Harness 的东西,而且一上来就 MIT 协议把源码全开源了。上线 48 小时,GitHub 星标冲到 9.3 万,圈里有人把它叫「Agent 界的 Android」。

我一开始也以为这又是个套壳 Coding 工具。读完架构文档才反应过来,它真正想做的,是把「智能体怎么干活」这件事的底层,彻底拆开重做一遍。

DeepSeek 自己给了一个公式,特别值得贴在每一个 AI 产品经理的显示器上:

Agent = Model + Harness

模型负责动脑,Harness 负责身体。身体这词里装的东西很多:工具怎么调、上下文怎么组织、出错了怎么重试、什么时候算干完、权限怎么管。过去大家卷模型,DeepSeek 这次把聚光灯打到了身体上。

下面从产品方法的视角,把这套设计拆开看。

先划一条线:Harness 不是模型,是智能体的身体

做产品的第一步,是把概念边界划清楚,不然需求会糊成一团。

DeepSeek 在技术文档里先划了线:Harness 不是大模型,也不是推理引擎(不等于 vLLM、SGLang),它是一个 Agent 运行时框架,是智能体的底座。

这个区分很关键。一个模型,哪怕强到 GPT 级别,也只干一件事:预测下一个 token。它不知道电脑上有哪些文件,不会自己跑测试,不会在出错时换条路重试。这些「让 AI 真正把活干完」的事,全在 Harness 里。

过去半年,关于 AI Coding 的讨论其实已经从模型悄悄转向了 Harness。同一个模型,丢进不同的 Agent 系统,表现能差出一大截。原因就在这儿:模型只管预测,Harness 决定模型「能看到什么、能调哪些工具、上下文怎么排、错误怎么处理、何时收工」。

所以 DeepSeek 这次的发布,本质上是承认了一件事:智能体的体验天花板,很大一部分不在模型,在身体。对产品经理来说,这是个重要的认知切换——你纠结「用哪个模型」之前,先得想清楚「我的 Agent 身体长什么样」。

一切皆插件:可替换的从工具一直下沉到 Agent Loop

Harness 最特别的地方,是它基于一套叫 Cordis 的插件总线,把「一切皆插件」做到了极致。

注意,是极致。主流 Coding Agent 也支持插件、MCP、自定义工具,但可替换的范围通常停留在「工具和技能」这一层。DeepSeek 把插件边界往下又沉了一层:模型适配器、文件工具、Shell 执行器、Skill 技能、会话存储、沙箱权限、Agent 主循环、WebUI,全是插件。

这意味着什么?意味着你可以不碰框架源码,只在配置里就完成:换掉模型、换掉某个工具、关掉某个能力、甚至换掉 Agent 怎么循环、怎么调度子 Agent、用什么界面。插件之间靠事件总线和服务依赖通信,高度解耦,支持动态加载和卸载。

对产品经理,这是个特别值得玩味的信号:当「运行时的每一块」都能被替换,产品就不再是「一个写死的助手」,而是一盒可拼装的乐高。你交付给用户的,不是一个固定形态,而是一套组合规则。

更狠的是工具调用的流水线化。一次工具调用,执行前会依次过 Hook、审批、权限检查、沙箱和超时;执行后还能改写结果、记录、渲染 UI。开发者不用改工具、也不用改 Agent Loop,就能在每个环节插自己的插件。普通调用和程序化调用入口不同,但共用同一套安全和观测机制。

这背后是一句产品哲学:可替换性要下沉到运行时,而不是停在功能层。很多团队做 Agent 产品,做到一半发现「我想改一下它的调度逻辑,结果要动源码」,就是因为插件边界划得太浅。DeepSeek 这次把边界划到了最底。

四种模式,其实是四套插件组合

基于同一套底座,Harness 提供了四种运行模式。但别被「四种模式」骗了,它们不是四套独立系统,而是四套默认加载不同的插件集合。

标准模式,加载完整工具栈:读写文件、Shell、网页检索、Skill、子 Agent 委派、任务规划。日常写代码、改 Bug、做重构用它,最常见。

PTC 模式(Programmatic Tool Calling,程序化工具调用),这是我最想让产品经理留意的。它让模型生成一段 TypeScript 代码,把多轮工具调用组合成一次性执行。换句话说,本来要往返十几轮「模型说一步、工具跑一步」,现在写成一个小程序一把跑完。直接省的是 token,省的是延迟,省的是来回出错的概率。这正好对上大家关心的「Agent 太贵、太慢」的痛点。

极简模式,只留一个 Shell 和一个文件编辑工具,用来在最小环境里测模型本事,排除其他组件干扰。

创造模式,允许 Agent 在运行时检查自己所处的环境、在内存里试装 Cordis 插件、据此组合出新模式。这一步最远:传统 Harness 怎么运行,是产品开发者预先写死的,用户只能在既定配置里选;创造模式试着把「配置权」也交给 Agent 本身。它离「Agent 自己改造自己的 Harness」还有距离,但方向已经立住了。

对产品经理的启示很直接:别把「模式」当成功能列表里的四个按钮,要把它当成「同一底座上的不同插件配方」。你给用户的不该是越多越好的开关,而该是针对不同场景的、默认就调好的几套配方。PTC 这种「为省钱省时而生」的模式,比堆十个炫技功能更有杀伤力。

多 Agent 有架构新意,但别吹成范式突破

Harness 内置了一套完整的多 Agent 系统。父 Agent 可以通过 Spawn 拉起一个全新上下文的子 Agent,通过 Fork 让子 Agent 继承已有会话;复杂任务里,模型还能用 workflow 工具现场写 JavaScript,拿 parallel 和 pipeline 组织并行或流水,再用 Ralph 模式让多个新 Agent 按轮次接力。

InfoQ 那篇深度稿的判断我很认同:放进常见的五种编排范式里,DeepSeek Harness 最接近层级式的 Supervisor-Worker(父 Agent 拆解、分配、汇总,子 Agent 执行),是个以层级为主、兼容并行和流水线的混合系统。它离真正的 Swarm(Agent 之间自主发现、协商、动态接管)还差得远。

所以实话是:多 Agent 的编排范式,DeepSeek 没有发明新的;真正新的,是把这些编排方式做成了可随配置替换的插件,甚至能把 Claude Code、Codex 或者支持 ACP 的外部 Agent 接到同一个子 Agent 接口后面。

这对做产品的人的提醒是:别被「多 Agent」三个字带节奏。编排算法大家迟早都会,拉开差距的是你愿不愿意把「怎么协作」也做成可替换、可比较、可回放的能力。Harness 把父 Agent 调度、子 Agent 接口、外部 Agent 接入全做成插件,等于把「协作方式」从写死的代码,变成了可以试错的变量。

还有一条设计我很喜欢:所有运行轨迹汇入同一条 append-only 事件流。模型看到的系统提示、推理内容、工具调用、子 Agent 调度、每一次上下文注入,全进同一份只追加的日志。Trajectory 视图能按来源检查,会话能恢复、分叉、回放,都建立在同一份事件流上。

这件事解决的,是可观测性。Agent 任务挂了,问题可能出在模型判断、工具返回、上下文注入、调度策略或系统提示里任何一环。内容散落在不同组件,你根本还原不了模型当时到底看到了什么。统一事件流给调试、评估、回放提供了一份共同底稿。对做 Agent 产品的团队,这是教科书级的一课:可观测性不是加个日志面板,是把「模型看到了什么」做成一等公民的数据结构。

三个产品启示

第一,从模型思维切到运行时思维。用户感知到的 Agent 能力,很大一块由 Harness 决定,不由模型决定。做产品时,把「选哪个模型」的权重降下来,把「身体怎么设计」的权重提上去。尤其对垂直场景,一个调好的小模型加一个厚 Harness,往往比裸接旗舰模型更好用、更便宜。

第二,可观测性就是产品力。Agent 如果不可回放、不可解释、不可分叉,就永远停在 demo。Trajectory 这种「统一事件流」思路,值得每个做 Agent 的团队抄。能还原每一步,才能迭代每一步。

第三,开放架构是一场赌,但赌的是生态。DeepSeek 选 MIT、在预览阶段就开源完整源码,目标显然不是做个封闭的 DeepSeek 客户端,而是想让模型、工具、Loop、UI 都长在同一套可组合框架上,让外部开发者围着它建插件。风险也明摆着:插件边界越深,接口稳定性、依赖管理、版本兼容、性能开销越难控;v0.1 阶段进来的开发者要承受迁移成本。而且「什么都能换」不会自动等于「任务成功率高」,最终还得看官方给的默认插件够不够好、评测够不够硬、第三方愿不愿意持续建。

落到 Agent 产品经理今天能做的:先别急着堆功能,把你产品的「插件边界」画清楚,哪些能换、换的成本多高;再把 PTC 这类「为省钱而生」的模式当成标配,而不是炫技项;最后,一定给自己的 Agent 接上可追溯的事件流,不然你永远不知道它为什么翻车。

窗口不会关,但「身体」这道题,现在就开始计分了。

主要信息来源:DeepSeek 技术社区《DeepSeek 发布 Harness 引擎》(2026-08-13,v0.1,MIT 开源,GitHub: deepseek-ai/deepseek-harness)、InfoQ《DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件》(2026-08-14)、腾讯新闻《DeepSeek 开源 Harness v0.1》(2026-08-18)、新浪新闻《DeepSeek Agent 功能有哪些》(2026-08-14)。架构细节(Cordis 插件总线、四种模式、Trajectory append-only 日志、多 Agent Spawn/Fork/Ralph Loop)以官方文档与 InfoQ 深度稿为准;「Agent 界的 Android」「48 小时 9.3 万星标」为媒体报道口径。