乐于分享
好东西不私藏

把Agent底座开源,真正做到一切皆插件

把Agent底座开源,真正做到一切皆插件
导语 
大模型跑分的内卷已经走到尽头。能不能真正落地解决复杂任务,Agent框架才是接下来最重要的战场。
最近 DeepSeek 正式开源了自研智能体运行框架 DeepSeek Harness,开发者预览版已经对外开放,官网:https://www.deepseek.com/harness/。采用 MIT 协议完全开源,面向所有开发者开放,给国内的Agent生态带来一套全新的IT 协议完全开源,面向所有开发者开放,给国内的Agent生态带来一套全新的底层选择。

很多人第一眼会把它当成又一款代码助手。但实际上,它并不是一个拿来直接用的成品软件,而是一套可以自由搭建智能体的底层底座。

简单一句话理解这个关系:大模型是大脑,Harness 就是智能体完整的操作系统。

模型负责思考推理,而 Harness 负责调度工具、读写文件、执行脚本、调用浏览器,把模型的想法变成真实可执行的动作。整套框架基于自研的 Cordis 微内核构建,最核心的理念只有一个:一切皆插件。

一、DeepSeek Harness,到底能干什么?

市面上绝大多数Agent产品,都是厂商打包好的成品。功能固定,想要增加一个自定义能力,基本没有办法改动底层。

DeepSeek Harness 的思路完全反过来:把整个智能体运行链路全部打散,做成一个个独立插件。模型、工具沙箱、会话存储、前端界面、多智能体调度,全部可以插拔替换。

你不用修改框架核心代码,就能完成绝大多数定制:

不想只用 DeepSeek 模型?直接换一个模型插件,对接任意主流大模型;

需要连接数据库、本地文件、自建业务接口?写一个轻量插件接入即可;

不满意自带的 Web 界面?前端本身也是插件,可以完全重写一套自己的工作台。

框架内置了四种运行模式,覆盖了从日常使用到深度开发、模型评测的各类场景:

标准模式:完整的Agent工作台,支持长任务、多工具串联、任务断点恢复,适合编程、自动化工作流;

PTC程序化工具调用:允许模型通过代码串联多个工具,自动完成复杂度更高的工程任务;

极简模式:轻量版本,DeepSeek官方做模型基准测试时,用的就是这套环境;

创造模式:专门面向插件开发者,自带调试环境,可以快速测试自己开发的自定义Agent。

创造者模式让我想起了黑客帝国电影中的场面,neo需要一辆直升机🚁和武器,系统造好后就直接传送给他了,他马上就学会开。通过cordis底座+插件能力,数字世界的任何训练过的东西,LLM都可以造出来再以插件形式给到AGENT,这个底座未来就是AGENT的工程化小脑,可以让成千上万的插件很好地配合工作,还管理他们的生命周期。LLM还是主大脑,主管理解和推理,生成指令

还有一个很实用的设计:完整可追溯的会话日志。

每一步模型思考、工具调用、文件修改都会完整留存。任务中断可以随时恢复,也可以分叉出多个版本并行测试。所有操作都能够回放审计,大大降低了复杂Agent任务的调试难度,企业使用也能满足合规追溯的需求。

上手门槛也很低,本地部署有两种选择。

如果只是想快速体验,安装好 Node.js 环境之后一行命令就能拉起 Web 端界面:

npx @deepseek-ai/dsh web

访问本地127.0.0.1:3080,填入自己的 API‑Key 就可以直接使用。

想要深度二次开发,可以直接克隆完整源码:

git clone https://github.com/deepseek-ai/deepseek-harness

二、它和市面上的Agent工具,有什么本质区别?

最大的差别:它不做产品,做底座。

我们平时用到的绝大多数Agent,都是封装完毕的工具。厂商决定了你能用什么功能、不能用什么功能,想要深度改造基本无路可走。

而 DeepSeek Harness 的定位,是一套通用智能体基础设施。它给开发者一套完整、可自由组装的底层,你可以基于它搭建完全属于自己的Agent。

简单对比:

成品Agent:开箱即用,但定制空间很小,大多绑定特定模型;

DeepSeek Harness:上手需要一点开发能力,但自由度拉满,兼容各类大模型,底层架构完全开放,MIT协议商用友好。

它不是为了做一个“最好用的代码助手”,而是提供一个开放平台。数据分析、自动化运维、企业私有知识库机器人、多智能体协作系统,都可以在这套底座之上搭建。

三、哪些人适合折腾 DeepSeek Harness?

独立开发者、程序员

搭一个私人本地Agent工作台,按需扩展爬虫、脚本自动化、数据库查询等能力,不用被商业工具的会员、额度限制。

企业技术团队

私有化部署内部AI工作台,对接自有代码库与业务系统,所有数据留在内网,不用走外部服务。

模型评测与研究团队

标准化的极简运行环境,可以用来统一评测不同大模型的Agent工具调用能力,做对照实验。

插件生态开发者

基于Cordis微内核开发各类技能插件,共建开源生态。

这里也要客观提醒一句:目前版本为开发者预览版,插件接口、内核能力还在快速迭代。现阶段更适合学习、测试、二次开发,不建议直接上生产环境。

四、开源Harness,意味着什么?

在此之前,DeepSeek给大家的印象更多是高性能大模型、高性价比API。随着Harness开源,可以明显看到它的战略变化:不再只输出模型,而是开始输出一整套AI基础设施。

国内很多团队想做Agent应用,但从头搭建一套完整运行框架成本极高。DeepSeek直接开源整套底座,相当于降低了整个行业的开发门槛。

统一的插件标准一旦慢慢形成,各类工具、技能插件可以跨项目复用,国产Agent生态也会多一条自主可控的道路。

写在最后

大模型时代上半场,大家比拼的是参数、跑分、上下文窗口。

而下半场,比拼的是谁能更好地让AI动手做事。

DeepSeek Harness最大的意义,是把搭建智能体的选择权交到开发者手上。不用局限于厂商预设好的功能,你完全可以按照自己的需求,定制一套专属Agent。

感兴趣的朋友可以直接访问官网或是 GitHub,下载源码亲自试一试。

信息渠道整理
官方主页:https://www.deepseek.com/harness/
GitHub仓库:https://github.com/deepseek-ai/deepseek-harness

已经快9万星标了,增长太快了有没有!

互动话题

你现在在用哪些Agent工具?有没有遇到定制困难、不够灵活的痛点?如果让你基于Harness开发一个插件,你最想实现什么功能?