乐于分享
好东西不私藏

模型成了插件,账单却没有:Harness 上线一周,Agent 运行时把「换模型」降级成一行配置

模型成了插件,账单却没有:Harness 上线一周,Agent 运行时把「换模型」降级成一行配置

一、这一周发生了什么

8 月 13 日,DeepSeek 在没有发布会的情况下把两件东西同时推了出来:V4-Pro 正式版(0813),以及一个叫 DeepSeek Harness(命令行名 dsh)的开源 Agent 运行时。前者是模型,后者是跑模型的壳。四天过去,热度分布出乎很多人意料——模型的讨论被涨价盖过去了,而这个 MIT 协议、Node.js 写成、还挂着「developer preview」牌子的壳,在 GitHub 上一路冲到十万星级别,插件生态在周末就自己长了出来。
Harness 的设计只有一句话:一切皆插件。模型适配器、工具注册表、会话日志、沙箱、文件系统,甚至 Agent 循环本身,全都是插件,全都可以替换。官方文档里那句「没有需要打补丁的特权内核」,说的就是这个意思——扩展它不需要改它的源码,只需要在旁边再挂一个插件。底层用的是 Cordis 元框架,来自一篇讲「时空可组合性编程范式」的论文。
同一周还有两件事,方向完全一致:
8 月 15 日前后,Codex 的 Multi Agents v2 开始支持跨模型委派:编排者可以是 GPT-5.6 Sol,而把定义明确的杂活派给更快更便宜的 Luna。据披露该功能的开发者说,Luna worker 是「纯子 Agent」,不能互相通信也不能再派生 Agent,默认行为仍然是用父模型的同款配置克隆自己,想走新路径目前得显式提示。
Agent Plugins 1.0 在 GitHub Copilot 全面可用,由 Vercel、AWS、Anysphere、GitHub、微软、OpenAI 联合打磨,Google 在发布当天以核心维护者身份加入。规范本身很小:一个 plugin.json 清单、可选的 skills/ 目录、可选的 mcp.json。
三件事拼在一起是同一个判断:模型正在被降级为配置项,运行时正在升级为架构决策。

二、可替换的和不可替换的

过去两年,大家默认的分层是「模型很重要,外面那层是胶水」。Harness 的四种预设把这个假设直接推翻了。

预设

工具面

适用场景

standard

文件系统、shell、网页搜索、子 Agent、plan 模式

完整编码 Agent

minimal

只有 bash 和 str_replace_editor

隔离测评、基准跑分

code

生成 TypeScript SDK,让模型写程序而不是逐个调函数

五轮往返压成一次调用

creator

standard + 运行时检查、插件实验

自定义预设开发

注意 minimal:DeepSeek 自己公布 V4-Pro-0813 的部分公开编码 Agent 基准(Terminal Bench 2.1 拿到 87.9,DeepSWE 62.7,Toolathlon-Verified 74.1)时,模型就是跑在 Harness 的 minimal 模式里的。这意味着「模型分数」这个东西,从一开始就包含了壳的贡献。同一个模型换个壳,数字会变——这不是脏数据,这是事实:Agent 能力从来就是模型与运行时的联合产物。
code 模式更值得琢磨。传统 function calling 是「模型发一个工具调用 → 运行时执行 → 结果回填上下文 → 模型再发下一个」,五步操作就是五个完整往返,每一轮都要把整个上下文重新过一遍。code 模式把工具编译成一份 TypeScript SDK 交给模型,模型直接写一段程序,一次执行完。省下来的不只是延迟,还有四轮 prefill 的钱。
而在「可替换」这一侧,Harness 的 provider 目录覆盖了 Anthropic、OpenAI、AWS Bedrock、Azure、Google 的企业 Agent 平台,以及 DeepSeek 自家端点——还留了一个「自定义 OpenAI 兼容网关」的口子。它甚至内置两个子 Agent provider,可以把活直接派给 Claude Code 和 Codex(默认关闭,需要你自己装好、登录好)。另有 MCP 客户端、Agent Client Protocol 支持,能读 AGENTS.md 和 CLAUDE.md。
一个中国实验室发布的 Agent 框架,可以毫无障碍地把竞争对手的模型塞进去跑。这看起来像是让利,实际是一次赌注:模型会被商品化,壳不会。换模型是改一行配置,换运行时是重写会话存储、重跑回归、重新培训团队。VentureBeat 那句评价说得直白:对企业开发者来说,Harness 可能才是 8 月 13 日更重要的那半边。
但这里有个反讽。就在 Harness 让模型变得随时可换的同一周,DeepSeek 的账单结构变得更难换了。北京时间 8 月 17 日 0 时(UTC 8 月 16 日 16:00)起,V4 系列启用峰谷计价:V4-Pro 输出从统一的 $0.87/百万 token 变成闲时$1.98、高峰 $3.96;缓存命中输入从$0.003625 涨到闲时 $0.022、高峰$0.044——闲时就已经是五倍多,高峰约十二倍。而 Harness 主打的正是长会话、仓库分析、子 Agent 派发这类缓存最密集的工作负载。
于是开发者拿到了一个奇怪的组合:运行时层面前所未有地可移植,成本层面前所未有地要精算。模型是插件了,账单还不是。

三、落地场景:把「模型是插件」这句话补完

「一切皆插件」要真的成立,缺的是最后一环——插件背后得有个统一的、可计费的、模型齐全的端点。否则你在 config 里写下 5 个 provider,就得管 5 套 key、5 张账单、5 个额度告警、5 种限流语义,配置项是统一了,运维没有。
这正是模型中转层的位置。以为例,它提供一个 OpenAI 兼容的统一入口,正好对上 Harness 那个「自定义 OpenAI 兼容网关」的插件口子:
from openai import OpenAIclient = OpenAI(api_key="wr-***", base_url="https://wrouter.ai/v1")#编排者:跑规划、拆任务plan = client.chat.completions.create(  model="deepseek-v4-pro",  messages=[{"role""user""content""分析这个仓库的鉴权模块,列出重构步骤"}],)#worker:把定义明确的杂活派给便宜模型,同一个 key、同一张账单for step in parse_steps(plan.choices[0].message.content):  client.chat.completions.create(    model="deepseek-v4-flash",    messages=[{"role""user""content": step}],  )
放进 Harness 的模型插件配置里也是同一件事——把 provider 指向 https://wrouter.ai/v1,然后在预设里按角色写模型名,编排者用强模型,子 Agent 用快模型,评测时再切一个第三方模型做交叉验证。三个卖点在这个场景里各司其职:接口稳定,让 Harness 这种还会有破坏性变更的 preview 项目至少在模型这一侧不用跟着改;模型完整,让「换模型只改一行」这句话在跨厂商时也成立,而不是只在同一家的产品线内成立;计费统一,让峰谷价、缓存命中率、编排者与 worker 的分摊,能在一个地方看清楚,而不是月底对着五张账单做减法。
顺带一个实操建议:既然 Harness 把「模型可见的一切」都写进 append-only 会话日志,而计费又开始跟时段绑定,那就顺手把每次调用的模型名、token 数、发起时间一起记进去。等到你需要回答「上周那次 Agent 跑飞的会话花了多少钱、贵在哪一步」时,这份日志会比任何账单都有用。

四、结语

Harness 这一周的走红不是因为它做了什么新功能,而是因为它把一个所有人都在做、但没人说破的事情写成了架构:模型是可替换件,运行时才是资产。Codex 的跨模型委派、Agent Plugins 1.0 的统一打包格式,都是同一句话的不同说法。
对开发者的启示很具体:先假设你半年内会换掉现在用的每一个模型,然后照这个假设去设计你的调用层。把模型名做成配置,把 provider 做成插件,把计费收到一个口子里。这样等下一次「某家凌晨悄悄换了端点、某家宣布涨价 12 倍」的时候,你要改的只是一行字符串。
如果你正在搭这样的调用层,可以拿 wrouter.ai 做那个统一入口,把多模型编排的成本和稳定性问题先关掉一半,再回头专心打磨你的 Agent 循环。
来源
DeepSeek Harness 官方仓库(MIT,developer preview):https://github.com/deepseek-ai/deepseek-harness
The New Stack《DeepSeek open sources an agent harness where everything is a plugin》:https://thenewstack.io/deepseek-harness-open-source-plugins/
The Register《DeepSeek's innovative harness treats everything as a plug-in》:https://www.theregister.com/ai-and-ml/2026/08/14/deepseeks-innovative-harness-treats-everything-as-a-plug-in/5288095
VentureBeat《DeepSeek Harness launches as open-source rival to Claude Code》:https://venturebeat.com/technology/deepseek-harness-launches-as-open-source-rival-to-claude-code-alongside-v4-pro-on-api-with-higher-prices
HPCwire《DeepSeek Open-Sources the Missing Layer Between AI Models and Agents》:https://www.hpcwire.com/2026/08/14/deepseek-open-sources-the-missing-layer-between-ai-models-and-agents/
RuntimeWire《OpenAI lets GPT-5.6 Sol delegate grunt work to cheaper Luna agents》:https://runtimewire.com/article/openai-lets-gpt-5-6-sol-delegate-grunt-work-to-cheaper-luna-agents
DeepSeek API 更新日志(峰谷定价):https://api-docs.deepseek.com/zh-cn/updates