ARTICLE · 1118915
都在说的插件,AI Agent 正在变成可组装的工作台
FIELD NOTE
都在说的插件,AI Agent 正在变成可组装的工作台
如果只记住一件事:它们都叫插件,但其实在改不同的东西。Claude Mods 碰到运行时,Pi 在整理工具调用,Codex 在打包工作方法,DeepSeek Harness 则把整套运行环境拆成可替换部件。
最近几条更新放在一起看,很容易让人觉得,AI Agent 正在集体走向“插件化”。但这四个案例的重点并不一样:有的在改 Agent 的内部动作,有的在减少工具说明带来的上下文负担,有的在把一套工作方法装起来,还有的试图把整个运行环境拆开重组。
这里最容易混淆的,恰恰是“插件”这个词。它听起来像同一类东西,实际能伸进去的深度差别很大。先把这个范围看清楚,后面的四个产品才不会被混成一团。
01
先别急着把所有插件混在一起
把插件放到 Agent 里,可以先粗略分成四层:
—工具层:增加搜索、浏览器、数据库、画图等能力。
—技能层:告诉 Agent 一类任务应该怎么做,例如代码审查、写周报或制作幻灯片。
—工作流层:把多个工具和步骤接成一条可复用的路径。
—运行时层:改变 Agent 如何处理消息、调度工具、显示界面,甚至改变它原本的内置功能。
差别在于,前面三层是在给工作台添工具、添说明或添流程;到了运行时层,插件开始碰到工作台本身。Claude Mods 和 DeepSeek Harness 引起讨论,主要就是因为它们把手伸到了这里。

图 1
02
Claude Mods:它开始碰 Claude Code 的内部动作
Anthropic 在 Claude Code 的官方源码说明里,把 Mod 定义为带有 function hooks 的 Claude Code 插件。简单说,它可以挂到 Claude Code 的内部事件上,在特定时机插入自己的处理逻辑。

图 2
这也是它和普通技能插件的分界:普通插件通常是在已有工作台里增加能力,Mod 则可以影响 Claude Code 怎样工作、怎样显示结果,以及部分内置能力怎样实现。官方仓库目前列出了几个内置 Mod:
—diff:把代码变化显示在旁边的面板中;
—telemetry:处理内置遥测事件;
—agents-md:改变项目指令文件的读取方式;
—sec-default:控制组织级设置和插件之间的边界。
如果普通插件像给汽车装导航,Claude Mod 更像是在改仪表盘、控制系统和部分驾驶规则。这个比喻不完全精确,但能说明它为什么比“多一个命令”更深入。
Boris Cherny 在 X 上宣布 Claude Mods 已经上线,并展示了社区制作的俄罗斯方块 Mod。[1]
这项能力还在早期。官方源码也提醒,相关 API 可能随着版本变化而调整。眼下更适合把它看成一个开放方向:Agent 的内置功能开始允许社区参与重新定义,至于生态能不能稳定下来,还要看后续版本。
03
Pi Code mode:先别把工具说明全塞进上下文
Pi 1.0 处理的是另一个问题:工具一多,Agent 的上下文会被工具说明占得很满。传统做法是在启动时把说明全部放进去,之后每次请求都重复带上一部分。

图 3
Pi 的 Code mode 把这个过程改成脚本调用:模型需要某个工具时,再通过代码调用工具或模型接口,并读取对应的说明。Pi 官方 1.0 更新说明称,在默认工具和 Code mode 同时启用时,一个 GPT-5.6 请求的提示词规模大约从 5300 个 token 降到 3300 个 token。
这组数字说明的是装载方式变了,不是模型突然获得了新能力。工具不必在一开始就全部摊开,Agent 可以在需要时把工作台补齐。
Pi 1.0 还允许对话进行到一半时更换系统消息和工具,部分工具也可以延迟加载或提前缓存。对开发者来说,这让 Agent 更像一个可以动态整理的工作台,而不是开机时就固定好的工具栏。
Pi 1.0 官方更新说明[2]也提醒,Code mode 首先是一种运行机制和调用方式。它不等同于完整的插件市场,也不代表所有功能都已经开放给第三方替换。
04
Codex Plugins:把一套工作方法装起来
Codex 的路子更接近“把一套做事方法打包好”。OpenAI 对插件的描述,是把可复用的 Skills、连接的应用和其他能力组合起来,帮助 ChatGPT 或 Codex 完成一类工作。插件可以接外部服务,也可以只包含本地技能和操作说明。
比如,一个项目管理插件可以读取日历、邮件或项目管理工具里的信息,按固定模板起草周报,提醒用户检查风险,再在得到授权后把结果写回相关应用。它装进去的不是一个孤零零的按钮,而是一段可以反复使用的工作路径。
所以,Codex 和其他 Agent 确实在解决相近的问题,但它目前最清晰的重点,是把能力和工作流封装、分发出来;它并不是在直接开放 Claude Code 那样的内部运行时。
这也是为什么 Codex 插件要同时处理应用授权、工作区权限和安装范围。插件能做什么,不只由它的说明决定,还取决于它连接了哪些应用、用户给了哪些授权,以及它运行在哪个平台。
OpenAI 官方插件说明[3]把 Skills、连接应用、插件安装和权限边界写得比较清楚。社区里的 Taste 等案例,则让人看到另一件事:插件生态的价值,也在于用户能不能把自己的方法留下来,下一次不用重新解释。
05
DeepSeek Harness:连运行环境也可以拆开换
DeepSeek Harness 说 “Everything is a plugin”,重点不在于插件数量多,而在于它把 Agent 的运行环境也当成可组合的部分来处理。
从官方仓库和文档来看,它想插件化的范围包括:
—模型和模型提供商;
—工具和 Shell 执行能力;
—子 Agent;
—终端和后台任务;
—Web UI;
—Computer Use;
—计划任务、记忆和其他运行时服务。
普通技能插件主要回答“这件事应该怎么做”;Harness 层插件还会影响 Agent 能调用什么、怎样运行,以及怎样和桌面交互。这已经更接近在组装一个 Agent 平台。
DeepSeek Harness 的 Computer Use 文档说明,模型可以通过配置好的 provider 观察并操作本地桌面,目前可以使用 Cua Driver MCP 或 native provider。同一个组合中一次只能注册一个 Computer Use provider,而且这项能力仍处于实验阶段。

图 4
它确实可以让 Agent 打开浏览器、观察页面、执行点击和输入,再去 X 或其他网站读取资料。但“能操作桌面”和“能稳定完成网页研究”之间,还有一段距离。浏览器状态、系统权限、页面结构,以及网页里的提示注入,都会影响结果。
DeepSeek Harness 官方网站[4]以及 Computer Use 文档[5]展示了这套架构正在往哪里走。
06
把四条路线放在同一张图里

图 5
放在一起看,它们并不是在争夺同一个位置。Claude Mods 碰运行时,Pi 调整工具调用,Codex 打包工作方法,DeepSeek Harness 则把更多运行组件拆出来。与其问谁的插件更强,不如先问:它到底允许用户改动哪一层?
07
为什么大家现在都在做这件事?
功能多到一定程度之后,全部塞进核心产品并不是好办法。搜索、浏览器、代码执行、记忆和桌面操作,各自带着不同的权限和配置;全都默认打开,系统会变重,用户也很难知道哪些能力正在参与。
用户需要的工作台也不一样。程序员在意代码和终端,研究人员在意资料和引用,设计师在意文件与视觉工具,企业团队还要考虑权限和审批。一套默认配置很难同时照顾这些场景。
社区的速度又往往比官方产品更快。官方团队把基础设施做稳,细分需求则由使用者先遇到、先试出解法。插件、技能和工作流,给这些经验留下了一个可以复用的形状。
对用户来说,插件化最后落到一件很具体的事:不用每次重新解释自己的工作方法,Agent 可以把这套方法留下来,并在下一次继续用。
08
开放得越深,越要看权限
功能开放得越深,用户越不能只看功能表。还需要继续盯住几件事:
—不同 Agent 之间还没有统一的插件标准;
—插件 API 变化很快,版本兼容并不稳定;
—第三方插件可能读取文件、调用网络或执行代码;
—Computer Use 会受到网页提示注入和错误操作影响;
—插件越强,用户越需要理解权限和数据流向。
DeepSeek Harness 的安全说明明确提醒,它目前是开发者预览软件,尚未完成安全审计。Claude Mods 的 hooks API 也仍可能变化。Codex 插件则受应用授权和工作区权限约束。
“一切皆插件”听起来很自由,但真正让它能被日常使用的,还是权限控制、版本兼容、可组合性和安全审查。
09
最后,问题从模型转到了工作台
以前,人们比较 AI 产品,常看模型参数、上下文长度和回答质量。现在还要看另一件事:用户能不能把自己的工具、习惯和工作流程带进来。
Claude Mods 在试着开放运行时行为,Pi 在重新安排工具调用,Codex 在把工作方法封装起来,DeepSeek Harness 则把更大范围的运行组件交给用户组合。
模型当然还在变化,但 Agent 的差异会越来越多地出现在“工作台怎么被组织”这件事上。不同产品可能开放不同层级,用户也要在自由度、易用性和权限边界之间做选择。
接下来真正难的,是让普通用户看懂一个插件拿到了什么权限、会影响哪些数据,并且在出错前把它停下来。谁能把这件事讲清楚、做顺手,谁才有机会让插件进入日常工作。
10
资料来源
Anthropic Claude Code Mods 官方源码说明[6]
[6] https://github.com/anthropics/claude-code/blob/main/mods/README.md
Pi 1.0 官方更新说明[2]
[2] https://pi.dev/changelog/releases/1.0
OpenAI Plugins 官方说明[3]
[3] https://help.openai.com/en/articles/20001256-plugins-in-chatgpt
DeepSeek Harness 官方网站[4]
[4] https://www.deepseek.com/en/harness/
DeepSeek Harness Computer Use 文档[5]
[5] https://github.com/deepseek-ai/deepseek-harness/blob/master/docs/subsystems/computer-use.md
DeepSeek Harness 安全说明[7]
[7] https://github.com/deepseek-ai/deepseek-harness/blob/master/SAFETY.md
Boris Cherny:Claude Mods 公告[1]
[1] https://x.com/bcherny/status/2099551291601248485
DeepSeek Harness:桌面版公告[8]
[8] https://x.com/DeepSeekHarness/status/2105330281389662575
Codex Taste 插件案例[9]
[9] https://x.com/alexkehr/status/2105735268980699469
— END —
