夜雨聆风学习资料网

ARTICLE · 1119331

Hermes接Jev:15个开源插件,怎么选?

Hermes接Jev:15个开源插件,怎么选?

国庆假期已过半,在这还是说声假期快乐。


本文仅作开源项目信息整理,不代表相关品牌立场或商业合作。文中信息截至2026年10月2日,插件版本以目录实际为准。
部分名词释义:Jev           TypeSafe AI 的决策模型:不聊天,只做选择、打分、判断System One    心理学里的"快思考":直觉、秒断;System Two 才是慢慢推理决策模型      输入题目或状态,输出带概率的选择,程序直接拿来用hook          钩子:插件挂在 Agent 流程上的接口,事件发生时被调用MCP           模型调用外部工具的协议,一堆工具接进来统一对话中间件        夹在请求链路中间的处理层,能改写流过的请求shadow 模式   只记录判断、不真正拦截,先观察一段时间再启用

今天分享下Hermes的Jev插件。Hermes已经有很多Jev插件:名字里带Jev或TypeSafe的有13个,再加上两个以Jev为核心的后端大件,一共15个。覆盖从"这轮该加载哪个skill"到"这条终端命令敢不敢放行"的整条决策链。

这些插件不是只看文档写的。我挑了三个装上跑通(jev-judge、jev-skill-router、jev-typesafe),下面的实测数据是真实返回的关键字段摘录(数值原样,字段有裁剪);其余插件的组合逻辑来自本机插件目录和每个插件的说明文档(大多要配TypeSafe的API key,个别走OpenRouter或可选本地后端;没有key自行到typesafe-jev.com注册后获取)。这篇把"有什么、跑起来什么样、怎么选"一次讲清楚。

先搞明白:Jev是什么,凭什么管"决策"

Jev是TypeSafe AI今年9月发布的模型,它跟ChatGPT那类东西完全不是一个路子:不聊天,只做选择题。

给它一段状态和一道题,它返回结构化结果加概率:这件事该归类到哪一类(96%)、危险程度高不高(92%)、要不要转人工(94%)。程序拿到数字直接执行下一步,不用解析长文本、也不用等它"组织语言"。

它的定位是Agent的"快思考层"。大模型负责想得深,Jev负责选得快。官方公布的数据是:每百万输入token 0.042美元、端到端70到500毫秒;在适合它的判别类任务上,比同级别的通用大模型快40到200倍。官方自己标注说,这个倍数是较高水平,不能往所有任务上外推。

为什么这种"选得快的活"对Agent重要?因为一个Agent跑一轮,里面全是小型判断:该加载哪个skill、该用哪个模型、这个操作危险吗、这条记忆要不要塞进上下文。这些活每一步都调一遍大模型,又慢又贵。

就因为这,Hermes的插件目录里Jev插件的密度高得离谱。不只Hermes:DSH那边有jev-dsh-decision(约300星),Claude Code那边有拿Jev做上下文压缩和输出裁剪的插件。整个生态是9月这一个月里冒出来的。

Hermes利用插件几行 能力接上Jev

Hermes的插件不复杂:一个目录、一个plugin.yaml、一段Python,丢进插件目录或者一行命令装上,重启就生效。真正关键的是它能挂的位置:

  • 工具调用前
    :可以拦下来,也可以改参数。危险操作直接截停就走这里
  • 工具结果出来后
    :可以替换结果。长输出先裁一刀再进上下文,就靠这个
  • 模型调用前
    :可以往这轮消息里塞点上下文。比如塞进"这轮该用哪个skill"的建议
  • 请求发出前
    :中间件连请求本体都能重写。模型和推理档位的路由走这里
  • 还有子代理生命周期接口:插件能程序化地起子任务、等结果、取消任务。"编排"这条腿是官方给的

每个事件还带session、轮次、任务、子任务的关联ID。谁在什么时候做了哪个判断,全部有据可查。下面这15个插件,基本就是把这几类挂点占了个遍。

15个插件简介

通用决策工具

jev(作者ourines,v0.1.2):最朴素的一个。装上多一个jev_evaluate工具,你想问Jev什么就手动调。后端可选TypeSafe或Cloudflare。

jev-typesafe(作者Anders Jensen-Waud):四个原子工具,yes/no判断题、路由、打分、混合问题一次批量评估。

这两个是"手动挡",装了他们,Agent的行为不会自动变,适合先试试手感。

能力路由:该用哪个skill、哪个MCP

jev-skill-router(作者DoGMaTiiC):模型调用前动手,从你现有的skill名单里点名一个最合适的,写进这轮上下文。没有合适的就闭嘴不说话。它有两层阈值,先粗选一轮,再把候选复读一遍做精细判断,双阈值都过线才出手。

typesafe-skill-router(作者DECRUX9812):同类思路,风格不同,判断结果会写成一行<skill_relevance>标注挂在你的消息上。约15星。

jev-skill-router-mcp(作者ydmw74):同一个需求的MCP版,skill建议以MCP服务的形式提供。

哦对,这三个是同一件事的三种实现,选一个,别叠。

jev-mcp-router(作者Pinutss):如果你接了一堆MCP服务器,这个负责在一堆工具里挑该用哪个。和上面同一套包结构:一个skill加一个MCP服务。

jev-agent-router(作者Pinutss):任务该交给哪个agent干,它给路由建议。同样是skill加MCP服务的轻结构。

模型与算力的路由

jev-model-router(作者Pinutss):挑模型。同样是一个skill加一个MCP服务的轻结构。

jev-effort-router(作者AlphaPerseii3000,v0.2.1):这个更狠,每轮同时决定用哪个模型、给多高的推理档位,直接重写发出去的请求。但有个大前提:只支持Ollama:Cloud。(对,就这一个)其他provider一律不生效。不吃Ollama云模型的,这个直接跳过。

安全门禁

jev-judge(作者DoGMaTiiC):每次终端命令、写文件、改代码之前先问Jev一遍:这东西破坏性多大、会不会往外传数据、影响面多广。默认是shadow模式,只把判断记录到日志、不拦任何操作(先当摄像头,别一上来就当保安);观察一阵觉得靠谱,再切enforce让它动真格。它还会把每次判断的脱敏摘要发给TypeSafe(工具名加参数,参数每次最多600字符、最多12个)。

jev-approvals(作者anpicasso,v0.3.0,约20星):把Jev当审批员用。危险命令被转成审批请求,Jev判断该不该放行;判断失败一律升级给人,绝不自动放行。和judge的区别:judge面向"每一次工具调用",approvals面向"命令审批"这个位置。

记忆与上下文

jev-memory-selector(作者Pinutss):把agent的记忆按token预算筛一遍。记住的东西多了之后,哪些值得带进这轮,由它来裁。

jev-curator(作者anpicasso):给skill库做语义治理,判断哪些skill内容上互相重复、哪些该合并归档,产出计划但由Hermes自己执行。

两个大件

nerve(作者keeltrace,v0.2.2):这不是单点插件,是一整套"监督神经系统"。16个工具、9个钩子:决策、排序、验证、评估、上下文治理、token预算控制,还有远程执行器(可以在别的机器上跑活)。后端不绑死,Jev之外还支持Laya和OpenJev,能本地自托管。代价也最直接:每轮对话的用户消息(最多1.2万字符)加脱敏工具预览会发给选定的后端(介意出网的,看到这句就该停一下)。

hermes-structured-aux-models(作者trajectoire-ai):把Hermes内部的小活(审批、压缩、MCP采样)从"聊天式提问"换成"Jev决策调用"。走OpenRouter的key,不等TypeSafe的钥匙。

好了,15个齐了。搜索里还能看到新面孔在往外冒,这个生态的增速比文章写得快。

安装:实测数据

15个里我装了三个跑通:jev-judge管安全、jev-skill-router管选择、jev-typesafe管判断,正好是决策链的三段。装上花了十来分钟,跑了一批案例,挑几个接地气的说(下面代码块都是真实返回里截的关键字段)。

周报:让它模拟一遍老板视角

拿一份真实风格的周报草稿(修了个bug、优化了加载速度、开了两个评审会、学了个框架)问它三个问题:

{"boss_satisfied":0.71,"weakest_point":"next_step(0.78)","grind_index":0.74}

翻译一下:老板大概会觉得本周产出充实(0.71)、摸鱼嫌疑低(0.74),但"下周计划太模糊"的嫌疑最高(0.78)。

说得挺准。那句"继续跟进技能系统优化",谁写谁心虚(咳,这句我写着也心虚)。写周报的人可以拿去照一照。

计划:这份季度计划有多画饼

三个目标:三个月把留存率从28%提到50%、重构全部核心战斗系统、上线三个新玩法;团队一共四个人。问它"画饼指数":

{"score":2.99,"legend":{"3":"纯纯画饼"},"confidence":0.99}

接近满分(2.99/3),纯纯画饼,置信度0.99。这判决要是能拿到项目会上,能省半小时扯皮。

策划案:资源有限先做哪个

一个休闲游戏的系统列表(弹珠核心玩法、成长、社交、商业化),问它资源有限该先把哪个做扎实:

{"choice":"core","probabilities":{"core":1.0,"meta":0.0,"social":0.0,"monetize":0.0},"confidence":1.0}

一票全给核心玩法,其余全零。它不做和稀泥的中间态。

架构:EventBus该不该上

一个常见争议场景:为了UI和逻辑解耦,全项目改消息总线,跨模块通信用事件,已经堆了200个事件类型。问它三问:

{"sustainable":0.33,"biggest_risk":"complexity(0.7)","necessity":1.22}

扩规模后可持续吗:0.33,偏悲观;最大风险:事件失控、调试难追踪(0.7);必要性:1.22,可选优化偏没必要。

老实说这个判决跟我自己的口味一致:解耦的收益如果要压上整个项目,先想想是不是过度设计。

路由功能:

还有一类日常用法。问它"帮我写本周工作周报",没吱声;"设计一下新手引导流程"这么像游戏开发的活,也没吱声。它先看你手上的技能名单,没有真正合适的就沉默,宁可不说,不乱说。

行吧,这份憋得住的定力,我服。

怎么选?先回答自己三个问题

问题一:你想让Jev管哪一段?

只想知道Jev什么手感,装jev-typesafe,手动调,零自动化风险。

skill列表越来越长得记不住,装jev-skill-router(或typesafe-skill-router,二选一)。

经常跑自动化脚本、委派任务,怕哪天真闯祸,装jev-judge,shadow起步。

模型和工具的选择也要管,看jev-model-router和jev-mcp-router。

想要一整套监督加调度,直接读nerve的文档,这是这批里功能最全的,也是最重的。

问题二:数据出境你介意吗?

不全都得出网,分三类看:路由和门禁类(judge、skill-router、typesafe-skill-router、approvals,以及jev-typesafe那批手动工具)会把内容发给判断服务,各自发的不一样:judge发工具名和脱敏参数;skill-router发你的消息(最多4000字符)加skill名单和摘要;nerve发每轮的提示词(最多1.2万字符)。走OpenRouter的(effort-router、structured-aux-models)换成OpenRouter的key,判断发生在OpenRouter上。还有默认就不联网的:model-router本地启发式就能跑,curator默认不出网也不自动动手,nerve的Laya和OpenJev后端可以自托管。做敏感项目,先看后两类。

问题三:装了能不能回退?

都能。hermes plugins disable一行关掉;judge默认就是shadow模式,只记日志不拦东西,我装上后正常操作零感觉。唯一别做的就是全装(真的别):里面有三组重复对(三个skill路由、两个模型路由、两个门禁),叠着装不光浪费,出了怪问题还分不清是谁干的。

嗯,最简单的判断:认识Jev,装jev-typesafe;想让Hermes变聪明,从jev-judge(shadow)和jev-skill-router两个开始;想一步到位,先读nerve的文档再做决定。

几个共通的坑

  • 不全是"必须有key":路由和判断类大多要TypeSafe的API key(还在Early Access阶段),有的走OpenRouter的key;但也有不需要的(model-router默认本地就能跑,curator默认不出网,nerve可自托管)。没key的路由类插件装了也是空转
  • 每做一次决策多一次网络往返。官方标称70到500毫秒,我实测judge单次判断在600到800毫秒(日志里五次:641到718毫秒),skill-router每轮1.5到2.8秒,都比标称慢一些。挂在每轮对话上的插件,响应会变慢一点,挑关键点用,别把每个路口都装上收费站
  • 走MCP的那几个(Pinutss的model-router、mcp-router、memory-selector、agent-router,加上ydmw74的skill-router-mcp)是stdio MCP形态,启动依赖机器上的uv
  • judge和skill-router在服务故障时都是fail-open:没key、超时、接口报错就放行或沉默,不卡你的流程。所以它们是辅助判断,替代不了本地权限管理和人工审批
  • 都是社区插件(目录里标的community),不是官方亲儿子,更新节奏看作者
  • 版本门槛:15个条目里8个显式声明了门槛,7个要Hermes 0.21以上、jev-typesafe要0.19以上,其余7个没声明。我的0.21.5满足全部已声明约束,实测装上的三款都能跑

📮

👋 还没关注?别划走,这里有个名片等你收下。


往期精选:

OpenCode小技巧:环境变量写法

OpenCode小技巧:agent配置的用法

deepseek-harness 插件开发:写一个轻量记忆注入插件(附源码) 

Hermes Agent 在 Windows 的隐藏坑:硬盘多出以盘符开头路径的文件夹

Ollama vs LM Studio vs llama.cpp:本地大模型方案怎么选?

Hermes 和 Claude Code 协作踩坑 & 如何编写对应委派 Agent Skill

相关学习资料