乐于分享
好东西不私藏

Hermes Agent安装使用-图文教程

Hermes Agent安装使用-图文教程
PART  效果预览
PART  正文
  • 本文和comfyui没有关系,请熟知!!!!
  • 单纯介绍Hermes Agent+Ollama的安装、配合使用
  • Ollama教程请看这篇-》Ollama下载、安装、走cpu-图文教程
  • 首先最好全程魔法。不然很慢。
  • 搜索栏目搜PowerShell
执行命令
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
  • 它会自动处理一切,

  • 他自己会下运行 Hermes Agent 的完整环境

  • 他执行了下面这些步骤,

  • 安装核心依赖:自动下载并安装 uv (Python 包管理器)、Python 3.11Node.js 22ripgrep (代码搜索工具)、ffmpeg (多媒体处理) 等

  • 配置 Git 环境:如果你的电脑没有 Git,它会自动下载一个 便携版 Git (PortableGit)。这个版本完全独立,不会影响你电脑上已有的任何 Git 设置

  • 克隆代码并设置环境:将 Hermes Agent 的完整代码克隆到 %LOCALAPPDATA%\hermes\hermes-agent 目录,并为你创建一个 Python 虚拟环境

  • 配置 PATH 环境变量:自动将 hermes 命令添加到你的用户 PATH 中,方便你在任何地方直接使用

  • 杀毒软件我后面是给他关掉的
到下图这个位置
选项
一句话解释
数据流向
成本
是否适合你?
1. Quick Setup (Nous Portal)
用 Nous 官方的云端服务,OAuth 登录一键配置好所有模型和工具。
数据会经过 Nous 的云端服务器
免费
(有每天免费额度)
❌ 不推荐。数据要上传云端,不符合你本地运行的初衷。
2. Full setup
手动填写每个 API 密钥(OpenAI、Anthropic等),自己配置所有功能。
数据流向你指定的 API 服务
按量付费
(用谁的API就付给谁)
❌ 不推荐。你需要为云端模型付费,且配置繁琐。
3. Blank Slate
所有功能默认关闭,只保留最基础的核心,你后续按需手动开启。
完全本地
,数据不出电脑
零成本
(搭配本地Ollama)
✅ 强烈推荐。最灵活、最安全、最省钱,符合你用本地模型的规划。
这里我选3回车
  • 然后进入下一个步骤,
  • 33因为我本地有Ollama
  • 然后我Ollama本地端口是http://127.0.0.1:11434/v1
  • 你本地Ollama记得要先启动!!!!

  • 我加/v1是他默认格式,不用在意,你可以不用管,因为直接访问他是404
  • 主要看下一步有没有识别到
  • API 兼容模式的步骤

Select API compatibility mode:  1. Auto-detect [current]     Use Hermes URL heuristics; best for standard OpenAI-compatible endpoints.  2. Chat Completions     Use /chat/completions for standard OpenAI-compatible servers.  3. Responses / Codex     Use /responses for Codex-compatible tool-calling backends.  4. Anthropic Messages     Use /v1/messages for Anthropic-compatible endpoints.
选项
说明
是否适合你?
1. Auto-detect (推荐)
Hermes 自动探测 URL 格式并选择最合适的模式
✅ 选这个,省心
2. Chat Completions
使用标准的 /chat/completions 端点
⚠️ Ollama 支持,但自动检测也能识别
3. Responses / Codex
用于 Codex 兼容后端
❌ 不适用
4. Anthropic Messages
用于 Anthropic Claude API
❌ 不适用
  • 选1回车
API mode: auto-detect  Available models:    1. artokun/gemma4-comfyui-mcp:12b    2. qwen3:4b
  • 这里显示你Ollama本地有下载了哪些模型
  • 我选1
这里直接回车,让他自己检测长度
继续回车默认地址为名字就好
Select terminal backend:  Select by number, Enter to confirm.  (○)  1. Local - run directly on this machine (default)  (○)  2. Docker - isolated container with configurable resources  (○)  3. Modal - serverless cloud sandbox  (○)  4. SSH - run on a remote machine  (○)  5. Daytona - persistent cloud development environment  (●)  6. Keep current (local)
选项
说明
优点
缺点 / 适用场景
Local (默认)直接在电脑上执行所有命令
-。
无需任何设置,开箱即用
,延迟最低,最适合快速体验和本地开发-
没有任何隔离
,Agent 拥有和你相同的文件权限。如果你通过消息网关(如Telegram)远程使用,会有安全风险-
Docker
在一个独立的 Docker 容器中执行命令,提供强隔离的沙箱环境
安全性高,可以限制 Agent 的权限,防止意外操作影响主机系统-
需要安装 Docker 并进行额外配置
SSH
连接到远程服务器执行命令
适合需要利用远程强大算力或管理远程机器的场景
需要你有可用的远程服务器,并进行 SSH 配置-
Modal / Daytona
云端沙箱云开发环境中执行命令
提供云端的强隔离环境,支持按需启停,成本可控-
需要注册对应云服务,通常涉及费用-
Singularity
主要在高性能计算(HPC)集群中使用。
专为科学计算和集群环境设计
目前的个人使用场景来说,不太相关。
  • 那么这里选1 

  • Local (默认)

 How far do you want to go?  Your minimal agent is ready. What next?  Select by number, Enter to confirm.  (●)  1. Start with everything disabled — finish now (most minimal)  (○)  2. Walk through all configurations — opt in to tools, skills, plugins, MCP
选项
说明
适合谁?
1. 最精简模式(推荐)
只保留核心功能,所有附加工具(Slack、Discord、浏览器插件等)默认关闭。
现在就适合这个
。先跑通“对话→操作电脑”这条核心链路,后续需要什么再加什么。
2. 完整配置向导
会逐个询问你每个工具、技能、插件的开关,配置流程很长。
适合已经熟练使用 Hermes,需要一次性配置好所有功能的进阶用户。

这里我选1

  • 然后就成功了
  • 关掉Windows PowerShell终端
  • 重新打一个Windows PowerShell终端
  • 输入hermes chat
  • 输入帮我看看我桌面上有哪些文件
  • 出项msg=interrupt  是不行的 
  • 你先确保电脑进程里所有的Ollama 进程都关掉
  • 包括右小角的应用给他退出。

新开一个命令符输入Ollama serve

  • 提示:

  • Error: listen tcp 127.0.0.1:11434: bind: Only one usage of each socket address (protocol/network address/port) is normally permitted.

  • 就是还有进程没关

  • 都关掉后

  • 输入Ollama serve

  • 是会如下图所示列出你显卡的显存之类的信息。

  • 别关,这代表你以服务形势启动了Ollama
  • 这部纯粹是为了验证你模型到底关没关全。
  • 但是启动要要选模型才对,所以我们ctrl+c退出下
  • 输入Ollama list ,我们先看看本地你自己下了哪些模型
  • 比如我有下,下面这2个模型
  • 1、artokun/gemma4-comfyui-mcp:12b

  • 2、qwen3:4b

  • 输入Ollama run 你对应的模型
  • 给他最小化。
  • 这样你会发现,就算命令符打开Ollama 跟桌面端打开服务没区别
  • 区别最大的是Ollama桌面端打开你选完模型要先问一句,
  • 才能触发对应模型
  • 记得cmd命令符别关!
  • 重新打开Windows PowerShell终端
  • 输入hermes chat

  • 输入:你能干啥。他会先出来一个笑脸然后在思考,
  • 然后给出以下回答就代表服务有开成功
  • 如果你太久没用他,
  • 他可能会先卸载模型,
  • 然后等你下次问在加载!
  • 你可以问他

  • 你现在已经加载gemma4-comfyui-mcp:12b 吗

然后我说下下面的进度条
⚕ gemma4-comfyui-mcp:12b │ 6.31K/65.5K │ [█░░░░░░░░░] 10% │ 21m │ ⏲ 1m 15s │ ✓ 0s
部分
含义
⚕ gemma4-comfyui-mcp:12b
当前使用的模型名称(即你正在用的 12B 模型)
6.31K/65.5K已处理的 Token 数 / 总上下文窗口大小
。6.31K 表示已经用了约 6,310 个 token,总窗口是 65,536 个 token(即 65.5K)。这意味着你的对话或任务已经占用了约 10% 的上下文容量。
[█░░░░░░░░░] 10%任务进度条
。当前整体进度为 10%,可能是一个长任务(比如复杂规划或多步骤操作)的完成度。  
21m从任务开始到现在的耗时
,这里是 21 分钟。这可能是一个持续较长的任务(比如多个工具调用、大量推理),也可能是因为模型响应慢导致的累积时间。
⏲ 1m 15s预估剩余时间
,根据当前进度和速度估算还需要约 1 分 15 秒完成。
✓ 0s最后一次操作/工具调用的耗时
,这里是 0 秒,表示刚刚完成一个快速操作(可能只是一次成功但耗时极短的调用)。
你输入/clear就可以把们清零了
  • 前面说的都是hermes chat 对话操作
  • 那么说下hermes tools 
下图回车
我翻译下如下表(不一定准确)
编号
工具名称
功能说明
1
🔍 Web Search & Scraping
联网搜索
提取网页内容(需配置 API Key)
2
🌐 Browser Automation
控制浏览器
:导航、点击、输入、滚动
3
💻 Terminal & Processes
执行终端命令
,管理进程(如 dirmkdir
4
📁 File Operations
文件操作
:读取、写入、修改、搜索文件
5
⚡ Code Execution
执行代码片段
(如 Python、JavaScript)
6
👁️ Vision / Image Analysis
分析图片内容
,识别图像中的文字或物体
7
🎬 Video Analysis
分析视频内容
(需要支持视频的模型)
8
🎨 Image Generation
生成图片
(AI 绘图,需配置 API Key)
9
🎬 Video Generation
生成视频
(文本/图像生成视频)
10
🐦 X (Twitter) Search
搜索 X(原 Twitter)
 上的公开信息
11
🔊 Text-to-Speech
文字转语音
,把文字朗读出来
12
📚 Skills
管理和使用
 Hermes 内置的 60+ 技能
13
📋 Task Planning
任务规划
,把复杂任务拆分成步骤(Todo 列表)
14
💾 Memory
跨会话记忆
,让 Hermes 记住你的偏好和历史
15
🧩 Context Engine
上下文引擎
,运行时工具管理
16
🔎 Session Search
搜索历史对话
,找回之前的聊天记录
17
❓ Clarifying Questions
主动追问
,当指令不明确时让 Hermes 向你提问澄清
18
👥 Task Delegation
任务委派
,把子任务交给其他 Agent 执行
19
⏰ Cron Jobs
定时任务
,让 Hermes 定期自动执行某些操作
20
🏠 Home Assistant
智能家居控制
(如控制灯、空调等)
21
🎵 Spotify
控制 Spotify
:播放、搜索、管理歌单
22
🤖 Yuanbao
腾讯元宝集成
:查询群组信息、成员、发送消息
23
🖱️ Computer Use
桌面操控
:后台控制鼠标、键盘,点击、输入、滚动(不干扰你正常使用)
  • 这里输入23,回车。
  • 让他控制输入设备。
  • 23会选中
  • 然后tab按一下,回车。
  • 会保存选项并重启Windows PowerShell终端
  • 一直按ctrl+c回到终端界面如下
  • 输入hermes computer-use install
  • 安装Computer Use 驱动(全程魔法)
爆了个错cua-driver installing did not complete. Re-run manually:
  • 输入下面命令运行下
  • 这个命令会从 cua-driver 的官方仓库下载并运行安装脚本

powershell -NoProfile -ExecutionPolicy Bypass -Command "irm https://raw.githubusercontent.com/trycua/cua/main/libs/cua-driver/scripts/install.ps1 | iex"
  • 然后我们关掉powershell
  • 右键以管理员身份打开

hermes chat

  • 帮我在D:\test新建一个1.txt

  • 下图他就会自动在左侧帮你新建了1个1.txt

  • 注意,跟他说操作要带上你文件夹的绝对路径

注意这里切换模型,下次不变回去的命令是
/model artokun/gemma4-comfyui-mcp:12b --global
注意,artokun/gemma4-comfyui-mcp:12b的artokun/是模型名称的一部分
比如我切 qwen3:4b
/model qwen3:4b --global
  • 切的时候
  • 记得先用Ollama选中模型发一句话激活下模型再切
  • 这也是第二种激活方法,前面一种是通过命令符,
  • 这种是通过Ollama桌面应用
  • 至于更多关于Hermes Agent的用法,
  • 感兴趣可以自己研究下