Hermes Agent 入门教程:从安装到拥有一个真正会干活的 AI Agent
Hermes Agent 入门教程:从安装到拥有一个真正会干活的 AI Agent
最近 AI Agent 项目越来越多,但不少所谓的 Agent,本质上还是“聊天机器人 + 几个工具调用”。
Hermes Agent 则更接近一个真正可以长期运行在电脑或服务器上的 AI 助手:它不仅能和你聊天,还可以操作文件、运行 Shell 命令、搜索网页、调用浏览器、保存长期记忆、学习新的 Skill,甚至接入 Telegram、Discord 等聊天平台长期运行。
Hermes Agent 由 Nous Research 开发,官方将其定位为一个能够随着使用不断积累经验的自我改进 Agent。它的一个核心设计思路是把“事实性记忆”和“做事情的方法”分别保存下来,让 Agent 不只是记住你说过什么,还能逐渐学会你平时是怎么做事情的。
本文就从零开始搭建一个 Hermes Agent。
本文内容基于 2026 年 9 月版本的 Hermes Agent。项目目前更新速度很快,如果未来命令发生变化,建议同时参考官方文档。
一、Hermes Agent 到底是什么?
普通的大模型 API 使用方式大概是:
你
↓
LLM
↓
回答
而 Hermes 更像:
你
↓
Hermes Agent
↓
LLM
↓
判断需要做什么
├── 搜索网页
├── 操作文件
├── 执行 Shell
├── 调用浏览器
├── 查询历史会话
├── 调用 Skill
├── 读取 Memory
└── 调用其他工具
↓
继续推理
↓
完成任务
因此你可以直接告诉它:
检查一下这个项目为什么启动失败,把问题修掉。
Hermes 可以自己查看文件、执行命令、读取日志,然后根据结果继续处理,而不是每执行一步都让你手动把结果复制给 AI。
官方目前提供的工具已经覆盖网页搜索、浏览器自动化、终端执行、文件编辑、长期记忆、任务委托、消息发送等多个方向。
这也是 Hermes 和普通聊天机器人最大的区别。
二、安装 Hermes
Hermes 目前支持 Linux、macOS、Windows、WSL2,以及 Android Termux。
如果准备长期运行,我个人更推荐:
Debian / Ubuntu Server
如果只是自己电脑体验,Windows 也已经可以直接使用原生版本,不再必须依赖 WSL2。官方 Windows 安装程序还会自动准备 Python、Node.js、Git Bash、ffmpeg 等依赖。
Linux / macOS / WSL2
执行:
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
安装完成后重新加载 Shell:
source ~/.bashrc
如果使用 zsh:
source ~/.zshrc
然后测试:
hermes
Hermes 的安装程序会创建一个受管理的运行环境,默认数据主要保存在:
~/.hermes/
官方现在推荐使用安装脚本管理 Hermes,而不是自己使用 pip install hermes-agent 拼环境。
Windows 原生安装
打开 PowerShell:
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
安装完成后重新打开 PowerShell,然后:
hermes
即可启动。
如果你以前看到一些教程写着“Windows 必须安装 WSL2”,那基本属于旧版资料。现在官方已经提供原生 Windows 安装方式。
三、第一次配置 Hermes
安装只是第一步。
Hermes 本身并不是一个大模型,所以还需要给它配置一个 LLM Provider。
最简单的方法:
hermes setup
或者直接进入模型配置:
hermes model
Hermes 当前支持很多 Provider,包括 Nous Portal、OpenRouter、Anthropic、OpenAI Codex、GitHub Copilot、DeepSeek、Kimi、MiniMax,以及自定义 OpenAI Compatible API。
如果只是第一次体验,使用交互式:
hermes model
跟着界面选择即可,不建议一开始手动修改 YAML。
四、使用 Nous Portal
官方目前最推荐的是 Nous Portal。
直接执行:
hermes setup --portal
它会启动浏览器 OAuth 登录,然后自动配置 Provider、模型以及 Hermes Tool Gateway。
Nous Portal 的优势在于一个账户可以访问大量不同模型,不需要分别管理 Claude、GPT、Gemini、DeepSeek 等厂商的 API Key。官方目前称其提供超过 300 个模型。
配置完成之后可以查看状态:
hermes portal info
然后:
hermes
或者:
hermes chat
就可以正式开始使用了。
五、使用 OpenRouter
如果本来就有 OpenRouter API,也非常适合 Hermes。
首先:
hermes model
选择:
OpenRouter
然后输入 API Key 和模型。
也可以通过:
hermes config set OPENROUTER_API_KEY sk-or-xxxxxxxx
保存 Key。
Hermes 会自动把 API Key 之类的敏感信息放到:
~/.hermes/.env
而普通设置则保存在:
~/.hermes/config.yaml
所以一般不需要自己维护一堆环境变量。
六、接入自己的 API 或本地模型
这一点我觉得是 Hermes 非常实用的地方。
它可以连接任何兼容 OpenAI /v1/chat/completions 接口的服务。
例如你有:
vLLM
llama.cpp
Ollama
自建 API
API 中转
LiteLLM
其他 OpenAI Compatible API
都可以尝试接进去。
运行:
hermes model
然后选择类似:
Custom endpoint
输入:
API Base URL
API Key
Model Name
即可。
比如一个本地接口:
http://127.0.0.1:8000/v1
Hermes 官方现在要求用于 Agent 的模型至少拥有 64K Token 上下文窗口。如果使用本地模型,需要注意把 Context Length 调到至少 65536,否则 Hermes 可能直接拒绝启动该模型。
这是很多第一次接本地模型的人比较容易踩的坑。
七、开始第一次对话
最简单:
hermes
进入交互模式。
然后可以像普通 AI 一样聊天:
你好,介绍一下你现在有哪些能力。
但如果只是这样用,其实浪费了 Hermes。
可以试试:
帮我检查一下当前服务器的磁盘、内存和 CPU 使用情况。
或者:
看看当前目录是什么项目,告诉我这个项目应该怎么启动。
再例如:
检查最近的日志,看看有没有异常。
此时 Hermes 就可能主动使用 Terminal、文件读取等工具完成任务。
如果只想执行一次询问,不进入交互模式,也可以:
hermes chat -q "检查一下当前机器的系统信息"
Hermes CLI 还支持多行编辑、历史记录、工具执行流式显示以及中途打断 Agent 等功能。
八、Tools:让 Hermes 真正拥有“手脚”
模型只是 Hermes 的“大脑”。
Tools 才是它的“手脚”。
查看工具:
hermes tools
也可以:
hermes tools list
Hermes 当前可以提供终端、文件、网页、浏览器、Memory、Skills 等大量工具。
例如开启 Terminal 后,你告诉它:
帮我安装 nginx。
它就可能自己执行:
apt update
apt install nginx
再检查:
systemctl status nginx
然后根据结果继续处理。
所以把 Hermes 部署到 VPS 上之后,它实际上已经非常接近一个:
AI Linux 运维助手
而不仅仅是聊天机器人。
九、一定要注意 Terminal 权限
这里必须专门提醒一下。
如果 Hermes 的 Terminal Backend 直接使用本机 Shell,那么理论上模型能够执行当前用户有权限执行的命令。
所以不要在完全不受控的环境中直接给 Agent:
root + unrestricted shell
尤其是服务器里还有重要数据的时候。
Hermes 官方支持把 Terminal Backend 放进 Docker:
hermes config set terminal.backend docker
或者让 Hermes 通过 SSH 操作单独的机器:
hermes config set terminal.backend ssh
这样就可以把 Agent 的操作范围隔离出来。
正式使用时,我比较推荐:
AI Agent
↓
Docker / 独立虚拟机
↓
再通过受限方式访问生产环境
而不是直接给 Agent 一台重要服务器的 root Shell。
十、Hermes 最有意思的功能:Memory
如果每次打开 AI,它都像失忆了一样,那么再强的 Agent 用久了也会比较麻烦。
Hermes 内置了跨会话 Memory。
例如你可以告诉它:
记住,我所有 Docker 项目默认放在 /opt/docker。
或者:
记住,我的服务器主要使用 Debian。
下一次重新打开 Hermes,这些信息仍然可以被使用。
Hermes 的内置记忆主要保存在:
~/.hermes/memories/
其中包含类似:
MEMORY.md
USER.md
的内容。
可以简单理解成:
Memory = 记住“是什么”
比如:
我的服务器使用 Debian
项目目录在 /opt/app
我喜欢使用 Docker Compose
这些都适合 Memory。
十一、Skills:让 Hermes 记住“怎么做”
Skills 是我认为 Hermes 最值得玩的功能之一。
如果说:
Memory = 事实
那么:
Skill = 方法
例如你让 Hermes 完成了一套部署流程:
拉取 Git
↓
安装依赖
↓
构建 Docker 镜像
↓
更新 Compose
↓
启动容器
↓
检查健康状态
以后你可以告诉它:
把刚才这一套部署方式保存成一个 Skill。
以后遇到类似任务时,它就可以重新加载这套流程,而不需要每次重新摸索。
官方给出的经验也很直观:
Memory 用来记录“是什么”,Skill 用来记录“怎么做”。
查看已经安装的 Skill:
hermes skills list
搜索 Skill:
hermes skills search docker
查看一个 Skill:
hermes skills inspect <skill>
安装 Skill:
hermes skills install <skill>
也可以在聊天中输入:
/skills
查看当前可用 Skills。
这套机制也是 Hermes 所谓“越用越懂你”的基础之一。
因为真正有价值的并不只是:
AI 记得你叫什么。
而是:
AI 知道你平时是怎么干活的。
十二、配置文件在哪里?
Hermes 的核心数据基本都集中在:
~/.hermes/
典型结构大概是:
~/.hermes/
├── config.yaml
├── .env
├── auth.json
├── SOUL.md
├── memories/
├── skills/
├── cron/
├── sessions/
└── logs/
其中 config.yaml 保存模型、Terminal、Memory 等普通配置,.env 保存 API Key 和密码等敏感信息,SOUL.md 与 Agent 自身的人格和行为设定有关,而 memories、skills、sessions、logs 则分别保存记忆、技能、会话和日志。
查看当前配置:
hermes config
修改配置:
hermes config edit
设置某个配置:
hermes config set KEY VALUE
检查配置:
hermes config check
因此正常情况下,并不建议新手直接拿编辑器乱改 config.yaml。
十三、把 Hermes 变成 Telegram / Discord Bot
当 CLI 已经稳定运行之后,就可以进入 Hermes 更有意思的玩法:
常驻 AI Agent
运行:
hermes gateway setup
Hermes 会进入消息平台配置流程。
目前 Gateway 可以接入 Telegram、Discord、Slack、WhatsApp、Signal、Email、Home Assistant、Microsoft Teams 等平台。
配置完成后:
hermes gateway start
这样 Hermes 就可以长期运行在服务器上。
你人在外面,只需要通过 Telegram 给它发:
看看服务器现在 CPU 为什么这么高。
Hermes 就可以在服务器上检查进程、查看日志,然后把结果发送回来。
这时候 Hermes 才真正开始从一个:
CLI AI 工具
变成:
7×24 小时在线的个人 AI Agent。
不过 Gateway 一定要配置访问控制。官方提供白名单、私聊配对以及开放访问等模式,而生产环境并不建议直接设置成任何人都能使用,否则别人可能间接获得 Agent 的工具调用能力。
十四、新手推荐的学习顺序
第一次使用 Hermes,不建议一上来把所有功能全部打开。
比较合理的路线是:
- 安装 Hermes → 配置一个模型 → 确保普通聊天正常 → 测试文件和 Terminal 工具 → 开始使用 Memory → 学习 Skills → 再配置 Gateway → 最后研究 Cron、MCP、多 Agent、浏览器自动化以及自定义 Skill。
原因很简单:
如果最基础的模型调用都没有配置好,却同时加入 Telegram、Cron、十几个 Tool 和多个 Provider,出问题之后会很难判断究竟是哪一层的问题。
Hermes 官方自己的 Quickstart 也建议先确保一次普通对话完整跑通,再逐步开启 Gateway、Cron、Skills、Voice 和路由等高级功能。
十五、常用排障命令
如果 Hermes 出现奇怪问题,可以先运行:
hermes doctor
再检查配置:
hermes config check
查看整体状态:
hermes status --all
Gateway 有问题则重点检查:
~/.hermes/logs/gateway.log
普通错误日志主要位于:
~/.hermes/logs/
如果刚刚升级了 Hermes,配置结构发生变化,还可以运行:
hermes config migrate
让 Hermes 帮助补充新版缺少的配置项。
十六、Hermes 适合拿来干什么?
如果只是为了:
问 AI 几个问题
其实完全没有必要部署 Hermes。
ChatGPT、Claude 或普通 API Client 已经足够。
Hermes 真正适合的是:
需要 AI 实际操作环境
+
需要长期运行
+
任务具有重复性
+
希望 AI 记住环境和工作方式
例如服务器维护、代码项目维护、自动化任务、信息收集、Bot 助手、家庭服务器管理,以及个人长期 AI 助手,这些场景都比较适合 Hermes。
它真正有意思的地方,并不是“又多了一个 AI 对话框”。
而是:
第一次:
你教 AI 怎么做。
↓
第二次:
AI 知道该怎么做。
↓
使用时间越来越长:
AI 开始理解你的服务器、
项目结构、
操作习惯和工作流程。
这才是 Hermes 的核心价值。
十七、总结
Hermes Agent 可以简单理解成:
LLM
+
Tools
+
Terminal
+
Memory
+
Skills
+
Gateway
+
Automation
最终组成一个能够长期运行、操作真实环境,并且随着使用逐渐积累经验的 AI Agent。
如果只是第一次体验,我建议先做到下面这个程度:
# 安装
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# 配置
hermes setup
# 选择模型
hermes model
# 启动
hermes
然后尝试告诉它:
检查一下这台机器的系统环境,
告诉我你目前能够帮我做些什么。
等基础交互稳定之后,再去折腾:
Memory
Skills
Telegram / Discord Gateway
Cron
MCP
Browser
Docker Sandbox
到这个阶段,Hermes 的可玩性就会开始明显提高。
如果你有一台长期在线的 VPS,也非常推荐把 Hermes 单独部署进去体验一下。
相比单纯在网页里和 AI 对话,一个能够真正读取环境、执行任务、学习工作流程,并且长期在线的 Agent,会带来完全不同的使用体验。
参考资料
Hermes Agent 官方文档:安装、Quickstart、配置、Provider、Tools、Skills、Memory 与 Gateway。
Hermes Agent GitHub 项目。
- 点赞
- 收藏
- 关注作者
评论(0)