

你是否想过,让一个 AI 助手不只是陪你聊天,而是能真正替你执行任务、管理代码、甚至自动完成工作流?Hermes Agent 零基础搭建教程 就是为此而生。今天这篇文章,我会带你从零开始,5 分钟快速上手这个个人 AI 编程助手,并把它变成一个能长期为你工作的系统。
在开始之前,可以先看一下工具的整体界面和核心使用逻辑,帮助你建立第一印象:

从上面这张图可以快速理解 Hermes Agent 的核心使用方式:它不是一个简单的聊天窗口,而是一个集成了模型、工具、消息入口和记忆的 Agent 系统。
为什么 Hermes Agent 值得你花时间搭建?
很多人对 AI Agent 的认知还停留在“高级聊天机器人”的层面。但 Hermes 的定位完全不同。它是由 Nous Research 推出的 self-improving AI agent,官方文档明确指出,它的价值不在于“装上以后能聊天”,而是把模型、工具、消息入口、记忆、技能和安全边界组织成一个可持续工作的 Agent Loop。
简单来说,Hermes 能帮你做的事包括但不限于:
- 在本地或服务器上长期运行,随时待命
- 接入 Telegram、Slack 等消息平台,通过日常聊天入口交互
- 执行文件操作、终端命令、网页搜索、浏览器自动化等任务
- 记住你的偏好和工作习惯,不断优化响应
- 通过 Skills 沉淀可复用的工作流程
如果你正在寻找一个能真正“干活”的 AI 助手,而不是又一个需要你手动复制粘贴的聊天界面,那么这篇 Hermes Agent 评测 会告诉你它到底值不值得用。
核心组成:理解 Hermes 的骨架
在动手安装前,先建立一个 mental model 非常重要。Hermes Agent 怎么用 才能发挥最大价值?关键在于理解它的几个核心组件:
| 组件 | 作用 | 你需要关注什么 |
|——|——|—————-|
| CLI / Desktop | 本机交互入口 | 能否正常启动、能否选择模型、能否运行工具 |
| Gateway | 消息平台后台进程 | Telegram/Slack/Discord 等入口是否接通 |
| AIAgent | Agent 主循环 | Prompt、模型、工具调用、压缩、重试、fallback |
| Providers | 模型供应商 | Nous Portal、OpenRouter、Anthropic、本地模型 |
| Tools | Agent 能执行的能力 | 终端、文件、浏览器、搜索、媒体、记忆 |
| Memory | 长期上下文 | MEMORY.md、USER.md 是否被合理维护 |
| Skills | 可复用知识/流程 | 操作手册、模板、工作流是否沉淀为 skill |
| MCP | 外部工具服务器 | 是否只暴露必要工具,是否审查 server manifest |
| Security | 安全边界 | approval、deny rules、隔离、密钥、日志脱敏 |
这个表格不是让你背下来,而是让你在搭建过程中随时对照:当某个环节出问题时,你知道该检查哪个组件。
搭建路线:不要一步到位
很多新手犯的第一个错误,就是试图一次性把所有功能都配好。Hermes Agent 使用教程 建议你按以下路线走:
- 本机安装 Hermes – 先跑通基础环境
- 配好一个模型 provider – 推荐从 Nous Portal 开始
- 跑通第一轮
hermes chat– 验证核心功能 - 接一个消息入口 – 例如 Telegram 或 Slack
- 打开必要工具 – 不要一口气开放所有权限
- 沉淀 memory、skills、SOUL.md – 让 Agent 真正“认识你”
- 再考虑 MCP、cron、VPS、Docker – 进阶部署
这个顺序的好处是:每一步都有明确验收点。出了问题时,你知道是安装、模型、工具、消息入口还是权限边界出了问题。
安装方式选择:根据你的环境对号入座
macOS / Windows:优先 Desktop installer
如果你只是想最快跑起来,官方推荐使用 Hermes Desktop installer。安装器会帮你处理命令行和桌面应用,适合:
- 不想先处理 Python/Node/ffmpeg/ripgrep 依赖
- 想用桌面端管理会话
- 在 Windows 上希望少折腾 PATH 和 shell 环境
- 第一次体验 Hermes
Linux / macOS / WSL2 / Termux:命令行安装
PR0
Windows 原生 PowerShell:命令行安装
PR1
⚠️ 安全提醒:curl | bash 或 iex (irm ...) 都是“从网络下载脚本并执行”。更稳的做法是:
- 确认来源是 Hermes 官方域名
- 先在测试环境运行
- 有安全要求时先下载脚本,人工检查关键逻辑
- 不要在有生产密钥、客户数据、重要私钥的机器上直接试错
安装结束后,先开一个新终端,再检查:
PR2
如果 hermes 命令找不到,通常是 PATH 没刷新、终端没重开、Windows shell 环境没有加载新变量。
最快跑通:hermes setup --portal
官方 Quickstart 推荐第一次配置直接走:
PR3
这个命令会做几件事:
- 打开浏览器完成 Nous Portal OAuth 登录
- 把 refresh token 存到
~/.hermes/auth.json - 把模型 provider 设置为 Nous
- 选择默认 agentic model
- 打开 Tool Gateway,用于 web search、image generation、TTS、browser automation 等工具路由
验证命令:
PR4
你可以在首次对话里让 Hermes 做一个轻量任务,例如:
> 请搜索 Hermes Agent release notes,并总结最近三个变化点。
这个任务能同时验证:模型是否能正常响应、web search 工具是否通、Tool Gateway 是否配置成功、Hermes 是否能把工具结果整合成答案。
配置目录:理解 ~/.hermes/
Hermes 的配置核心在 ~/.hermes/。典型结构如下:
PR5
最重要的规则:Secrets 放 .env,普通配置放 config.yaml。不要把 API key、bot token、数据库密码写进 Markdown、Git 仓库或公开 issue。
模型与工具配置:从最小集开始
模型 provider
Hermes 支持多种 provider:Nous Portal、OpenRouter、Anthropic、OpenAI-compatible endpoint、本地模型等。使用 Nous Portal 时,hermes setup --portal 会同时完成 provider 和 Tool Gateway 配置。
常用命令:
PR6
进入 chat session 后可以使用:
PR7
经验之谈:做 Agent 工作不要只看模型“聊天能力”,还要看 tool calling 是否稳定、长上下文是否可靠、输出是否可控、价格和延迟是否可接受。
Tools 与 Toolsets
Hermes 的 Tools 是 Agent 能执行的函数,按 toolsets 组织。搭建初期建议:
- 先启用最小工具集
- 先跑只读或低风险工具
- 终端工具保持审批
- 文件写入、删除、shell 命令、浏览器自动化都要留边界
- 确认每个工具失败时怎么观察日志
不要一开始就把所有工具全开。
消息网关:让 Hermes 进入你的日常入口
Hermes 的 Gateway 是后台进程,负责把 Telegram、Discord、Slack、WhatsApp、Signal、SMS、Email、Home Assistant、DingTalk、Feishu/Lark、WeCom、Weixin 等入口接到 Hermes 会话上。
推荐第一站:Telegram 或 Slack
原因:配置路径相对清晰、Bot 模型成熟、适合个人或小团队验证、日志和权限更容易理解。
⚠️ 重要提醒:Telegram bot 默认 privacy mode 开启,在群组里只能看到 / 命令、回复 bot 的消息、服务消息、bot 管理的频道消息等;关闭 privacy mode 后才能看到群内所有消息。不要为了“方便”随便关闭隐私模式,除非你明确知道 bot 会看到什么、记录什么、回复什么。
Gateway 常见运维方式
先手动跑:
PR8
再考虑常驻:
- macOS:launchd
- Linux / VPS:systemd、tmux、nohup
- Windows:Task Scheduler 或 WSL 启动任务
- Docker:容器 supervisor
Memory、Skills 与 SOUL.md:真正拉开长期差异的部分
Memory:有限、整理过的长期记忆
Hermes 的 memory 不是“无限聊天记录”。它更接近 bounded curated memory。MEMORY.md 和 USER.md 位于 ~/.hermes/memories/,会在会话开始时注入系统提示。
这意味着:
- 记忆应该是整理后的事实和偏好
- 不应该把所有聊天原文都塞进去
- 未验证猜测不应该混进事实源
- 记忆有容量和质量管理问题
- 记忆更新需要定期清理、修正和过期处理
SOUL.md:Agent 的身份与行为边界
SOUL.md 是 Hermes 的主身份设定。建议 SOUL.md 里不要写过度抽象的“你是最强 AI”。更实用的是:
- 你服务谁
- 你默认怎么沟通
- 你不应该做什么
- 哪些动作必须确认
- 哪些信息不能外发
- 哪些输出需要附带证据
- 哪些任务要先问清楚
Skills:把流程变成可复用能力
Skills 是按需加载的知识文档,遵循 progressive disclosure,减少 token 使用。适合做成 skill 的内容:
- 客户研究流程
- PR review 标准
- 外贸邮件模板
- 数据清洗步骤
- 竞品分析框架
- 项目复盘模板
- 团队安全边界
- 特定软件/平台操作手册
判断标准:如果一个流程你会反复解释给 Agent,就应该考虑把它沉淀成 skill。
MCP:把外部工具接进 Hermes,但不要“全接”
MCP 是 Model Context Protocol。Hermes 的 MCP 文档说明,它可以让 Hermes 连接外部工具服务器,例如 GitHub、数据库、文件系统、浏览器栈、内部 API 等。
MCP 的正确心智模型:Hermes 仍然是 agent,MCP server 只是贡献工具。你要控制每个 server 暴露多少工具面。
不要这样做:
- 一次性接所有 MCP
- 给数据库读写全权限
- 把生产 API 暴露给未隔离 agent
- 不看 manifest 和 bootstrap 命令
- 让 agent 自己决定是否能访问敏感系统
更稳的做法:
- 从只读工具开始
- 只暴露一个 server 的少量工具
- 给工具命名清楚
- 为写操作保留人工审批
- 记录 MCP server 来源和版本
- 定期审查工具列表
- 禁用不需要的 resource/prompt utility wrappers
安全基线:不要把 Agent 当成普通聊天窗口
Approval mode:默认保守
新手阶段使用 manual,熟悉后可以逐步使用 smart,不要轻易使用 off 或 YOLO。高风险命令不要永久 allow,团队环境应写清楚审批规则。
Deny rules:即使 YOLO 也要有硬边界
可以考虑阻止:
- force push
- 递归删除
- 格式化磁盘
- 删除密钥目录
- 直接推生产
- 下载脚本后直接 pipe 到 shell
- 数据库 destructive operation
- 未经确认的外部发送脚本
终端 backend:生产环境优先隔离
| 场景 | 推荐后端 |
|——|———-|
| 个人本机试用 | local,但保持审批 |
| 代码实验/不可信命令 | docker |
| 云端长期运行 | VPS + docker 或受控 ssh |
| 高风险数据/生产资源 | 不建议直接给 agent 访问,先做只读和隔离 |
Dashboard 不要随便暴露到公网
hermes dashboard 默认在 127.0.0.1:9119 启动;--insecure 会允许绑定非 localhost,并明确标为危险。远程访问优先 SSH tunnel。
从个人可用到团队可用
个人可用最低要求
- 本机安装成功
- 模型可用
- CLI 可用
- 一个消息平台可用
- 基础工具可用
- manual approval
.env不进 Git- memory 不乱写
团队可用额外要求
- 统一 profiles 或配置模板
- 明确哪些工具允许使用
- 明确哪些数据不能进 agent
- 明确哪些外发动作必须人工确认
- Gateway 日志可观测
- 定时任务可暂停和审计
- skills 有版本管理
- MCP server 有来源审查
- 更新前有备份和回滚
团队化最容易出问题的不是安装,而是权限和责任:Agent 一旦能替团队做事,就必须知道它不能替团队决定什么。
最小可行搭建方案
如果你希望少走弯路,可以按这个 MVP 执行:
- 本机跑通:安装 Hermes → 配好 provider →
hermes chat正常 →hermes doctor不报关键错误 - 接一个消息入口:选择 Telegram 或 Slack → 配 bot token → 启动 gateway → 测试私聊或受控群组
- 打开必要工具:明确需要哪些 toolsets → 终端工具保持 manual approval → 禁止危险命令 → 只给当前项目目录访问
- 沉淀 Memory / Skills:写好 SOUL.md → 维护 USER.md 和 MEMORY.md → 把一个重复流程做成 skill
- 接 MCP 或上 VPS:只接一个 MCP → 只暴露少量必要工具 → 或把 gateway 迁到 VPS / Docker
常见问题排查
hermes: command not found
可能原因:安装未完成、PATH 没刷新、Windows 需要重开终端。先运行 hermes doctor。
模型没有响应
检查:provider 是否配置、.env 或 OAuth 是否有效、hermes portal info 是否正常、网络是否可访问 provider。
Tool Gateway 不工作
检查:是否通过 hermes setup --portal 启用、工具 routing 是否显示 through Nous Portal、是否缺依赖。
消息平台收不到消息
检查:bot token 是否正确、gateway 是否在运行、Telegram privacy mode 是否符合预期。
Agent 一直要求审批
这不一定是坏事。先确认当前是否 manual mode、命令是否真的危险、是否应该用 session 而不是 always。
Dashboard 能不能远程开
可以,但不建议裸开。远程管理优先用 SSH tunnel。
一张总检查表
| 阶段 | 检查项 |
|——|——–|
| 安装 | hermes --help、hermes doctor 可运行 |
| Provider | hermes setup --portal 或 hermes model 配置成功 |
| 首聊 | hermes chat 能正常响应 |
| 工具 | web/search/browser/terminal 按需启用 |
| 配置 | secret 在 .env,普通配置在 config.yaml |
| 消息 | gateway 可运行,一个平台先跑通 |
| 安全 | approval manual/smart,危险命令不自动放行 |
| 隔离 | 高风险任务用 docker/ssh/cloud backend |
| 记忆 | MEMORY.md、USER.md 不乱写,不污染事实源 |
| 技能 | 重复流程沉淀为 skill |
| MCP | 只接必要 server,只暴露必要工具 |
| 运维 | logs、backup、update、rollback 有路径 |
结语:搭建 Hermes 的重点不是“装上”,而是形成闭环
Hermes Agent 零基础搭建教程 到这里就结束了。你可以很快完成安装,但真正决定它是否好用的,不是安装命令,而是你有没有把这些部分设计成闭环:
- 一个稳定入口
- 一个适合 agentic 工作的模型
- 一组最小但够用的工具
- 一套可维护的记忆与技能
- 一个可审计的消息网关
- 一条明确的安全边界
- 一个能持续运行、能排错、能回滚的部署方式
如果只是把 Hermes 当聊天窗口,它的价值会被低估。如果把它当成“入口 + 工具 + 记忆 + 技能 + 安全边界”的系统来搭,它才会真正变成一个能长期工作的 Agent。
随着 AI 编程工具越来越多,选择也变得越来越复杂。如果你正在筛选类似工具,可以参考「
」进行系统对比。



