)
1. 为什么你的 Hermes Agent 装完就吃灰很多人第一次接触 Hermes Agent都是被“自进化智能体”“7×24 常驻”“多 Agent 协作”这些词吸引进来的。装完之后发现它好像也就是个能聊天的命令行工具问几句天气、写两段文案然后就没有然后了。问题不在 Hermes Agent 本身而在于你只完成了“安装”这一步没有把它放到一个能持续运行的环境里也没有给它接上稳定的模型通道更没有配置记忆和协作结构。Hermes Agent 是 Nous Research 团队开源的一个智能体框架它的定位不是“聊天窗口”而是一个可以部署在服务端、长期后台运行的自动化程序。它支持持久记忆、工作流编排、多平台对接还能通过技能系统自主迭代。换句话说你把它装在本地电脑上关机就断你把它接在一个不稳定的模型通道上跑几分钟就报错你不配置记忆架构它每次对话都像第一次见你。这三个问题不解决Hermes Agent 就永远只是个玩具。这篇内容聚焦的就是从零到一把 Hermes Agent 跑起来在 VPS 上完成部署通过 TaoToken 统一 Key 接入模型配置三层记忆架构最后跑通多 Agent 协作。每一步都会给出可复制的环境变量、配置文件片段和验证动作。你不需要有很深的 Linux 功底但需要有一台能 SSH 登录的 VPS以及一个能用的模型 API Key。先说清楚适合谁看如果你已经装过 Hermes Agent 但不知道下一步做什么或者你正准备部署但不想在模型配置上反复踩坑那这篇内容就是为你写的。如果你还没装也没关系部署部分会从 SSH 连接开始讲。整个流程实测下来从零到跑通多 Agent 协作大约需要 40 到 60 分钟主要时间花在系统更新和依赖安装上。2. TaoToken 统一 Key 接入 Hermes Agent 的模型配置方案Hermes Agent 本身不绑定任何一家模型服务商它通过配置文件读取 Base URL、API Key 和 Model ID 来调用模型。这意味着你可以把任何兼容 OpenAI 接口规范的通道接进来。TaoToken 提供的就是这样一个统一入口一个 Key 可以调用多种模型Base URL 固定不需要为每个模型单独申请账号。为什么要在 Hermes Agent 里用 TaoToken 而不是直接填某家厂商的 Key原因有三个。第一Hermes Agent 的模型架构分三层主模型负责复杂推理辅助模型负责对话压缩和摘要备用模型负责容灾切换。如果每个模型都去单独申请 Key管理成本很高。TaoToken 一个 Key 就能覆盖这三层配置时只需要改 Model ID。第二Hermes Agent 支持多凭证轮转TaoToken 的 Key 可以配合轮转策略使用额度管理更灵活。第三VPS 上的网络环境不一定能稳定直连某些模型服务TaoToken 的 API 入口在连通性上更省心。你需要提前准备的东西一台 Ubuntu 22.04 或 24.04 的 VPS最低 2 核 2G 内存20G 硬盘一个 TaoToken 的 API Key在控制台创建即可SSH 客户端Windows 用 PowerShell 或 TermiusmacOS 用终端。TaoToken 的 API 地址是https://taotoken.net/api这个地址在 Hermes Agent 的配置里会作为 Base URL 使用。注意不要在后面加/v1Hermes Agent 的 OpenAI 兼容层会自动拼接路径。API Key 的格式通常是sk-开头的一串字符在控制台的 API Keys 页面可以创建和查看。在正式配置之前建议先在本地用 curl 验证一下 Key 是否可用。打开终端执行curl -X POST https://taotoken.net/api/chat/completions \ -H Authorization: Bearer 你的TaoToken_API_Key \ -H Content-Type: application/json \ -d { model: gpt-4o-mini, messages: [{role: user, content: ping}], max_tokens: 10 }如果返回的 JSON 里有choices字段说明 Key 和通道都正常。如果返回 401说明 Key 填错了或者被禁用了如果返回local proxy failed之类的错误说明网络层有问题需要检查 VPS 的出站规则。这一步验证通过之后再去配置 Hermes Agent可以省掉很多排查时间。Hermes Agent 的模型配置支持多种方式交互式hermes setup、直接编辑配置文件、或者用hermes config set命令。推荐用配置文件方式因为可以一次性把主模型、辅助模型、备用模型都写好后面改起来也方便。配置文件的位置通常在~/.hermes/config.toml或~/hermes/hermes.conf具体取决于安装方式。下一节会给出完整的配置片段。3. VPS 部署与 Hermes Agent 可复制配置文件这一节从 SSH 连接开始一步步把 Hermes Agent 装到 VPS 上并写好模型配置。所有命令都可以直接复制执行只需要替换 IP 和 Key。第一步SSH 连接 VPS。把下面的 IP 换成你的公网地址ssh root你的VPS公网IP如果你用的是密钥登录加上-i参数指定私钥路径。连接成功后先更新系统并创建专用运行用户。不建议用 root 跑 Hermes Agent这是 Linux 运维的基本规范apt update apt upgrade -y adduser hermes usermod -aG sudo hermes su - hermes创建用户时会提示设置密码设一个强密码并保存好。切换到 hermes 用户后执行官方安装脚本curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash安装过程会拉取依赖耗时 2 到 5 分钟取决于 VPS 的网络环境。安装完成后不要急着跑hermes setup先手动创建配置文件这样模型通道可以一次性配好。Hermes Agent 的配置文件采用 TOML 格式路径是~/.hermes/config.toml。如果目录不存在先创建mkdir -p ~/.hermes nano ~/.hermes/config.toml然后把下面的配置粘贴进去替换你的TaoToken_API_Key为实际 Key[model] provider openai base_url https://taotoken.net/api api_key 你的TaoToken_API_Key model_id gpt-4o max_tokens 4096 temperature 0.7 [model.auxiliary] provider openai base_url https://taotoken.net/api api_key 你的TaoToken_API_Key model_id gpt-4o-mini max_tokens 2048 temperature 0.3 [model.fallback] provider openai base_url https://taotoken.net/api api_key 你的TaoToken_API_Key model_id claude-3-5-sonnet max_tokens 4096 [memory] backend sqlite path ~/.hermes/memory.db compression_threshold 0.5 [agent] name hermes-main workdir ~/hermes/projects这段配置里[model]是主模型负责直接对话和复杂推理[model.auxiliary]是辅助模型负责对话压缩和摘要用轻量模型控制成本[model.fallback]是备用模型主模型额度耗尽或报错时自动切换。三个模型都走 TaoToken 的同一个 Base URL只是 Model ID 不同。[memory]段配置了 SQLite 作为长期记忆后端compression_threshold 0.5表示上下文用到 50% 时触发压缩这是官方推荐的阈值。[agent]段设置了工作目录后面多 Agent 协作时会用到。保存退出后用hermes config check验证配置格式hermes config check如果输出Config OK说明 TOML 格式没问题。如果报错通常是缩进或引号问题仔细检查一下。接下来配置 Systemd 进程守护让 Hermes Agent 开机自启、崩溃自动重启。创建服务文件sudo nano /etc/systemd/system/hermes.service写入以下内容[Unit] DescriptionHermes Agent Service Afternetwork.target [Service] Typesimple Userhermes WorkingDirectory/home/hermes ExecStart/home/hermes/.local/bin/hermes run Restartalways RestartSec10 EnvironmentHERMES_CONFIG/home/hermes/.hermes/config.toml [Install] WantedBymulti-user.target注意ExecStart的路径要和你实际安装的 hermes 可执行文件路径一致可以用which hermes确认。保存后启用服务sudo systemctl daemon-reload sudo systemctl enable hermes sudo systemctl start hermes到这里VPS 部署和模型配置就完成了。下一节验证请求是否真的跑通。4. 验证模型连通性与记忆读写配置写好了不代表能跑通必须做三步验证启动日志、模型连通性、记忆读写。这三步都过了才能进入多 Agent 协作。先看启动日志sudo journalctl -u hermes -f正常启动会输出类似Hermes Agent started、Model provider: openai、Memory backend: sqlite的信息。如果看到Config file not found说明配置文件路径不对如果看到401 Unauthorized说明 TaoToken 的 Key 有问题如果看到local proxy failed或connection refused说明 VPS 出站网络有问题需要检查防火墙或 DNS。日志正常后进入交互模式测试模型连通性hermes chat在对话里输入ping如果模型返回内容说明主模型通道正常。然后测试辅助模型是否生效输入一段较长的对话观察日志里是否出现Auxiliary model invoked for compression。如果辅助模型没被调用检查[model.auxiliary]段是否配置正确。记忆读写的验证稍微复杂一点。Hermes Agent 的记忆分三层Level 1 是静态文件每次会话自动加载Level 2 是按需加载的项目记忆Level 3 是 SQLite 长期记忆。先创建 Level 1 的静态文件mkdir -p ~/.hermes/memory nano ~/.hermes/memory/SOUL.md写入# SOUL.md ## 身份 你是 Hermes Agent 主实例负责协调子 Agent 完成任务。 ## 行为准则 1. 回答简洁不编造信息。 2. 遇到不确定的内容明确说明。再创建USER.md# USER.md ## 使用偏好 - 语言中文 - 风格精简 - 时区UTC8保存后重启 Hermes Agentsudo systemctl restart hermes然后在对话里问我的使用偏好是什么如果模型回答出“中文、精简、UTC8”说明 Level 1 静态记忆加载成功。Level 3 长期记忆的验证在对话里输入请记住我的项目代号是 hermes-test部署在 VPS 上。然后退出对话重新进入问我的项目代号是什么。如果模型回答hermes-test说明 SQLite 长期记忆读写正常。如果回答不出来检查~/.hermes/memory.db文件是否存在以及[memory]段的path是否正确。这一步常见的一个坑是SQLite 文件的权限问题。如果 Hermes Agent 以 hermes 用户运行但 memory.db 是 root 创建的就会写入失败。用ls -la ~/.hermes/memory.db确认属主是 hermes。5. 多 Agent 协作配置与常见报错排查多 Agent 协作是 Hermes Agent 区别于普通对话工具的核心能力。它的实现方式是通过 Profile 拆分角色每个 Profile 有独立的记忆、人设和模型配置互相隔离。你可以创建一个 researcher 负责调研一个 writer 负责文案一个 coder 负责代码然后通过主 Agent 分发任务。创建 Profile 的命令hermes profile create researcher hermes profile create writer hermes profile create coder每个 Profile 会在~/.hermes/profiles/下生成独立目录里面有各自的config.toml和记忆文件。你可以为 researcher 配置高推理能力的模型为 writer 配置轻量模型控制成本。修改~/.hermes/profiles/researcher/config.toml[model] provider openai base_url https://taotoken.net/api api_key 你的TaoToken_API_Key model_id gpt-4o max_tokens 8192 temperature 0.5 [agent] name researcher role 负责信息检索、资料整理和事实核查writer 的配置类似但model_id可以换成gpt-4o-minitemperature调到 0.8 让文案更有变化。coder 的model_id建议用claude-3-5-sonnet代码生成更稳。配置完成后在主 Agent 的对话里测试任务分发请 researcher 调研 Hermes Agent 的记忆架构整理成三点摘要然后让 writer 把摘要改写成一段 200 字的介绍。如果配置正确主 Agent 会先调用 researcher 的 Profile 执行调研再把结果传给 writer 的 Profile 做改写。你可以在日志里看到Profile researcher invoked和Profile writer invoked的记录。这一步常见的报错有四个。第一个是401 Unauthorized说明某个 Profile 的 API Key 没填对检查~/.hermes/profiles/xxx/config.toml里的api_key。第二个是local proxy failed通常是 VPS 的 DNS 解析问题执行curl -I https://taotoken.net/api确认连通性。第三个是reading choices: unexpected end of JSON input说明模型返回了空响应可能是max_tokens设得太小或者 Model ID 写错了。第四个是OAuth token expired如果你用的是 OAuth 方式的凭证需要重新执行hermes auth login。还有一个容易忽略的问题Profile 之间的记忆隔离。如果你希望 researcher 和 writer 共享部分上下文需要在主 Agent 的AGENTS.md里配置加载规则# AGENTS.md ## 关联文档 - shared_context: ~/.hermes/memory/shared.md ## 加载规则 - 所有 Profile 启动时加载 shared_context这样每个 Profile 都能读到共享的上下文文件但各自的长期记忆仍然独立。实测下来这种“共享静态文件 独立长期记忆”的结构在多 Agent 协作里最实用。6. 把 Hermes Agent 跑成长期可用的自动化助手走到这一步你的 Hermes Agent 已经具备了三个关键能力稳定的模型通道、持久的三层记忆、可拆分角色的多 Agent 协作。接下来要做的是把它从“能跑”变成“长期可用”。第一件事是配置定时任务。Hermes Agent 支持自然语言设置定时任务不需要写 cron 表达式。在对话里输入每天早上 9 点让 researcher 汇总前一天的对话记录生成一份简报然后让 writer 改写成 300 字以内的摘要发给我。Hermes Agent 会自动解析时间、角色和任务链生成对应的调度配置。你可以在hermes dashboard的看板里看到任务状态。第二件事是配置技能系统。技能是可复用的工作流放在~/hermes/skills/目录下。每个技能是一个文件夹里面有SKILL.md定义规则可选scripts/目录放可执行脚本。比如创建一个“每日简报”技能mkdir -p ~/hermes/skills/daily-report/scripts nano ~/hermes/skills/daily-report/SKILL.md写入# 每日简报技能 ## 触发条件 用户说“生成今日简报”时触发。 ## 执行步骤 1. 读取 ~/.hermes/memory/daily.md 中的今日记录。 2. 调用 writer Profile 生成 300 字摘要。 3. 将摘要追加到 ~/hermes/projects/reports/daily.md。技能采用按需加载机制只有匹配到触发条件时才会加载不会增加日常对话的 token 开销。第三件事是安全加固。VPS 上跑长期服务必须做基础防护。禁用 SSH 密码登录编辑/etc/ssh/sshd_config把PasswordAuthentication改成no然后重启 SSH 服务。配置防火墙只开放必要端口sudo ufw allow 22 sudo ufw allow 443 sudo ufw enable如果你需要通过网页看板访问 Hermes Agent再开放对应端口。另外建议开启系统自动安全更新sudo apt install unattended-upgrades -y sudo dpkg-reconfigure --prioritylow unattended-upgrades最后把 TaoToken 的 API Key 和 Hermes Agent 的配置文件做好备份。Key 泄露的风险比 VPS 被入侵更常见建议定期在 TaoToken 控制台轮换 Key然后更新~/.hermes/config.toml和各个 Profile 的配置。如果你在配置过程中遇到模型通道的问题可以先到 TaoToken 的接入文档里对照 Base URL 和 Model ID 的写法如果 Key 需要重新生成直接在控制台的 API Keys 页面操作。多 Agent 协作跑通之后你会发现 Hermes Agent 真正好用的地方不在于单次对话有多聪明而在于它能记住你的习惯、按你的规则自动执行任务并且随着使用时间越来越贴合你的工作流。