Hermes Agent 完全指南:从工具到 AI 助理「实战篇」

图像

这篇文章,就想跟大家聊聊这两个月用 Hermes 的心得,以及我是如何将它从一个工具变成我的 AI 私人助理。

从 4 月初开始用 Hermes Agent,到 4 月 8 号写下第一篇 Hermes 入门文章,到今天已经两个多月。
回头看这两个月,感触还挺多的。

最早安装它的时候,其实没抱太大期待,抱着玩玩的态度,觉得不过是个开源框架,大概率和小龙虾差不多。

而且当时驱使我安装的动力,最主要是听官方宣传特别省 token,就抱着随便体验一下的心态装上了。

结果用下来才发现,这玩意儿是真有点东西。
它能帮我处理的事情比想象中多得多,用着用着就冒出一个念头:这不就是我的贾维斯吗?

慢慢地,它真的成了我自己的私人助理。

废话不多说了,直接带大家复盘下这两个月心路历程,希望对大家有所启发。

1. 安装方式

Hermes 和普通聊天工具不太一样。

Hermes 是一个能常驻在你环境里的 Agent

你给它安排好任务,它立马会自己规划执行,并且在事情做完之后,它还会主动沉淀成可复用的技能,积攒经验,下次遇到类似任务就处理得游刃有余。

它的安装方式分两种:

  1. 本地安装
  2. 服务器部署🔥

我一开始就部署在服务器上,原因很简单👇🏻:

Hermes 这种需要长期在线、随时待命的 Agent,装在自己电脑上那就只是一个本地玩具,完全发挥不了它的作用。

我的想法很明确,就是要把它打造成一个真正 7×24 小时随时待命的「贾维斯」,所以直接选择部署在 VPS 上。

然后在选择 VPS 的时候,我结合官方文档做了一些调研:

根据不同的使用场景,Hermes Agent 对 VPS 的配置需求大概可以分为三档。

1. 基础配置(适合个人学习、测试、单机器人挂载)

  • CPU:1 核(共享 CPU 即可)
  • 内存:1 GB - 2 GB
  • 硬盘:10 GB - 20 GB
  • 带宽:1 Mbps - 5 Mbps

2. 进阶配置(适合多代理运行、挂载 Telegram/Discord 商业机器人、轻量向量库)

  • CPU:2 核
  • 内存:4 GB
  • 硬盘:40 GB 以上(建议 SSD/NVMe,加快本地记忆检索速度)
  • 带宽:10 Mbps 以上

3. 高级配置(只有当你想在 VPS 上部署开源大模型时才需要)
如果不想用外部 API,打算用 Ollama 在 VPS 上部署本地大模型时,配置就得大幅升级:

  • CPU:4 核 ~ 8 核
  • 内存:16 GB ~ 32 GB(用于 CPU 强行推理大模型)
  • 显卡(可选):想要丝滑的速度,需要带显存(VRAM)在 8GB 以上的 GPU 服务器

我自己的场景主要是跑资讯简报、服务器监控以及一些定时任务。

所以选的是 2 核 4G 内存、60G 存储的配置。

跑了两个月,目前来看完全够用,没遇到过卡顿或者资源吃紧的情况。

此处发散:我越来越觉得 VPS 在 AI 时代其实是很保值的东西。

以前 VPS 可能只是用来建站、挂脚本、跑服务;但现在有了各种 Agent 之后,它更像是一个属于自己的云端工作台

只要有一台长期在线、网络稳定、权限可控的机器,很多自动化任务就可以真正跑起来。

年轻人现在真的应该人手至少备一台 VPS。
尤其是配置合适、线路稳定、价格还能接受的机器,后面只会越来越难抢。

不,现在已经很难抢了😅

🚨由于 VPS 没有招到赞助商,所以此处不做推荐,大家自行选择,量力而行即可。

2. 部署流程

下面是我当时的大致流程,简要叙述下,具体可以看下入门文章。

4 月 8 日

先 SSH 登录服务器:

ssh root@YOUR_IP

第一次登录之后,先把默认密码改掉,再装一些基础工具:

passwd
apt update && apt upgrade -y
apt install -y curl wget git vim tmux build-essential python3-pip unzip htop ufw

这里建议多注意一下服务器安全。

Hermes 不是一个跑完就结束的脚本,而是一个长期在线、可以自主执行任务的 Agent。
它一旦部署在 VPS 上,就相当于有了一个长期暴露在公网环境里的执行入口,所以基础安全不要省。

我建议至少做几件事:

修改默认 SSH 端口

默认 22 端口长期暴露在公网,很容易被各种扫描器扫到。
你可以把 SSH 端口改成一个不常见的端口,并在防火墙里放行新的端口。

如果你已经修改了 SSH 端口,下面这句里的 YOUR_SSH_PORT 记得换成你自己的端口:

ufw allow YOUR_SSH_PORT/tcp
ufw enable
ufw status

⚠️ 这里有个坑:启用防火墙之前,一定要确认新的 SSH 端口已经放行,并且最好不要立刻关闭当前 SSH 窗口。
先新开一个终端测试能不能连上,确认没问题之后再断开旧连接,不然很容易把自己锁在服务器外面。

尽量使用 SSH Key 登录

如果是长期使用的服务器,建议后续配置 SSH Key 登录,并关闭 root 密码登录。
这样比单纯改密码安全得多。

一键脚本执行前确认来源

Hermes 官方提供了一键安装脚本:

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

这类 curl | bash 的命令用起来很方便,但最好确认一下来源是官方地址,不要随手复制来路不明的安装脚本。

脚本跑完之后会进入初始化引导,注意两点:

第一,能注册成系统服务就注册。
引导里如果问你是否作为 service 运行,直接选 Y
这样服务器重启之后 Hermes 会自动起来,不需要你手动再进一次命令行。

第二,装完之后跑一遍自检:

hermes doctor

如果关键项都是绿色,基本就可以开始用了。

3. 模型选择

Hermes 本质是一个 Agent,只是一个躯壳。

要真正把活干好,还得看灵魂:模型!!!

我现在自己手上常用的模型和订阅比较多,大概有这么几类:

ChatGPT / Codex

这个是我目前用得最多的,尤其是和 Codex 相关的 Coding Agent 场景。

如果本地之前已经登录过 Codex,Hermes 初始化的时候会自动检测并复用已有授权。
全新环境也可以按引导重新授权,流程比较简单。

如果你手头还没有 ChatGPT Plus 订阅,可以参考下面教程:

5 月 3 日

Claude

Claude 更适合处理长文本、复杂推理、代码理解和一些需要稳定输出质量的任务。
Opus 4.6 写作不错,其他和 GPT 其实不相上下。

⚠️不过这里有个小坑:Hermes 原生并不能直接接入 Claude 订阅,通常需要走 API 或兼容接口。

X Premium

X Premium 的 grok 4.3 的优势主要在 X 相关场景。

比如看热点、追踪 X 上的讨论、理解一些实时信息流,Grok 会比较顺手。
毕竟它和 X 的结合更深,拿来辅助做 X 内容观察和灵感记录,体验还不错。

此处再次致谢马老板!🫡

5 月 17 日

DeepSeek

国货之光,很多日常任务、文本类、信息整理任务,用 DeepSeek 完全够用。
尤其是一些不需要顶级模型但需要高频调用的场景,它会是一个很好的补充。

小米

国货之光 Top3,雷布斯相当慷慨,实测 Python 编码能力一流。

有些轻量任务没必要每次都上最贵的模型,能用就行。
长期跑 Agent 的时候,多准备几个模型通道,本身也是一种容错。

所以我现在的思路不是只押一个模型,而是根据任务类型来分工:写代码、长文本、资讯整理、X 信息流、中文轻量任务,各用各更擅长的模型。

具体见官方文档:👉🏻官方文档传送

图像

🚀【划重点】ChatGPT 模型怎么接入最划算

ChatGPT / Codex 是目前 Hermes 的主力模型,模型能力强,支持多模态,搭配辅助模型干活,完美!!

ChatGPT 接入目前主要有以下途径:

方式一:官方订阅,首选

能官方订阅就官方订阅,Codex 授权流程最顺,模型也是完整体。
卡在支付环节的,可以看我前面提过的教程,目前比较稳,不过需要有一定的动手能力。

方式二:API 接入,图省事的选择

如果是手残党,不想折腾订阅,或者你和我一样,平时靠 Codex、Claude Code、OpenCode 这类 Coding Agent 干活,Plus 额度不够的话,还可以找个靠谱的 API 接入(国内一大特色😄)

正好这两天看到阮一峰老师在 X 上推荐了一个 API 中转,我好奇心比较重,喜欢尝试新鲜事物,顺手花 9 块 9 开了个新人体验包。

对,你没看错,9 块 9,买不了吃亏,买不了上当,30 天,150 美元额度。

这个定价明显就是让你来薅的,那这波羊毛就别客气了。

5 月 29 日

问问大家,你是用 Codex 还是 Claude Code?我看很多人最近跳船,选择 Codex,评价还不错。Codex 官方套餐最低 20 美元/月,现在有个试用机会,只要 9.9 元人民币(相当于 150 美元的 API 月度使用量)。

感兴趣的推友可以自己进去试试!

传送门👉🏻:点我一键直达🚀

🔥总之一句话:长期跑 Agent,不只是选哪个模型好用,也要考虑接入方式和调用成本。

4. 日常场景:它每天帮我做什么

目前主要有以下用途:

  1. AI 资讯抓取
  2. X 粉丝增长监控
  3. 服务器性能监控
  4. 订阅提醒
  5. AI Agent 版本检查(Codex / Claude Code / Agy / Hermes 等等)
  6. 待办事项提醒
  7. X 灵感记录
  8. X 创作者收入统计(如果你有 2000 粉,还可以加入平台:💰点击加入,共同富裕💪🏻)
  9. 程序员鼓励师 or 贴心女友(单身🐶必备)

图像

这里挑几个场景简单展开一下。

AI 资讯抓取

我给 Hermes 安排了一个固定任务:每天定时抓取我关注的信息源,然后把内容整理成一份简报。

目前这份 AI 早/晚/周报的信息源一共 6 个,思路是英文媒体、社区热度、中文媒体、论文各占一块,互相补盲:

这份简报一般会分成几类:

  • 今天值得关注的新模型 / 新工具
  • GitHub 上比较有意思的项目
  • X 上讨论度比较高的 AI 动态
  • 值得后续单独研究的文章或教程

AI 资讯

X 粉丝增长监控

主要通过 X Premium 的 grok 内置工具抓取粉丝数,快速了解粉丝增长情况,后续计划接入帖子流量监控,分析爆款因素,后续有进展再同步给大家。

🚀🚀🚀如果你们对哪个有兴趣,想知道具体实现细节,评论区留言!!!

更多玩法有待挖掘,未完待续…

5. 两个月复盘:它到底值不值得折腾?

先说结论:超值!

当然有个前提。
如果只把 Hermes 当成一个新鲜玩具,它可有可无;但如果你本来就有一些固定重复的工作,比如每天看资讯、定时查服务状态、整理某类信息、把结果推送到 IM,那它的价值会很快体现出来。

我这两个月最大的感受是:现在的 Agent,比的已经不是"能不能回答问题",而是"能不能稳定地替你完成一串重复动作"。

普通 AI 聊天工具是你问一句它答一句;Hermes 这种部署在服务器上、24 小时在线的常驻 Agent,更像一个私人管家

到点自动跑,发现变化自动记录,有结果自动推送,做完之后还能慢慢沉淀经验。

而且用到后面会养成一种习惯:什么事都随时丢给它,它自动帮你记录、总结、推送。
你的记忆力和注意力就从"别忘了这件事"里解放出来,放回真正需要你的判断和决策上。

它不是让你少思考,而是把重复检查、重复整理、重复提醒这些事情先接过去。

这也是我觉得 Hermes 最像私人的地方,强烈推荐你亲自去试一下。

6. 一些建议

最后简单说几个建议。

先从低风险任务开始

刚开始最好只让它做看、查、整理、提醒这类基础任务,调教好了再进阶。

任务描述要尽量清楚

Agent 不怕你要求多,它怕你要求不清楚。
时间、信息源、输出格式、判断标准,能写清楚就写清楚。

权限要慢慢给

Hermes 是长期在线的 Agent,不是一次性脚本。
权限能少给就少给,能晚给就晚给。

成本要提前算

VPS 成本比较固定,但模型调用成本会随着任务数量慢慢堆起来。
长期跑 Agent,一开始就要想清楚模型接入方式和调用成本。

日志偶尔要看

省心不等于完全不用管。
前期偶尔看看日志,能帮你发现任务跑偏、工具失败、权限配置不合理这些问题。

总之一句话:VPS 是它的身体,模型是它的大脑,任务流程才是它真正的灵魂。

7. The End

后面我会继续写一些 Hermes 和 AI Agent 的实际用法。

比起泛泛聊趋势,我更想记录这些工具真正放进日常工作之后,到底哪些地方有用,哪些地方只是看起来热闹。