Hermes Agent 设置

1. Hermes Agent 设置

Hermes Agent 这样设置,那么恭喜你,为了省钱又进一步😂

DeepSeek 为主大模型,Kimi K2.6 为视觉模型,并且无需来回切换,只要丢图片进去就会自动使用 Kimi K2.6 去识别。
(理论上你可以设置更多的大模型去完成不同的工作,并且全程自动无需切换大模型)

写很多以 X 文章的形式去编辑这类干货教程已经很多了,我想试试普通的发帖方式编辑会不会被更多的人去看到。

那么话不多说,下面直接是干货!


主模型:deepseek-v4-pro

视觉模型:kimi-k2.6

运作逻辑:DeepSeek 负责所有的工具调用、代码、排查、对话,一旦你丢过来图片或者视频帧,系统自动切到 Kimi 去识图,识完把结果扔回给 DeepSeek 继续处理。
整个过程不需要手动切换模型,你体感上就是同一个助手在干活,但实际上后面是两个大脑在协作。


1.1. 为什么这样搭

deepseek-v4-pro 的工具调用和长上下文处理能力确实强,跑代码任务、排查问题、多步骤复杂操作的稳定性比 Kimi 好一截。

但它有一个硬伤:暂时不支持多模态,直接给它丢图片会报 unknown variant image_url 的错。

kimi-k2.6 的多模态能力不用说,中文 OCR 也准,但纯文本推理和工具调用不如 DeepSeek 稳。

所以最优解就是各取所长,DeepSeek 当大脑,Kimi 当眼睛。

(其实说白了就是为了省 Token!)


1.2. 配置步骤

1.2.1. 第一步:确保 API Key 就位

~/.hermes/.env 里确认两行:

DEEPSEEK_API_KEY=你的deepseek密钥
KIMI_API_KEY=你的kimi密钥

1.2.2. 第二步:切主模型

终端敲:

hermes config set model.default deepseek-v4-pro
hermes config set model.provider deepseek

1.2.3. 第三步:设视觉模型

hermes config set http://auxiliary.vision.model kimi-k2.6
hermes config set http://auxiliary.vision.provider kimi-coding
hermes config set http://auxiliary.vision.base_url https://api.moonshot.ai/v1

1.2.4. 第四步:如果你的 Kimi key 是老 key

sk- 开头不是 sk-kimi- 开头),需要在 .env 最后加一行:

KIMI_BASE_URL=https://api.moonshot.ai/v1

新 key 走 api.kimi.com,老 key 走 api.moonshot.ai,config 默认写的 api.moonshot.cn 是错的,不改会 401。

1.2.5. 第五步:/reset 重开会话生效


1.3. 踩过的坑

一个是上面说的 API 地址问题,moonshot.cnmoonshot.ai 差一个字母,排查了好一阵。

另一个更隐蔽:Hermes 内置的 vision 工具往 Kimi API 发请求时,content 数组里 image_url 排在了 text 前面,Kimi 的接口不认这个顺序,偶尔 400。

目前的变通方案是发图时绕过内置工具,直接 Python 调 moonshot API,textimage_url 前面就没事。

不影响使用,但不算完美,等后续优化。


配完之后你正常跟他聊天就行,DeepSeek 处理一切。

发图过来的时候,你不需要说“用 Kimi 看”,系统自动检测到图片就走 Kimi 视觉,识读完无缝回到 DeepSeek 继续对话。

你体感上就是同一个助手能看能想能干,但后台其实是两个模型在做各自最擅长的事。

最大好处是不用你在聊天里手动切模型,流程全自动。
而且以后如果想换视觉模型,改 auxiliary.vision.model 一行就行,不影响主模型。