Hermes Agent 设置
1. Hermes Agent 设置
Hermes Agent 这样设置,那么恭喜你,为了省钱又进一步😂
DeepSeek 为主大模型,Kimi K2.6 为视觉模型,并且无需来回切换,只要丢图片进去就会自动使用 Kimi K2.6 去识别。
(理论上你可以设置更多的大模型去完成不同的工作,并且全程自动无需切换大模型)
写很多以 X 文章的形式去编辑这类干货教程已经很多了,我想试试普通的发帖方式编辑会不会被更多的人去看到。
那么话不多说,下面直接是干货!
主模型:deepseek-v4-pro
视觉模型:kimi-k2.6
运作逻辑:DeepSeek 负责所有的工具调用、代码、排查、对话,一旦你丢过来图片或者视频帧,系统自动切到 Kimi 去识图,识完把结果扔回给 DeepSeek 继续处理。
整个过程不需要手动切换模型,你体感上就是同一个助手在干活,但实际上后面是两个大脑在协作。
1.1. 为什么这样搭
deepseek-v4-pro 的工具调用和长上下文处理能力确实强,跑代码任务、排查问题、多步骤复杂操作的稳定性比 Kimi 好一截。
但它有一个硬伤:暂时不支持多模态,直接给它丢图片会报 unknown variant image_url 的错。
而 kimi-k2.6 的多模态能力不用说,中文 OCR 也准,但纯文本推理和工具调用不如 DeepSeek 稳。
所以最优解就是各取所长,DeepSeek 当大脑,Kimi 当眼睛。
(其实说白了就是为了省 Token!)
1.2. 配置步骤
1.2.1. 第一步:确保 API Key 就位
在 ~/.hermes/.env 里确认两行:
DEEPSEEK_API_KEY=你的deepseek密钥
KIMI_API_KEY=你的kimi密钥
1.2.2. 第二步:切主模型
终端敲:
hermes config set model.default deepseek-v4-pro
hermes config set model.provider deepseek
1.2.3. 第三步:设视觉模型
hermes config set http://auxiliary.vision.model kimi-k2.6
hermes config set http://auxiliary.vision.provider kimi-coding
hermes config set http://auxiliary.vision.base_url https://api.moonshot.ai/v1
1.2.4. 第四步:如果你的 Kimi key 是老 key
(sk- 开头不是 sk-kimi- 开头),需要在 .env 最后加一行:
KIMI_BASE_URL=https://api.moonshot.ai/v1
新 key 走 api.kimi.com,老 key 走 api.moonshot.ai,config 默认写的 api.moonshot.cn 是错的,不改会 401。
1.2.5. 第五步:/reset 重开会话生效
1.3. 踩过的坑
一个是上面说的 API 地址问题,moonshot.cn 和 moonshot.ai 差一个字母,排查了好一阵。
另一个更隐蔽:Hermes 内置的 vision 工具往 Kimi API 发请求时,content 数组里 image_url 排在了 text 前面,Kimi 的接口不认这个顺序,偶尔 400。
目前的变通方案是发图时绕过内置工具,直接 Python 调 moonshot API,text 放 image_url 前面就没事。
不影响使用,但不算完美,等后续优化。
配完之后你正常跟他聊天就行,DeepSeek 处理一切。
发图过来的时候,你不需要说“用 Kimi 看”,系统自动检测到图片就走 Kimi 视觉,识读完无缝回到 DeepSeek 继续对话。
你体感上就是同一个助手能看能想能干,但后台其实是两个模型在做各自最擅长的事。
最大好处是不用你在聊天里手动切模型,流程全自动。
而且以后如果想换视觉模型,改 auxiliary.vision.model 一行就行,不影响主模型。