1、进入 Hermes 模型配置 CLI
在 fnOS 上打开终端,进入 Hermes 容器执行模型配置命令(不要用 WebUI 选择器,它不会写回 config.yaml):
docker compose exec hermes hermes model
会进入交互式菜单,选择 custom (direct API)「添加自定义 OpenAI 兼容端点」。
2、填写 API base URL
在 API base URL 提示处填入智谱开放平台的接口地址: https://open.bigmodel.cn/api/paas/v4 (注意是 https,不要漏了协议头)。
3、填写 API Key
在 API key 提示处粘贴你的智谱 API Key。这一步是可选项,但智谱接口需要鉴权,必须填,否则后续调用会 401。
4、选择 API compatibility mode
出现兼容模式选择时,输入 2(Chat Completions),不要选 Auto-detect。因为 glm-4.5-flash 已被官方从模型列表里下架,走 auto-detect 容易触发探测失败或过滤掉这个模型。
5、手动输入模型名,而不是从列表选
系统会列出 glm-4.5、glm-4.5-air、glm-5 等收费模型,但列表里不会有 glm-4.5-flash。这时不要选数字,直接手动输入模型名: glm-4.5-flash 回车确认。因为其他 App 还能正常调用这个模型,说明底层接口并未真正封禁它,只是从可枚举列表里隐藏了。
6、填写 Context length
出现 Context length in tokens 提示时,不要留空走 auto-detect(这个模型不在官方列表里,自动探测大概率拿不到准确值)。手动填入官方标称的 128K: 131072 这个值也满足 Hermes 要求上下文 ≥64K 才会接受模型的门槛。
7、保存并退出配置
确认所有信息无误后保存退出 CLI。如果 Hermes 提示需要重启服务生效,执行:
docker compose restart hermes
(如果只是模型配置变更,没有动 .env / 环境变量,restart 就够用,不需要 --force-recreate。)
8、验证是否真的能用
在 Hermes 里选中这个新配置的模型,发一条简单测试消息(比如“你好,你是谁”),确认能正常返回内容而不是报错。如果返回 404 / model not found,说明智谱这次是网关层彻底拦截而不只是隐藏,需要换其他调用路径;如果正常返回,配置就成功了。
Custom OpenAI-compatible endpoint configuration:
API base URL [e.g. https://api.example.com/v1]: https://open.bigmodel.cn/api/paas/v4
API key [optional]: *************************************************
Verified endpoint via https://open.bigmodel.cn/api/paas/v4/models (9 model(s) visible)
Select API compatibility mode:
1. Auto-detect
Use Hermes URL heuristics; best for standard OpenAI-compatible endpoints.
2. Chat Completions [current]
Use /chat/completions for standard OpenAI-compatible servers.
3. Responses / Codex
Use /responses for Codex-compatible tool-calling backends.
4. Anthropic Messages
Use /v1/messages for Anthropic-compatible endpoints.
Choice [1-4, Enter to keep current/detected]: 2
API mode: chat_completions
Available models:
1. glm-4.5
2. glm-4.5-air
3. glm-4.6
4. glm-4.7
5. glm-5
6. glm-5-turbo
7. glm-5.1
8. glm-5.2
9. glm-5.3
Select model [1-9] or type name: glm-4.5-flash
Context length in tokens [leave blank for auto-detect]: 131072
Display name [Open.bigmodel.cn]: ZAIfree
API key saved to .env as HERMES_CUSTOM_OPEN_BIGMODEL_CN_API_KEY
Default model set to: glm-4.5-flash (via https://open.bigmodel.cn/api/paas/v4)
💾 Saved to custom providers as "ZAIfree" (edit in config.yaml)
评论区