1、进入 Hermes 模型配置 CLI
在 fnOS 上打开终端,进入 Hermes 容器执行模型配置命令(不要用 WebUI 选择器,它不会写回 config.yaml):
docker compose exec hermes hermes model
会进入交互式菜单,选择 custom (direct API)「添加自定义 OpenAI 兼容端点」。
2、填写 API base URL
在 API base URL 提示处填入智谱开放平台的接口地址: http://open.bigmodel.cn/api/paas/v4 (注意是 https,不要漏了协议头)。
3、填写 API Key
在 API key 提示处粘贴你的智谱 API Key。这一步是可选项,但智谱接口需要鉴权,必须填,否则后续调用会 401。
4、选择 API compatibility mode
出现兼容模式选择时,输入 2(Chat Completions),不要选 Auto-detect。因为 glm-4.5-flash 已被官方从模型列表里下架,走 auto-detect 容易触发探测失败或过滤掉这个模型。
5、手动输入模型名,而不是从列表选
系统会列出 glm-4.5、glm-4.5-air、glm-5 等收费模型,但列表里不会有 glm-4.5-flash。这时不要选数字,直接手动输入模型名: glm-4.5-flash 回车确认。因为其他 App 还能正常调用这个模型,说明底层接口并未真正封禁它,只是从可枚举列表里隐藏了。
6、填写 Context length
出现 Context length in tokens 提示时,不要留空走 auto-detect(这个模型不在官方列表里,自动探测大概率拿不到准确值)。手动填入官方标称的 128K: 131072 这个值也满足 Hermes 要求上下文 ≥64K 才会接受模型的门槛。
7、保存并退出配置
确认所有信息无误后保存退出 CLI。如果 Hermes 提示需要重启服务生效,执行:
docker compose restart hermes
(如果只是模型配置变更,没有动 .env / 环境变量,restart 就够用,不需要 --force-recreate。)
8、验证是否真的能用
在 Hermes 里选中这个新配置的模型,发一条简单测试消息(比如“你好,你是谁”),确认能正常返回内容而不是报错。如果返回 404 / model not found,说明智谱这次是网关层彻底拦截而不只是隐藏,需要换其他调用路径;如果正常返回,配置就成功了。
评论区