侧边栏壁纸
博主头像
龍騰博客 博主等级

行动起来,活在当下

  • 累计撰写 193 篇文章
  • 累计创建 31 个标签
  • 累计收到 12 条评论

目 录CONTENT

文章目录

Hermes agent用上已下架的GLM-4.5-Flash大模型

管理员
2026-08-21 / 0 评论 / 0 点赞 / 4 阅读 / 0 字

1、进入 Hermes 模型配置 CLI

在 fnOS 上打开终端,进入 Hermes 容器执行模型配置命令(不要用 WebUI 选择器,它不会写回 config.yaml):

docker compose exec hermes hermes model

会进入交互式菜单,选择 custom (direct API)「添加自定义 OpenAI 兼容端点」。

2、填写 API base URL

在 API base URL 提示处填入智谱开放平台的接口地址: https://open.bigmodel.cn/api/paas/v4 (注意是 https,不要漏了协议头)。

3、填写 API Key

在 API key 提示处粘贴你的智谱 API Key。这一步是可选项,但智谱接口需要鉴权,必须填,否则后续调用会 401。

4、选择 API compatibility mode

出现兼容模式选择时,输入 2(Chat Completions),不要选 Auto-detect。因为 glm-4.5-flash 已被官方从模型列表里下架,走 auto-detect 容易触发探测失败或过滤掉这个模型。

5、手动输入模型名,而不是从列表选

系统会列出 glm-4.5、glm-4.5-air、glm-5 等收费模型,但列表里不会有 glm-4.5-flash。这时不要选数字,直接手动输入模型名: glm-4.5-flash 回车确认。因为其他 App 还能正常调用这个模型,说明底层接口并未真正封禁它,只是从可枚举列表里隐藏了。

6、填写 Context length

出现 Context length in tokens 提示时,不要留空走 auto-detect(这个模型不在官方列表里,自动探测大概率拿不到准确值)。手动填入官方标称的 128K: 131072 这个值也满足 Hermes 要求上下文 ≥64K 才会接受模型的门槛。

7、保存并退出配置

确认所有信息无误后保存退出 CLI。如果 Hermes 提示需要重启服务生效,执行:

docker compose restart hermes

(如果只是模型配置变更,没有动 .env / 环境变量,restart 就够用,不需要 --force-recreate。)

8、验证是否真的能用

在 Hermes 里选中这个新配置的模型,发一条简单测试消息(比如“你好,你是谁”),确认能正常返回内容而不是报错。如果返回 404 / model not found,说明智谱这次是网关层彻底拦截而不只是隐藏,需要换其他调用路径;如果正常返回,配置就成功了。

Custom OpenAI-compatible endpoint configuration:

API base URL [e.g. https://api.example.com/v1]: https://open.bigmodel.cn/api/paas/v4

API key [optional]: *************************************************

Verified endpoint via https://open.bigmodel.cn/api/paas/v4/models (9 model(s) visible)

Select API compatibility mode:

1. Auto-detect

Use Hermes URL heuristics; best for standard OpenAI-compatible endpoints.

2. Chat Completions [current]

Use /chat/completions for standard OpenAI-compatible servers.

3. Responses / Codex

Use /responses for Codex-compatible tool-calling backends.

4. Anthropic Messages

Use /v1/messages for Anthropic-compatible endpoints.

Choice [1-4, Enter to keep current/detected]: 2

API mode: chat_completions

Available models:

1. glm-4.5

2. glm-4.5-air

3. glm-4.6

4. glm-4.7

5. glm-5

6. glm-5-turbo

7. glm-5.1

8. glm-5.2

9. glm-5.3

Select model [1-9] or type name: glm-4.5-flash

Context length in tokens [leave blank for auto-detect]: 131072

Display name [Open.bigmodel.cn]: ZAIfree

API key saved to .env as HERMES_CUSTOM_OPEN_BIGMODEL_CN_API_KEY

Default model set to: glm-4.5-flash (via https://open.bigmodel.cn/api/paas/v4)

💾 Saved to custom providers as "ZAIfree" (edit in config.yaml)

0
AI

评论区