侧边栏壁纸
博主头像
龍騰博客 博主等级

行动起来,活在当下

  • 累计撰写 181 篇文章
  • 累计创建 31 个标签
  • 累计收到 7 条评论

目 录CONTENT

文章目录

Hermes agent用上已下架的GLM-4.5-Flash大模型

管理员
2026-08-21 / 0 评论 / 0 点赞 / 0 阅读 / 0 字

1、进入 Hermes 模型配置 CLI

在 fnOS 上打开终端,进入 Hermes 容器执行模型配置命令(不要用 WebUI 选择器,它不会写回 config.yaml):

docker compose exec hermes hermes model

会进入交互式菜单,选择 custom (direct API)「添加自定义 OpenAI 兼容端点」。

2、填写 API base URL

在 API base URL 提示处填入智谱开放平台的接口地址: http://open.bigmodel.cn/api/paas/v4 (注意是 https,不要漏了协议头)。

3、填写 API Key

在 API key 提示处粘贴你的智谱 API Key。这一步是可选项,但智谱接口需要鉴权,必须填,否则后续调用会 401。

4、选择 API compatibility mode

出现兼容模式选择时,输入 2(Chat Completions),不要选 Auto-detect。因为 glm-4.5-flash 已被官方从模型列表里下架,走 auto-detect 容易触发探测失败或过滤掉这个模型。

5、手动输入模型名,而不是从列表选

系统会列出 glm-4.5、glm-4.5-air、glm-5 等收费模型,但列表里不会有 glm-4.5-flash。这时不要选数字,直接手动输入模型名: glm-4.5-flash 回车确认。因为其他 App 还能正常调用这个模型,说明底层接口并未真正封禁它,只是从可枚举列表里隐藏了。

6、填写 Context length

出现 Context length in tokens 提示时,不要留空走 auto-detect(这个模型不在官方列表里,自动探测大概率拿不到准确值)。手动填入官方标称的 128K: 131072 这个值也满足 Hermes 要求上下文 ≥64K 才会接受模型的门槛。

7、保存并退出配置

确认所有信息无误后保存退出 CLI。如果 Hermes 提示需要重启服务生效,执行:

docker compose restart hermes

(如果只是模型配置变更,没有动 .env / 环境变量,restart 就够用,不需要 --force-recreate。)

8、验证是否真的能用

在 Hermes 里选中这个新配置的模型,发一条简单测试消息(比如“你好,你是谁”),确认能正常返回内容而不是报错。如果返回 404 / model not found,说明智谱这次是网关层彻底拦截而不只是隐藏,需要换其他调用路径;如果正常返回,配置就成功了。

0
AI

评论区