怎么接进你的客户端

三样东西:接口地址、你的钥匙、模型名。填对这三样就能用了。

先记下这三样

接口地址 (Claude Code 例外,见下面那一段)
钥匙sk- 开头那一串。还没有就去领一把,送 0.5 元试用额度。
模型名 glm-5.3 glm-5.3-flash glm-5.2
deepseek-v4-pro deepseek-v4-flash qwen3.8-27b
不想挑就填 default(现在指向 glm-5.3)。 各自的窗口、单价和当前状态见模型与状态
模型名必须自己填。客户端自带的默认值(gpt-…claude-…)是别家的模型名, 我们这儿没有,不改就会卡在第一发请求上。

按你用的客户端往下看

腾讯 WorkBuddy
  1. 主界面底部点模型选择器,拉到最下面点「配置自定义模型」
  2. 右上角「+ 添加模型」,供应商类型选「自定义 / Custom」
  3. 三个框分别填:
    API Base URL
    API Key你的 sk- 钥匙
    模型名称glm-5.3
  4. 保存,回到对话界面选中这个模型。
模型名要一字不差,多空格或大小写不对都会报模型不存在。
ZCode
  1. 设置里找到左侧「自定义供应商」,点 + 新建一个。
  2. 右侧填:
    Base URL
    API 格式OpenAI 兼容
    API Key你的 sk- 钥匙
    Model IDglm-5.3
  3. 保存后在模型列表里选中它。
我们同时支持 Anthropic 格式,在这里选 Anthropic 也能通, 但没必要 —— OpenAI 兼容这条路我们测得最全。
Claude Code
它靠环境变量配置,而且地址不带 /v1 —— 它自己会拼上 /v1/messages
macOS / Linux,写进 ~/.bashrc~/.zshrc
Windows PowerShell,当前窗口临时生效:
  1. 设好之后重开一个终端再运行 claude,不然环境变量不生效。
  2. 两个模型变量都要设。ANTHROPIC_SMALL_FAST_MODEL 是它跑后台小任务用的, 不设的话那些任务会去请求它自带的默认模型,然后报错。
想换回官方:把这几个变量删掉(unset)再重开终端。
Codex 系(Codex CLI 等)
~/.codex/config.toml(Windows 在 %USERPROFILE% 下的 .codex 文件夹里):
钥匙不写进配置文件,走环境变量:
  1. wire_api 必须是 "responses"。Codex 已经不支持 chat 协议了, 写成 "chat" 会直接连不上。
  2. env_key 写的是环境变量的名字,不是钥匙本身。
其它 OpenAI 兼容的客户端
凡是能自己填「接口地址 + API Key + 模型名」的,填法都一样:
地址 / Base URL
API Key你的 sk- 钥匙
模型glm-5.3
三套协议都支持,用你客户端原本那套就行:
OpenAI /v1/chat/completions · Anthropic /v1/messages · Responses /v1/responses

报错了怎么办

说模型不存在
多半是模型名没改,客户端还在发它自带的默认值。照上面的模型名重填一遍。 报错信息里我们会把能填的名字全列出来,照着抄就行。
401 / 说钥匙不对
检查有没有把 sk- 前缀漏掉,或者复制时带了空格换行。 钥匙被你自己在面板里停用或删掉了也会这样。
402 余额不足
用量与账单看余额。我们会在请求发出前先冻结一笔预估费用, 所以余额刚好卡在边上时会发不出去 —— 充一点就好。
回复是空的
多半是 max_tokens 给小了。这几个模型回答前会先思考,思考也占输出预算, 预算太小就全烧在思考上、正文没了。调大到两千以上再试。 真是这个原因的话,响应头 x-empty-content 里会写明。
503 服务器忙 / 模型暂时不可用
先看模型与状态。写「恢复中」就等一会儿,会自己好; 写「暂停供应」就换一个模型。这两种情况都不会扣你的钱。
对话太长
不会直接报错 —— 我们会先丢掉最旧的几轮帮你接着跑,裁过的话响应头 x-context-trimmed 里会写明。各模型收得下多少见模型与状态
还是不行的话,在用量与账单页面底部留言,只有我们看得到。 贴上报错原文最快 —— 但别贴你的钥匙。