← 返回用量查询

使用教程

你拿到一个 sk-xxx 格式的 Key,按下面步骤就能在绝大多数工具(OpenAI 兼容)以及 Claude Code(Anthropic 格式)里调用你分配到的模型。

接入信息

项目值
接口地址(Base URL)https://api.epowercomm.com/v1 (OpenAI 兼容工具填这个)
Claude Code 类工具地址https://api.epowercomm.com(不带 /v1,仅 Claude Code 等 Anthropic 格式工具填这个)
你的 API Keysk-xxxx(发放给你的那串)
模型名称你分配到的模型(当前 glm-5.3)
请求格式OpenAI 兼容(工具里选「OpenAI」或「OpenAI 兼容」类型)

1. 快速验证

把命令里的 你的Key 整串替换成你拿到的 Key(你的 Key 本身就是 sk- 开头,直接整串替换,不要再在前面拼 sk-xxx),glm-5.3 换成你分配到的模型。返回 JSON 里 choices[0].message.content 就是回复内容:

Mac / Linux Windows (PowerShell)
curl https://api.epowercomm.com/v1/chat/completions \
  -H "Authorization: Bearer 你的Key" \
  -H "Content-Type: application/json" \
  -d '{"model":"glm-5.3","messages":[{"role":"user","content":"你好,用一句话介绍你自己"}],"max_tokens":1024}'
glm-5.3 是思考模型,会先输出 reasoning_content(思考过程)再输出 content(回复),所以 max_tokens 要留大一点(如 1024),否则额度全给了思考、回复为空。不要加 "stream":true,否则 curl 会打印一堆 data: {...} 流式片段,非流式直接返回完整 JSON 更好读。

2. 在客户端里接入

不管什么工具,本质只填三样:接口地址、API Key、模型名称(当前 glm-5.3)。绝大多数工具选「OpenAI 兼容」、地址填 https://api.epowercomm.com/v1 即可;Claude Code 类工具走 Anthropic 格式,地址不带 /v1。点下方标签看对应工具的步骤:

ZCode Claude Code CC Switch WorkBuddy Cursor 聊天客户端 其他工具
  1. 打开 ZCode,点左下角设置,在左侧导航进入模型供应商页面。
  2. 在供应商条目里:接口地址填 https://api.epowercomm.com/v1,API Key 填你的 sk-xxx。
  3. 保存后,在模型切换菜单里选 glm-5.3 即可。

3. 查询你的用量

打开 https://query.epowercomm.com/,在框里输入你的 Key,无需登录即可看到:

状态颜色含义:

4. 调用次数与额度

5. 常见问题

「上下文」是什么?
是这次调用发给模型的全部内容:整个对话历史+系统提示+工具定义+图片。Claude Code 这类 Agent 工具每轮都会把完整历史重新发送一遍,所以聊得越久、上下文越大。调用明细里的「上下文」列就是每笔的实际值。

我这轮只发了几句话,为什么扣这么多次?
计费看你带过去的整个对话历史,不是本轮新增的几句话。比如聊到 20 万 token 的会话,你发「继续」两个字,模型仍要处理全部 20 万——这就是扣 5 次的原因。扣次与输出多少也无关,输出 100 和 5000 token 同价。

为什么越聊扣得越快?怎么省次数?
上下文随对话轮次累积增长,会话从 4 万涨到 11 万,扣次就从 1 次变 2 次。想省次数:阶段性开新会话(上下文清零,重新从 1 次档开始),或让工具少往对话里贴大文件。

48k / 112k / 200k 大概是多大的对话?
粗略量级:48k ≈ 几十轮短对话或小任务前期;112k ≈ 中型任务(读了不少文件);200k+ ≈ 长任务/大代码库。中文约 1 字 ≈ 0.6 token。

高峰期为什么扣 3 倍?
工作日 14:00~18:00(法定节假日除外)上游成本是平时的数倍,故按 3 倍计。避开高峰 = 直接省 2/3(同样请求平峰 2 次、高峰 6 次)。

「实际调用次数」和「累计扣次」为什么不一样?
实际调用次数 = 发起了多少笔请求;累计扣次 = 一共扣了多少次(长上下文的请求一笔扣多次)。明细每行的「扣次」加起来 = 累计扣次,可自行对账;剩余次数 = 总次数 − 累计扣次。

带图片的请求怎么算?
图片按张计入上下文(每张约 2800 token),与其余文本一起走同样的阶梯。

调用返回 429「5 小时使用上限」?
模型侧短期限额,等提示的重置时间后自动恢复,稍后再试,不消耗你的次数。

调用返回 403「服务暂时不可用」?
多为临时性服务调整或瞬时故障,重试即可;重试仍失败请联系管理员。失败的请求不会扣次数。

Key 突然不能用了?
打开查询页输入 Key 看状态:红色「已过期」或「已耗尽」就说明 Key 失效了,请申请新 Key。

接口地址到底填哪个?
普通工具(OpenAI 兼容)填 https://api.epowercomm.com/v1;只有 Claude Code 这类 Anthropic 格式工具填 https://api.epowercomm.com(不带 /v1)。填反了会连不上或 404。

能用哪些模型?
用你分配到的模型(查询页「可用模型」字段有列出)。当前主要是 glm-5.3,后续开放新模型会在本教程更新。