账户余额
 
已消耗
 
调用次数
累计发起的请求数
当前费率
 

计费说明(分时段)

按 token 计费,夜间价格是日间的一半,时段自动切换。

扣费时机每次调用后实时扣减
余额不足调用将被拒绝

用量数字来自上游响应,属估算值,以最终账单为准。

账户信息

用户名
身份
接入地址
充值换算
去充值

API 密钥

名称 密钥 状态 最近使用 操作
加载中…

快速开始

兼容 OpenAI 与 Anthropic 两套协议,把 base_url 指向本站即可。

加载中…
模型:glm-5.3-flash(快)或 glm-5.3(强)
其他语言的接入示例(curl / Anthropic SDK / 免费通道)

curl

curl https://your-site/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer 你的密钥" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role":"user","content":"你好"}],
    "stream": true
  }'

Anthropic SDK(同一个 base_url)

from anthropic import Anthropic

client = Anthropic(
    base_url="https://your-site",   # 注意:Anthropic SDK 不补 /v1
    api_key="你的密钥",
)
msg = client.messages.create(
    model="glm-5.3-flash", max_tokens=256,
    messages=[{"role": "user", "content": "你好"}],
)
print(msg.content[0].text)

免费通道(不扣余额)

# 只把 base_url 换成 /free/v1 就走免费额度,密钥还是这一把
client = OpenAI(base_url="https://your-site/free/v1", api_key="你的密钥")

免费通道限流更严、只能用免费池里的模型,且额度是运营者自费补贴的 —— 详见 免费额度 页。

调用记录

时间模型首字总耗时 输入输出通道
加载中…

首字是「从发请求到收到第一个字」的耗时 —— 流式对话里它比总耗时更影响体感。 它只有**经门户转发**的调用才量得到(直连上游的请求门户看不到),所以早期记录可能显示「—」。

用量数字来自上游响应,属**估算值**,以最终账单为准。