模型与价格 / glm-5.3-flash

glm-5.3-flash 省 12%

通过 token中泽信业 的统一接口调用 glm-5.3-flash,按实际 Token 用量计费。

OpenAI 兼容Anthropic 兼容

价格

计费项(元 / 百万 Token)价格
输入¥0.8¥0.704
缓存命中的输入¥0.202
输出¥2.8¥2.464
  • 调用时 model 字段填写 glm-5.3-flash。
  • 缓存命中价指请求中命中上下文缓存的输入部分。划线价为官方标价。
  • 思考内容按输出 Token 计费;建议 max_tokens 不小于 1000,否则额度可能全部用在思考上。

OpenAI 接口调用

curl https://token.zzxytech.com/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "glm-5.3-flash", "messages": [{"role": "user", "content": "你好"}], "max_tokens": 1000}'
# pip install openai
from openai import OpenAI

client = OpenAI(api_key="YOUR_API_KEY", base_url="https://token.zzxytech.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[{"role": "user", "content": "你好"}],
    max_tokens=1000,
)
print(resp.choices[0].message.content)

在 Claude Code 中使用

把下面的内容写入 ~/.claude/settings.json(Windows 为用户目录下的 .claude\settings.json),再启动 Claude Code。

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://token.zzxytech.com",
    "ANTHROPIC_AUTH_TOKEN": "YOUR_API_KEY",
    "ANTHROPIC_MODEL": "glm-5.3-flash",
    "ANTHROPIC_DEFAULT_OPUS_MODEL": "glm-5.3-flash",
    "ANTHROPIC_DEFAULT_SONNET_MODEL": "glm-5.3-flash",
    "ANTHROPIC_DEFAULT_HAIKU_MODEL": "glm-5.3-flash",
    "CLAUDE_CODE_SUBAGENT_MODEL": "glm-5.3-flash"
  }
}