ModelRouterModelRouter
⚠️合规提示:本项目仅用于合法授权的 API 网关、内部管理和私有化部署场景。请遵守上游服务条款、平台规则、监管要求和内容安全要求。
接口调用文本模型

GLM

智谱的 GLM 系列:可用型号、调用示例与计费方式。

智谱的 GLM 系列,从轻量到旗舰型号齐全。

  • 接口:POST https://modelrouter.club/v1/chat/completions(OpenAI 格式),字段说明见 创建对话
  • 在线试用需要登录,按自己的余额扣费

可用型号

模型 ID说明链接
glm-5.3最新旗舰价格 · 试用
glm-5.3-flashx5.3 轻量版价格 · 试用
glm-5.3-flash5.3 更轻量的版本,价格最低价格 · 试用
glm-5.2上一代旗舰价格 · 试用
glm-5.1按输入长度分档价格 · 试用
glm-5按输入长度分档价格 · 试用
glm-5-turbo按输入长度分档价格 · 试用
glm-4.7按输入、输出长度分档价格 · 试用
glm-4.5-air按输入、输出长度分档价格 · 试用

型号会随渠道调整增减,以 模型广场 和 GET /v1/models 为准。

调用示例

curl https://modelrouter.club/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3",
    "messages": [
      { "role": "user", "content": "用三句话介绍一下你自己" }
    ],
    "max_tokens": 2048
  }'
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://modelrouter.club/v1",
)

response = client.chat.completions.create(
    model="glm-5.3",
    messages=[{"role": "user", "content": "用三句话介绍一下你自己"}],
    max_tokens=2048,
)
print(response.choices[0].message.content)

换成其他型号,只需替换 model。需要逐字输出时加 "stream": true,见 流式输出。

计费

  • 按输入、输出、缓存命中 token 分别计价。
  • glm-5.3、glm-5.3-flashx、glm-5.3-flash、glm-5.2 只有一档单价。
  • glm-5.1、glm-5、glm-5-turbo 按输入长度分档:输入低于 32K token 一档,32K 及以上一档。
  • glm-4.7、glm-4.5-air 分三档:短输入短输出(输入低于 32K 且输出低于 200 token)、短输入长输出、长输入(32K 及以上)。

实时单价见 模型广场,每次调用的实际用量与扣费见 使用日志。

说明
  • max_tokens 包含思考过程。推理型号设得太小时,额度可能全部用于思考,content 为空。
  • 本站文本模型目前不支持在对话中识别图片。