接口调用文本模型
GLM
智谱的 GLM 系列:可用型号、调用示例与计费方式。
智谱的 GLM 系列,从轻量到旗舰型号齐全。
- 接口:
POST https://modelrouter.club/v1/chat/completions(OpenAI 格式),字段说明见 创建对话 - 在线试用需要登录,按自己的余额扣费
可用型号
| 模型 ID | 说明 | 链接 |
|---|---|---|
glm-5.3 | 最新旗舰 | 价格 · 试用 |
glm-5.3-flashx | 5.3 轻量版 | 价格 · 试用 |
glm-5.3-flash | 5.3 更轻量的版本,价格最低 | 价格 · 试用 |
glm-5.2 | 上一代旗舰 | 价格 · 试用 |
glm-5.1 | 按输入长度分档 | 价格 · 试用 |
glm-5 | 按输入长度分档 | 价格 · 试用 |
glm-5-turbo | 按输入长度分档 | 价格 · 试用 |
glm-4.7 | 按输入、输出长度分档 | 价格 · 试用 |
glm-4.5-air | 按输入、输出长度分档 | 价格 · 试用 |
型号会随渠道调整增减,以 模型广场 和 GET /v1/models 为准。
调用示例
curl https://modelrouter.club/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [
{ "role": "user", "content": "用三句话介绍一下你自己" }
],
"max_tokens": 2048
}'from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://modelrouter.club/v1",
)
response = client.chat.completions.create(
model="glm-5.3",
messages=[{"role": "user", "content": "用三句话介绍一下你自己"}],
max_tokens=2048,
)
print(response.choices[0].message.content)换成其他型号,只需替换 model。需要逐字输出时加 "stream": true,见 流式输出。
计费
- 按输入、输出、缓存命中 token 分别计价。
glm-5.3、glm-5.3-flashx、glm-5.3-flash、glm-5.2只有一档单价。glm-5.1、glm-5、glm-5-turbo按输入长度分档:输入低于 32K token 一档,32K 及以上一档。glm-4.7、glm-4.5-air分三档:短输入短输出(输入低于 32K 且输出低于 200 token)、短输入长输出、长输入(32K 及以上)。
实时单价见 模型广场,每次调用的实际用量与扣费见 使用日志。
说明
max_tokens包含思考过程。推理型号设得太小时,额度可能全部用于思考,content为空。- 本站文本模型目前不支持在对话中识别图片。