1. GLM-5.3 是什么
GLM-5.3(glm-5.3)是智谱 GLM-5 系列当前在本站定价目录中的最新版本号,与 GLM-5.1、GLM-5.2 相比基准价略有上调,但缓存写从收费改为免费——对于会反复装载大上下文的任务,这个规则变化可能抵消单价的上调。
全天统一价、无分时段规则。上下文窗口等规格参数以控制台模型列表与智谱官方目录为准。
2. 人民币价格表
| 计费项(元 / 百万 tokens) | 渠道目录参考价 | 本站售价 |
|---|---|---|
| 输入 | ¥9.8 | ¥1.96 |
| 输出 | ¥30.8 | ¥6.16 |
| 缓存读 | ¥1.82 | ¥0.364 |
| 缓存写 | ¥0(免费) | ¥0(免费) |
| 计费倍率 | 0.2x(本站售价 = 渠道目录参考价 × 0.2) | |
结算口径:按 Token 用量 × 站内倍率 0.2x 结算,全天统一价,明细以控制台账单为准。
3. 选型参考
- 系列内升级的盈亏平衡:输入贵 ¥0.42、输出贵 ¥0.756(对比 5.1/5.2),但缓存写免费。如果一个任务每百万 tokens 输入中有一半来自重复前缀的重建,省下的缓存写费(原来 ¥0.392)就已接近补上差价;前缀复用率越高,5.3 越划算。
- 高复用前缀任务首选 5.3:知识库问答、固定系统提示词的多轮客服——首次写入免费,后续命中缓存读仅 ¥0.364。
- 国产渠道横向比较:¥1.96/¥6.16 属中档偏高,与 Kimi K2.7 Code(¥1.54/¥7.0)输入接近、输出更低,高于 MiniMax 与 MiMo 各档。
4. API 调用示例
cURL · OpenAI 兼容调用
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [
{"role": "system", "content": "你是企业知识库助手,以下是企业文档……"},
{"role": "user", "content": "年假未休的折算规则是什么?"}
]
}'
Python SDK
Python · openai SDK
from openai import OpenAI
client = OpenAI(
base_url="https://www.codex789.com/v1",
api_key="sk-codex789-your-api-key",
)
resp = client.chat.completions.create(
model="glm-5.3",
messages=[{"role": "user", "content": "将这份调研记录整理为结论优先的纪要"}],
)
print(resp.choices[0].message.content)
5. 常见问题
GLM-5.3 的调用代号是什么?
调用代号为 glm-5.3,由智谱提供,具体可用状态以控制台模型列表为准。
GLM-5.3 比 GLM-5.2 贵多少?
本站售价下,GLM-5.3 输入 ¥1.96、输出 ¥6.16,比 GLM-5.1/5.2(¥1.54/¥5.404)输入贵 0.42、输出贵 0.756 每百万 tokens。
GLM-5.3 的缓存写收费吗?
不收费。GLM-5.3 的缓存写渠道目录标价为 ¥0,本站同样免费;这一点与 GLM-5.1/5.2(缓存写 ¥0.392)不同,缓存读按 ¥0.364 计费。
倍率是多少?
站内倍率 0.2x,国产模型人民币渠道统一(DeepSeek 除外为 0.3x);以控制台实时展示为准。