本站参考价:输入 ¥0 / 输出 ¥0 每百万 tokens(渠道目录参考价 × 0.2x;最终扣费以控制台为准)。

智谱 AI · Flash 推理 · 0.2x

GLM-5.3-Flash API:价格、参数与 OpenAI 兼容接入

GLM-5.3-Flash 是面向高频 Coding、工具调用、视觉输入和长上下文任务的效率型号。本站正式调用代号为 glm-5.3-flash,当前站内倍率为 0.2x;Ox-Alpha 是正式命名之前的测试代号。想了解匿名测试阶段的任务表现,可阅读 GLM-5.3-Flash 深度评测

更新日期:2026-09-01·模型代号:glm-5.3-flash·编辑:island AI Coding

模型定位:快速反馈优先

GLM-5.3-Flash 可以理解为 GLM-5.3 系列中的效率型号:重点是缩短首 token 等待、维持连续对话吞吐,并把文本、截图和工具结果放在同一条工作流中。它更适合“观察—修改—测试—复核”的短循环,而不是把未经整理的整库内容一次性塞入上下文。

  • 前端与 UI 调试:结合截图、DOM 信息和回归截图定位布局问题。
  • Coding Agent:配合搜索、编辑、测试工具执行多轮任务。
  • 长文档问答:对需求、规范和代码索引做分区检索与归纳。

Ox-Alpha:正式名称之前的测试代号

Ox-Alpha 是 GLM-5.3-Flash 在正式命名之前使用的测试代号。匿名测试阶段的讨论重点并不在代号本身,而在模型能否稳定完成连续任务:长上下文是否能召回关键片段、工具参数是否保持一致、截图理解能否转化为可执行修改,以及高并发时响应是否仍然可用。

复盘测试时应保留模型列表快照、请求时间、输入类型、上下文长度、首 token 延迟、总耗时、错误码和最终代码差异。这样才能把测试代号阶段的体验与正式 glm-5.3-flash 做同题比较。

规格与能力

维度当前公开口径落地时如何核验
架构约 320B 总参数、约 18B 激活的 MoE 路线以实际吞吐和延迟为准,不从总参数推断速度
上下文约 1M 级,具体上限随接口目录变化用首段、中段、末段问题测试有效召回
输入能力原生多模态方向,支持视觉任务确认渠道允许的图片、文件格式和大小
协议OpenAI 兼容 Chat Completions/v1/models 复制精确模型 id

多模态能力由模型和渠道共同决定。遇到输入校验错误时,先缩小文件、确认 MIME 类型,再检查 content 数组格式。

价格与倍率:以实时目录为准

本站已上线 glm-5.3-flash,当前站内倍率为 0.2x。倍率是结算系数,不等同于固定人民币单价;输入、输出、缓存读写和上下文分档价格可能随渠道调整,生产预算应以控制台实时目录为准。

成本核算建议:每次测试同时记录输入 token、输出 token、缓存命中率、失败重试次数和总耗时,再比较 Flash 与其他模型的单任务成本。

任务适配矩阵

任务推荐度建议工作流需要人工复核的点
UI 截图与前端修复截图 + 问题清单 + 修改 + 回归截图像素、颜色和断点尺寸
工具型 Coding Agent固定 schema,逐轮保存工具结果参数类型、权限和副作用
长文档问答中高章节分块、索引摘要、首中尾召回测试引用位置和遗漏率
高风险自动发布生成变更、运行检查、人工审批、可回滚生产配置和数据写入

从 Ox-Alpha 迁移到正式模型

  1. 将客户端模型字段从 ox-alpha 改为 glm-5.3-flash
  2. 使用同一批文本、截图和工具任务记录延迟、成功率、输出差异和费用。
  3. 重新检查上下文上限、图片大小、工具参数和错误码。
  4. 确认账单中的输入、输出和缓存计费后,再扩大并发。

OpenAI 兼容 API 接入

cURL
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"glm-5.3-flash","messages":[{"role":"user","content":"把这份需求拆成可执行的开发任务"}]}'

切换模型时只修改 model 字段。上线前固定一组文本、截图和长上下文样本,记录成功率、延迟、输出质量与费用。

来源与口径

模型规格和协议说明以本站模型目录、接口返回和OpenAI 兼容接口说明为准;站内倍率和最终人民币单价以本站控制台模型目录为准。Ox-Alpha 部分是正式发布前测试阶段的经验归纳,适合用于历史复盘,不替代正式版本的同题实测。

页面最后更新:2026-08-29。规格、价格或模型 id 发生变化时,应同步更新本页、模型目录和机器可读清单。

常见问题

GLM-5.3-Flash 的正式调用代号是什么?

正式调用代号是 glm-5.3-flash。从模型广场或 /v1/models 复制当前可用 id。

Ox-Alpha 还需要写进生产配置吗?

Ox-Alpha 仅用于测试阶段复盘;生产配置使用正式代号 glm-5.3-flash

站内倍率和实际价格有什么区别?

当前站内倍率为 0.2x,倍率是结算系数,输入、输出和缓存的实际单价以控制台实时目录为准。