
1. 先给结论:谁该用 Kimi K3 中转
Kimi K3 适合已经在用 OpenAI 兼容 SDK、Cursor 或自建后端,需要把长文档、长程工具循环和中文知识工作接到同一条 Base URL 的团队。官方模型 ID 是 kimi-k3,上下文窗口 1,048,576 tokens,思考模式始终开启,只能用 reasoning_effort 调强度,不能关掉。
中转的价值不在口号,而在账本和隔离:同一入口 https://www.codex789.com/v1、可见目录价、以及按环境拆 Key。它不是免费号池,也不是把官方 ¥20 / ¥100 自动变成账单上的 ¥0.84 / ¥4.2。
2. 模型 ID 与最小接入
公开详情页是Kimi K3 API 中转,调用代号填 kimi-k3。不要把编码模型 kimi-k2.7-code 或控制台里的高速档当成 K3。旧 URL 如果出现点号写法,规范页仍是短横线 slug。
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k3","reasoning_effort":"low","messages":[{"role":"user","content":"用三条要点说明这次发布失败原因"}]}'Python 只改 Base URL 和 model。上线前先打 /v1/models 或看控制台,确认分组里真有 kimi-k3。流式响应会同时给 reasoning_content 和 content,只读后者会把思考模型看成空白。
3. 价格为什么看起来便宜
官方挂牌和本站可见价是两套数字,不能用一句“0.2x”直接换算。2026-09-08 核对本站模型页 Offer:输入 ¥0.84、输出 ¥4.2 /百万 tokens,目录倍率 0.2x。同一天 Moonshot 定价页对 kimi-k3 写的是缓存命中 ¥2.00、缓存未命中 ¥20.00、输出 ¥100.00 /百万 tokens,窗口 1,048,576 tokens。
| 口径 | 怎么读 | 不要当成 |
|---|---|---|
| 官方挂牌 | 未命中 ¥20 / 输出 ¥100 | 本站实付 |
| 官方缓存命中 | ¥2.00 /百万 tokens | 每次请求都命中 |
| 本站可见参考价 | ¥0.84 / ¥4.2 | 合同单价或汇率折算 |
| 本站倍率 | 0.2x | 官方价 × 0.2 的保证结果 |
| 最终扣费 | 控制台流水 | 页面上的参考算术 |
0.2x 解释的是渠道目录倍率,不是“官方未命中价打二折后一定等于 ¥0.84”。充值汇率、缓存命中、重试和工具循环都会改最终数字。算法见倍率指南。
4. 企业级怎么用才稳
这里的稳定不是未验证的可用性百分比,而是可隔离、可核对、可回滚:
- 密钥隔离:预发、生产和评测各一把 Key。泄露时只轮转一把。
- 额度上限:给生产 Key 设额度,避免一次循环打穿余额。
- 错误可观察:把 HTTP 状态、错误码、model、prompt/completion tokens 写入自己的日志,周对账用控制台 CSV 对这三列。
- 思考字段:生产解析只要最终答案,就明确读
content;调试才打开推理增量。
5. 和 K2.7 Code 怎么选
K3 是旗舰知识与长程工作模型;Kimi K2.7 Code 是编码方向模型。官方定价页给 K2.7 Code 的窗口是 262,144 tokens,未命中 ¥6.50、输出 ¥27.00;本站可见参考价是输入 ¥0.308、输出 ¥1.4。两者不是同一个产品。
| 判断 | Kimi K3 | Kimi K2.7 Code |
|---|---|---|
| 模型 ID | kimi-k3 | kimi-k2.7-code |
| 官方窗口 | 1,048,576 tokens | 262,144 tokens |
| 官方未命中 / 输出 | ¥20 / ¥100 | ¥6.50 / ¥27 |
| 本站可见价 | ¥0.84 / ¥4.2 | ¥0.308 / ¥1.4 |
| 更合适 | 长文档、知识工作、长程工具 | 仓库内编码、补丁、测试修复 |
控制台如果还能看到 kimi-k2.7-code-highspeed,那是高速档。本站目前没有对应公开详情页和目录价,这里不编数字。迁移成本通常只改 model,但仍需用同一批真实任务对照,不要用新闻标题代替实验。
6. 真实接入坑
这些坑来自公开开发者讨论里反复出现的失败模式,写成检查项,不引用任何第三方站点:
- 把
kimi-k3和kimi-k2.7-code写进同一套系统提示,再抱怨“编码变笨”或“长文变贵”。 - 继续发送
thinking.type: disabled。官方当前口径是 K3 始终思考,关不掉;只能把reasoning_effort调到low。 - HTTP 200 但界面空白:推理在
reasoning_content。见空回复排查。 - 按 1M 窗口把整库反复塞进每次请求。官方说明缓存命中有前缀长度门槛,短请求不会被缓存。
- 把官方联网搜索参数抄进生产。官方定价页写明该能力正在升级、文档已过时。
家族选型还可以看国产模型 API 中转选型,那篇按任务选家族,本篇只把 K3 的 ID、价和窗口写清楚。
7. 一组可核对的费用例子
下面只演示算术,不是账单截图。假设走本站可见参考价 ¥0.84 / ¥4.2,且没有缓存命中、没有重试。
- 输入 20,000 tokens、输出 4,000 tokens:0.84×0.02 + 4.2×0.004 = 0.0336 元。
- 同一笔若按官方未命中价:20×0.02 + 100×0.004 = 0.80 元。目录价把这一笔缩小了一个数量级,前提是控制台确实按可见参考价结算。
- 若代理把同一份 80K 说明读 8 次,输入先变成 640K。便宜也会被放大。企业要限工具轮次,而不是只谈倍率。
8. Cursor / Codex / 自建服务怎么接
共同点只有两行:Base URL 指向 https://www.codex789.com/v1,模型填 kimi-k3。
- 自建后端超时要覆盖一次完整工具循环,不要用单次 HTTP 默认 15 秒。
- IDE 里把 K3 和生产编码模型拆开:长文档用 K3,补丁用 K2.7 Code 或别的编码档。
- 流式必须按 SSE 拼接。只读最终
content会把思考过程丢掉,也可能把整段看成失败。
9. 稳定不等于不会 429
企业接入仍会遇到限额。稳定的定义是错误可读、可退避、可换 Key 隔离,而不是承诺永远成功。
- 429 时读错误体,区分 RPM、TPM 和余额。
- 对工具循环设最大步数,防止自己打自己。
- 生产流量不要和评测脚本共用一把 Key。
10. 常见问题
Kimi K3 中转站是什么?
通过 OpenAI 兼容 Base URL 调用 kimi-k3 的渠道入口。权限、分组和账单以控制台为准。
0.2x 是不是官方价打二折?
目录倍率是 0.2x,但官方未命中价 × 0.2 并不等于本站可见的 ¥0.84 / ¥4.2。以控制台为准。
K3 能不能关掉思考?
官方当前文档写明关不了。觉得思考太长,把 reasoning_effort 设为 low。
企业能不能全员共用一把 Key?
能跑,但出问题不可追溯。至少按环境拆 Key,并给生产 Key 加额度上限。
规格来源:Moonshot《旗舰模型 Kimi K3 定价》与《Kimi K3》快速开始(模型 ID kimi-k3、窗口 1,048,576 tokens、未命中 ¥20 / 输出 ¥100、思考不可关),核对日期 2026-09-08。本站可见价与倍率以控制台为准。