Kimi K3 · 企业接入

Kimi K3 API 中转站?模型 ID、价格、1M 上下文与 K2.7 Code 对比

要的不是一句“更强”,而是:模型 ID 能不能直接填、官方价和本站可见价怎么分开读、1M 窗口怎么用、团队密钥怎么隔离。本篇把 Moonshot 公开规格和本站渠道目录价分开写。

更新日期:2026-09-08·证据:本站 /v1/models 未授权探针与官方规格核对
模型 IDkimi-k3
官方挂牌未命中 ¥20 / 输出 ¥100
本站可见价¥0.84 / ¥4.2 · 0.2x
上下文1,048,576 tokens
2026-09-08 对本站 /v1/models 未携带 API Key 的请求返回 HTTP 401 和 API_KEY_REQUIRED
2026-09-08 探针:GET https://www.codex789.com/v1/models 未携带 Key,返回 HTTP 401,code=API_KEY_REQUIRED。这只证明认证门禁存在,不证明 Kimi K3 的延迟、成功率和质量。

1. 先给结论:谁该用 Kimi K3 中转

Kimi K3 适合已经在用 OpenAI 兼容 SDK、Cursor 或自建后端,需要把长文档、长程工具循环和中文知识工作接到同一条 Base URL 的团队。官方模型 ID 是 kimi-k3,上下文窗口 1,048,576 tokens,思考模式始终开启,只能用 reasoning_effort 调强度,不能关掉。

中转的价值不在口号,而在账本和隔离:同一入口 https://www.codex789.com/v1、可见目录价、以及按环境拆 Key。它不是免费号池,也不是把官方 ¥20 / ¥100 自动变成账单上的 ¥0.84 / ¥4.2。

2. 模型 ID 与最小接入

公开详情页是Kimi K3 API 中转,调用代号填 kimi-k3。不要把编码模型 kimi-k2.7-code 或控制台里的高速档当成 K3。旧 URL 如果出现点号写法,规范页仍是短横线 slug。

curl
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k3","reasoning_effort":"low","messages":[{"role":"user","content":"用三条要点说明这次发布失败原因"}]}'

Python 只改 Base URL 和 model。上线前先打 /v1/models 或看控制台,确认分组里真有 kimi-k3。流式响应会同时给 reasoning_contentcontent,只读后者会把思考模型看成空白。

3. 价格为什么看起来便宜

官方挂牌和本站可见价是两套数字,不能用一句“0.2x”直接换算。2026-09-08 核对本站模型页 Offer:输入 ¥0.84、输出 ¥4.2 /百万 tokens,目录倍率 0.2x。同一天 Moonshot 定价页对 kimi-k3 写的是缓存命中 ¥2.00、缓存未命中 ¥20.00、输出 ¥100.00 /百万 tokens,窗口 1,048,576 tokens。

口径怎么读不要当成
官方挂牌未命中 ¥20 / 输出 ¥100本站实付
官方缓存命中¥2.00 /百万 tokens每次请求都命中
本站可见参考价¥0.84 / ¥4.2合同单价或汇率折算
本站倍率0.2x官方价 × 0.2 的保证结果
最终扣费控制台流水页面上的参考算术

0.2x 解释的是渠道目录倍率,不是“官方未命中价打二折后一定等于 ¥0.84”。充值汇率、缓存命中、重试和工具循环都会改最终数字。算法见倍率指南

4. 企业级怎么用才稳

这里的稳定不是未验证的可用性百分比,而是可隔离、可核对、可回滚:

  • 密钥隔离:预发、生产和评测各一把 Key。泄露时只轮转一把。
  • 额度上限:给生产 Key 设额度,避免一次循环打穿余额。
  • 错误可观察:把 HTTP 状态、错误码、model、prompt/completion tokens 写入自己的日志,周对账用控制台 CSV 对这三列。
  • 思考字段:生产解析只要最终答案,就明确读 content;调试才打开推理增量。

5. 和 K2.7 Code 怎么选

K3 是旗舰知识与长程工作模型;Kimi K2.7 Code 是编码方向模型。官方定价页给 K2.7 Code 的窗口是 262,144 tokens,未命中 ¥6.50、输出 ¥27.00;本站可见参考价是输入 ¥0.308、输出 ¥1.4。两者不是同一个产品。

判断Kimi K3Kimi K2.7 Code
模型 IDkimi-k3kimi-k2.7-code
官方窗口1,048,576 tokens262,144 tokens
官方未命中 / 输出¥20 / ¥100¥6.50 / ¥27
本站可见价¥0.84 / ¥4.2¥0.308 / ¥1.4
更合适长文档、知识工作、长程工具仓库内编码、补丁、测试修复

控制台如果还能看到 kimi-k2.7-code-highspeed,那是高速档。本站目前没有对应公开详情页和目录价,这里不编数字。迁移成本通常只改 model,但仍需用同一批真实任务对照,不要用新闻标题代替实验。

6. 真实接入坑

这些坑来自公开开发者讨论里反复出现的失败模式,写成检查项,不引用任何第三方站点:

  • kimi-k3kimi-k2.7-code 写进同一套系统提示,再抱怨“编码变笨”或“长文变贵”。
  • 继续发送 thinking.type: disabled。官方当前口径是 K3 始终思考,关不掉;只能把 reasoning_effort 调到 low
  • HTTP 200 但界面空白:推理在 reasoning_content。见空回复排查
  • 按 1M 窗口把整库反复塞进每次请求。官方说明缓存命中有前缀长度门槛,短请求不会被缓存。
  • 把官方联网搜索参数抄进生产。官方定价页写明该能力正在升级、文档已过时。

家族选型还可以看国产模型 API 中转选型,那篇按任务选家族,本篇只把 K3 的 ID、价和窗口写清楚。

7. 一组可核对的费用例子

下面只演示算术,不是账单截图。假设走本站可见参考价 ¥0.84 / ¥4.2,且没有缓存命中、没有重试。

  • 输入 20,000 tokens、输出 4,000 tokens:0.84×0.02 + 4.2×0.004 = 0.0336 元。
  • 同一笔若按官方未命中价:20×0.02 + 100×0.004 = 0.80 元。目录价把这一笔缩小了一个数量级,前提是控制台确实按可见参考价结算。
  • 若代理把同一份 80K 说明读 8 次,输入先变成 640K。便宜也会被放大。企业要限工具轮次,而不是只谈倍率。

8. Cursor / Codex / 自建服务怎么接

共同点只有两行:Base URL 指向 https://www.codex789.com/v1,模型填 kimi-k3

  • 自建后端超时要覆盖一次完整工具循环,不要用单次 HTTP 默认 15 秒。
  • IDE 里把 K3 和生产编码模型拆开:长文档用 K3,补丁用 K2.7 Code 或别的编码档。
  • 流式必须按 SSE 拼接。只读最终 content 会把思考过程丢掉,也可能把整段看成失败。

9. 稳定不等于不会 429

企业接入仍会遇到限额。稳定的定义是错误可读、可退避、可换 Key 隔离,而不是承诺永远成功。

  • 429 时读错误体,区分 RPM、TPM 和余额。
  • 对工具循环设最大步数,防止自己打自己。
  • 生产流量不要和评测脚本共用一把 Key。

10. 常见问题

Kimi K3 中转站是什么?

通过 OpenAI 兼容 Base URL 调用 kimi-k3 的渠道入口。权限、分组和账单以控制台为准。

0.2x 是不是官方价打二折?

目录倍率是 0.2x,但官方未命中价 × 0.2 并不等于本站可见的 ¥0.84 / ¥4.2。以控制台为准。

K3 能不能关掉思考?

官方当前文档写明关不了。觉得思考太长,把 reasoning_effort 设为 low

企业能不能全员共用一把 Key?

能跑,但出问题不可追溯。至少按环境拆 Key,并给生产 Key 加额度上限。

规格来源:Moonshot《旗舰模型 Kimi K3 定价》与《Kimi K3》快速开始(模型 ID kimi-k3、窗口 1,048,576 tokens、未命中 ¥20 / 输出 ¥100、思考不可关),核对日期 2026-09-08。本站可见价与倍率以控制台为准。