本站参考价:输入 ¥0.84 / 输出 ¥4.2 每百万 tokens(渠道目录参考价 × 0.2x;最终扣费以控制台为准)。

Moonshot AI · 文本模型

Kimi K3 API 中转

Moonshot AI 的旗舰长文本模型,通过 island AI Coding 的 OpenAI 兼容接口中转调用,模型代号为 kimi-k3。目录标注 1M tokens 超长上下文,能力标签为视觉理解、长文本、思维链;国产模型人民币渠道站内倍率 0.2x(本站售价 = 渠道目录参考价 × 0.2),本站售价输入 ¥4.2、输出 ¥21 每百万 tokens,是本站 Kimi 系列的最高价位档。

更新日期:2026-09-01·模型代号:kimi-k3

1. Kimi K3 是什么

Kimi K3(kimi-k3)由 Moonshot AI 提供,是国产阵营中长文本能力的代表性旗舰:首页模型卡对其的定位是「超强长文档分析与中文多轮推理」,配合 1M tokens 的超大窗口与思维链标签,专为重材料、重逻辑的任务设计。

它的目录画像:

  • 1M tokens 上下文:整卷材料一次性装入,免切分。
  • 能力标签:视觉理解、长文本、思维链,读图、读长文、逐步推演三项齐备。
  • 本站 ¥4.2/¥21 每百万 tokens:渠道目录参考价 ¥21/¥105 与国际同档型号持平,站内倍率 0.2x,缓存读 ¥0.42、缓存写免费。

2. 超长文档分析工作流

把大材料交给 K3 时,推荐三段式的固定打法:

  1. 整体速览:先要求模型输出材料的章节地图与核心论点清单,确认它「读懂了结构」;
  2. 定向追问:围绕第 1 步的地图逐节深入——财务口径、责任条款、实验方法等,每轮只锁一个主题;
  3. 交叉复核:让模型引用原文位置回答「依据在哪一段」,把幻觉风险压到最低;
  4. 结构化沉淀:把最终结论固化为表格或 JSON 字段,交付给下游系统直接消费,而不是停留在对话里。

这套流程的价值在于把 1M 窗口当作「全程在场」的资料库,而不是一次性的摘要机器;配合思维链标签,推理路径可见、结论可追溯。

3. 适用场景

研究报告精读

行业研报、学术长文的全文级解读与观点提取,中文表述的还原度是其相对优势。

合同与合规审阅

成套协议的责任条款梳理与冲突比对,配合思维链输出推理依据便于法务复核。

中文多轮深度对话

需要长期记忆上下文的咨询式对话与知识库问答,多轮之后仍能咬住早期设定。

代码库级理解

大型仓库的架构梳理与跨文件依赖分析——把核心目录树与关键模块一次性装入窗口,从全局视角回答「这个功能改哪里」。

4. API 最小示例

cURL · OpenAI 兼容调用
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [
      {"role": "user", "content": "先给出这份研报的章节地图,再列出三个最反直觉的结论"}
    ]
  }'

Python SDK

Python · openai SDK
from openai import OpenAI

client = OpenAI(
    base_url="https://www.codex789.com/v1",
    api_key="sk-codex789-your-api-key",
)

resp = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "对比这两份合同的违约条款差异"}],
)
print(resp.choices[0].message.content)

5. 价格与倍率说明

计费项(元 / 百万 tokens)渠道目录参考价本站售价
输入¥21¥4.2
输出¥105¥21
缓存读¥2.1¥0.42
缓存写¥0(不收费)不计费
计费倍率0.2x(本站售价 = 渠道目录参考价 × 0.2)

系列内选型:K3 是本站 Kimi 系列的最高价位档——K2.6(¥1.33/¥5.6)与 K2.7 Code(¥1.54/¥7.0)覆盖预算敏感的通用与代码任务,K3 以 1M 窗口与思维链标签服务重材料任务。

长文本场景的成本特性:这类任务的输入体量天然偏大——一次整卷分析仅输入就可能达到数十万 tokens,按本站 ¥4.2/MT 折算单次约几元钱(以 30 万 tokens 输入为例约 ¥1.26)。正因如此,「免切分直投」省下的拼接与重试成本,往往比单价差更值得关注。

6. 常见问题

Kimi K3 的调用代号是什么?

调用代号为 kimi-k3,由 Moonshot AI 提供,具体可用状态以控制台模型列表为准。

1M tokens 的窗口实际能装下什么?

整卷研究报告、成套合同文本或大型代码库的核心文件可以一次性装入分析;建议用控制台的 Token 统计实测自己的典型材料,确认水位后再定批量策略——宁可保守预估,也别让截断毁掉整场分析。

「思维链」标签对使用者意味着什么?

表示模型在作答前会展开多步推理过程,适合逻辑推演类任务;对步骤可解释性有要求的分析场景尤其受益。

和国际旗舰的长文本型号相比该怎么选?

中文多轮语境下的语感与本土表达是 Kimi K3 的传统强项,且渠道目录参考价 ¥21/¥105 与国际同档相当、站内倍率 0.2x;纯英文或特定生态绑定任务可另行对比国际型号实测。

中转调用的计费口径是什么?

本站售价按渠道目录参考价 ¥21/¥105 × 0.2 计:输入 ¥4.2、输出 ¥21、缓存读 ¥0.42 每百万 tokens,缓存写不计费;按 Token 用量逐条计入控制台账单。