本站参考价:输入 ¥0.609 / 输出 ¥1.218 每百万 tokens(渠道目录参考价 × 0.2x;最终扣费以控制台为准)。

小米 · 文本模型 · 人民币渠道

小米 MiMo v2.5 Pro API 中转

小米的 MiMo v2.5 Pro,模型代号为 mimo-v2.5-pro,通过 island AI Coding 的 OpenAI 兼容接口中转调用。国产模型人民币渠道站内倍率 0.2x(本站售价 = 渠道目录参考价 × 0.2),是标准版 MiMo v2.5 的约 3 倍价、仍处于国产渠道低价位段——本页渠道目录价格为定价目录公示数据。

更新日期:2026-09-01·模型代号:mimo-v2.5-pro

1. MiMo v2.5 Pro 是什么

MiMo v2.5 Pro(mimo-v2.5-pro)是小米 MiMo 系列的进阶档,与标准版 MiMo v2.5 构成两档阵容。全天统一价、无分时段规则。

Pro 与标准版的能力差异以小米官方目录说明为准;上下文窗口等规格以控制台模型列表为准。

2. 人民币价格表

计费项(元 / 百万 tokens)渠道目录参考价本站售价
输入¥3.045¥0.609
输出¥6.09¥1.218
缓存读¥0.0252¥0.00504
缓存写渠道目录未列出单价,不计费
计费倍率0.2x(本站售价 = 渠道目录参考价 × 0.2)

结算口径:本站售价按渠道目录参考价 × 站内倍率 0.2x 计算,全天统一价,明细以控制台账单为准。

3. 选型参考

  • 同系两档怎么分:标准版 ¥0.196/¥0.392、Pro ¥0.609/¥1.218。高吞吐简单任务留在标准版,效果不足的环节再换 Pro——批量场景里「部分请求升级」比全量升级更省。
  • 低价位段横向:Pro 输入 ¥0.609 高于 DeepSeek V4 Flash 平常档(¥0.462/¥1.386)、输出 ¥1.218 更低;与 MiniMax M2.7(¥0.42/¥1.68)相比输入高、输出低,输出占比大的任务 Pro 更划算。
  • 缓存读不到输入价的 1/100:¥0.00504 的缓存读适合系统提示固定、多轮重放上下文的会话型应用,命中率越高摊薄越明显。

4. 用失败样本升级,而不是全量切 Pro

MiMo v2.5 Pro 更适合作为质量兜底档,而不是仅凭“Pro”名称替换全部请求。一个可审计的路由流程是:标准版先生成,应用按 JSON Schema、必填字段、长度和业务枚举做确定性校验,仅把失败样本重新提交给 Pro,并记录升级原因。

  1. 为每类任务定义机器可判断的验收规则,例如字段完整、数值范围与枚举合法。
  2. 标准版请求通过规则后直接进入下游;失败请求保存脱敏输入和失败类型。
  3. 只将失败样本切换到 mimo-v2.5-pro,最多重试一次。
  4. 分别统计标准版一次通过率、升级比例、Pro 修复率和最终人工复核率。
10 万次任务示例输入假设输出假设估算总费用
全部使用 MiMo v2.5 Pro5,000 万 tokens1,000 万 tokens约 ¥42.63
标准版全量执行5,000 万 tokens1,000 万 tokens约 ¥13.72
其中 15% 失败样本再用 Pro额外 750 万 tokens额外 150 万 tokens总计约 ¥20.1145

这个算例只比较当前单价:全量标准版费用加 15% Pro 重跑费用,比全量 Pro 约低 52.8%。它不预设真实升级比例;生产决策必须用自己的校验日志替换示例中的 15%。

5. Pro 适合承担什么边界

  • 适合作为结构化输出兜底:标准版在多字段抽取或多约束改写中未通过应用校验时,Pro 承担第二次生成。
  • 适合小比例高价值样本:对人工复核昂贵、但可以先自动识别失败的请求,按失败原因选择性升级。
  • 不适合替代规则引擎:固定格式转换、精确数值计算和枚举映射能用确定性代码解决时,继续调用更贵模型只会增加成本和波动。
  • 不适合无边界自动重试:请求涉及发送、写入或扣费时,应用必须使用幂等键并限制重试次数。

排查 Pro 费用异常

Pro 页的升级建议是路由策略,不是模型效果保证。应保留标准版失败样本的脱敏输入、校验错误和重试次数,再按固定规则决定是否提交 Pro;没有失败分类和样本量时,不应把示例中的 15% 升级比例当作生产基线。涉及账单、写入或外部发送的流程,还需在应用侧设置幂等键和人工闸门。

价格、缓存计费和模型可见性可能随控制台配置变化。发布前复核模型代号 mimo-v2.5-pro、输入/输出单价与分组权限,并将复核日期写入变更记录;页面中的成本数字仅用于透明计算,不替代实时账单。

在高价值流程中,Pro 的额外费用应对应明确的失败类型,例如 JSON 校验失败、字段缺失或多轮指令无法保持约束;不要用主观“感觉质量不够”触发升级。将失败原因分组后,才能比较标准版一次通过、Pro 修复和人工复核三条路径的真实成本,并在提示词调整后识别升级比例是否异常。

先按模型代号拆分账单,核对升级比例是否突然上升;再检查校验规则是否过严、标准版提示词是否变更、以及同一失败请求是否被多次重放。缓存读价格低不代表所有上下文都会命中,动态前缀和字段顺序变化都应单独验证。

6. API 调用示例

cURL · OpenAI 兼容调用
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mimo-v2.5-pro",
    "messages": [
      {"role": "user", "content": "从这份工单里抽取:故障现象、影响范围、期望解决时间,输出 JSON"}
    ]
  }'

Python SDK

Python · openai SDK
from openai import OpenAI

client = OpenAI(
    base_url="https://www.codex789.com/v1",
    api_key="sk-codex789-your-api-key",
)

resp = client.chat.completions.create(
    model="mimo-v2.5-pro",
    messages=[{"role": "user", "content": "把这篇中文新闻稿改写成英文通稿,保留数据"}],
)
print(resp.choices[0].message.content)

7. 常见问题

小米 MiMo v2.5 Pro 的调用代号是什么?

调用代号为 mimo-v2.5-pro,由小米提供,具体可用状态以控制台模型列表为准。

MiMo v2.5 Pro 和 v2.5 价差多大?

本站售价 v2.5 Pro 为 ¥0.609/¥1.218,v2.5 为 ¥0.196/¥0.392,每百万 tokens,Pro 约为标准版的 3 倍价。

缓存读怎么计费?

缓存读本站 ¥0.00504 每百万 tokens(渠道目录 ¥0.0252 × 0.2),不到输入价的 1/100;缓存写渠道目录未列出单价,本站不计费。

倍率是多少?

站内倍率 0.2x,国产模型人民币渠道统一(DeepSeek 除外为 0.3x);以控制台实时展示为准。