本站参考价:输入 ¥0.196 / 输出 ¥0.392 每百万 tokens(渠道目录参考价 × 0.2x;最终扣费以控制台为准)。

小米 · 文本模型 · 人民币渠道

小米 MiMo v2.5 API 中转

小米的 MiMo v2.5,模型代号为 mimo-v2.5,通过 island AI Coding 的 OpenAI 兼容接口中转调用。国产模型人民币渠道站内倍率 0.2x(本站售价 = 渠道目录参考价 × 0.2),是本站国产模型的最低价档,缓存读低至 ¥0.00392——本页渠道目录价格为定价目录公示数据。

更新日期:2026-09-01·模型代号:mimo-v2.5

1. MiMo v2.5 是什么

MiMo v2.5(mimo-v2.5)是小米的文本模型,与同系的 MiMo v2.5 Pro 构成本站小米渠道的两档阵容。全天统一价、无分时段规则。

MiMo 系列的产品定位与能力以小米官方目录说明为准;上下文窗口等规格以控制台模型列表为准。

2. 人民币价格表

计费项(元 / 百万 tokens)渠道目录参考价本站售价
输入¥0.98¥0.196
输出¥1.96¥0.392
缓存读¥0.0196¥0.00392
缓存写¥0(不收费)不计费
计费倍率0.2x(本站售价 = 渠道目录参考价 × 0.2)

结算口径:本站售价按渠道目录参考价 × 站内倍率 0.2x 计算,全天统一价,明细以控制台账单为准。

3. 选型参考

  • 国产渠道最低价档:输入 ¥0.196、输出 ¥0.392,低于 MiniMax M2.7(¥0.42/¥1.68)的一半,适合分类、抽取、批量改写等高吞吐简单任务。
  • 缓存读是输入价的 1/50:¥0.00392 的缓存读在多轮对话与固定系统提示场景下几乎可以忽略,长会话成本主要由首轮输入与输出构成。
  • 同系升级路径:效果不足时升 MiMo v2.5 Pro(¥0.609/¥1.218,约 3 倍价);需要更强的通用能力则跨到 DeepSeek V4 Flash 平常档(¥0.462/¥1.386)。

4. 批量任务成本怎么估算

MiMo v2.5 的价格优势只有换成具体任务量才有意义。下表使用本站当前输入 ¥0.196、输出 ¥0.392、缓存读 ¥0.00392 每百万 tokens 计算;它是成本估算,不代表模型速度或任务通过率。实际账单还会受提示词长度、输出截断和缓存命中影响。

任务假设Token 构成估算费用决策意义
1 万条评论分类输入 500 万,输出 20 万约 ¥1.0584适合先跑低价基线,再抽样复核标签
10 万条商品标题规范化输入 800 万,输出 400 万约 ¥3.136输出占比提高后,输出价格开始主导成本
5 万轮固定提示会话缓存读 1 亿,新增输入 1,000 万,输出 500 万约 ¥4.312固定系统提示真正命中缓存时,重复上下文成本显著下降

计算方法为“各类 tokens ÷ 1,000,000 × 对应本站单价”后求和。例如评论分类的输入费为 5 × ¥0.196,输出费为 0.2 × ¥0.392。上线前应从真实日志取输入、输出的 P50 与 P95,而不是用一条短提示外推整批费用。

5. 哪些任务适合,哪些应升级

任务状态优先选择验收方式
标签集合固定、字段少、可规则校验MiMo v2.5检查枚举值、字段数量和空值率
批量改写允许人工抽检MiMo v2.5按业务类别分层抽样,不只看平均通过率
复杂指令经常漏字段或破坏 JSON失败样本升级 MiMo v2.5 Pro保存失败原因,只升级未通过校验的请求
涉及图片输入、事实核验或不可逆写入改用对应能力模型或增加人工确认不要用低价文本模型替代缺失的能力与审核

三类常见接入问题

这页的选择建议只基于当前公开价格、代号和任务约束,不把“最低价档”当作质量或速度证明。上线前可先用一组固定样本做小批量验收:记录输入与输出 token、结构化字段通过情况、人工抽检结果和失败原因,再决定是否扩大用量。若任务包含事实核验、代码执行或不可逆写入,应把 MiMo v2.5 放在草稿或分类环节,并由规则或人工完成最终确认。

当模型列表、价格或可用分组发生变化时,应以控制台实时数据为准,并同步更新本页表格、成本算例和调用示例;历史账单不能直接推断下一周期价格。这样可以让页面上的成本结论保持可复核,也避免把一次配置状态误写成长期服务承诺。

批次执行还应保存任务 ID 和幂等键,网络重试时先查已有结果,避免相同输入重复扣费或覆盖已审核数据。若抽检发现错误率超出业务阈值,应暂停该批次、保留失败样本并回滚下游写入,而不是继续追加模型重试。

对于批处理,建议把任务拆成“预检、调用、校验、抽检”四步:预检过滤空文本和超长输入,调用阶段固定模型代号,校验阶段拒绝缺字段或非法枚举,抽检阶段保存少量脱敏样本。每一步都应记录批次日期、token 统计和失败类型;这些记录比单次成功响应更适合判断是否继续使用该型号。

  • 返回格式漂移:在提示词中给出 JSON Schema,并在应用侧验证;校验失败后最多重试一次,再升级型号,避免无限重放。
  • 缓存费用没有下降:确认固定前缀完全一致、缓存字段已启用且控制台账单出现缓存读用量;提示词中动态时间戳会破坏命中。
  • 调用显示模型不存在:API 参数使用 mimo-v2.5,同时确认密钥分组可见该模型;不要从页面 URL mimo-v2-5 反推调用代号。

6. API 调用示例

cURL · OpenAI 兼容调用
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mimo-v2.5",
    "messages": [
      {"role": "user", "content": "判断这条用户评论的情感倾向,输出 positive/negative/neutral"}
    ]
  }'

Python SDK

Python · openai SDK
from openai import OpenAI

client = OpenAI(
    base_url="https://www.codex789.com/v1",
    api_key="sk-codex789-your-api-key",
)

resp = client.chat.completions.create(
    model="mimo-v2.5",
    messages=[{"role": "user", "content": "把这一万条商品标题统一成「品牌+品类+规格」格式"}],
)
print(resp.choices[0].message.content)

7. 常见问题

小米 MiMo v2.5 的调用代号是什么?

调用代号为 mimo-v2.5,由小米提供,具体可用状态以控制台模型列表为准。

MiMo v2.5 有多便宜?

本站售价输入 ¥0.196、输出 ¥0.392 每百万 tokens,是本站国产模型的最低价档;缓存读仅 ¥0.00392,约为输入价的 1/50。

v2.5 和 v2.5 Pro 怎么选?

v2.5 Pro 输入 ¥0.609、输出 ¥1.218,约为 v2.5 的 3 倍价。高吞吐简单任务用 v2.5 控成本,效果不足时再升 Pro,缓存读两者都极低。

倍率是多少?

站内倍率 0.2x,国产模型人民币渠道统一(DeepSeek 除外为 0.3x);以控制台实时展示为准。