1. MiMo v2.5 是什么
MiMo v2.5(mimo-v2.5)是小米的文本模型,与同系的 MiMo v2.5 Pro 构成本站小米渠道的两档阵容。全天统一价、无分时段规则。
MiMo 系列的产品定位与能力以小米官方目录说明为准;上下文窗口等规格以控制台模型列表为准。
2. 人民币价格表
| 计费项(元 / 百万 tokens) | 渠道目录参考价 | 本站售价 |
|---|---|---|
| 输入 | ¥0.98 | ¥0.196 |
| 输出 | ¥1.96 | ¥0.392 |
| 缓存读 | ¥0.0196 | ¥0.00392 |
| 缓存写 | ¥0(不收费) | 不计费 |
| 计费倍率 | 0.2x(本站售价 = 渠道目录参考价 × 0.2) | |
结算口径:本站售价按渠道目录参考价 × 站内倍率 0.2x 计算,全天统一价,明细以控制台账单为准。
3. 选型参考
- 国产渠道最低价档:输入 ¥0.196、输出 ¥0.392,低于 MiniMax M2.7(¥0.42/¥1.68)的一半,适合分类、抽取、批量改写等高吞吐简单任务。
- 缓存读是输入价的 1/50:¥0.00392 的缓存读在多轮对话与固定系统提示场景下几乎可以忽略,长会话成本主要由首轮输入与输出构成。
- 同系升级路径:效果不足时升 MiMo v2.5 Pro(¥0.609/¥1.218,约 3 倍价);需要更强的通用能力则跨到 DeepSeek V4 Flash 平常档(¥0.462/¥1.386)。
4. 批量任务成本怎么估算
MiMo v2.5 的价格优势只有换成具体任务量才有意义。下表使用本站当前输入 ¥0.196、输出 ¥0.392、缓存读 ¥0.00392 每百万 tokens 计算;它是成本估算,不代表模型速度或任务通过率。实际账单还会受提示词长度、输出截断和缓存命中影响。
| 任务假设 | Token 构成 | 估算费用 | 决策意义 |
|---|---|---|---|
| 1 万条评论分类 | 输入 500 万,输出 20 万 | 约 ¥1.0584 | 适合先跑低价基线,再抽样复核标签 |
| 10 万条商品标题规范化 | 输入 800 万,输出 400 万 | 约 ¥3.136 | 输出占比提高后,输出价格开始主导成本 |
| 5 万轮固定提示会话 | 缓存读 1 亿,新增输入 1,000 万,输出 500 万 | 约 ¥4.312 | 固定系统提示真正命中缓存时,重复上下文成本显著下降 |
计算方法为“各类 tokens ÷ 1,000,000 × 对应本站单价”后求和。例如评论分类的输入费为 5 × ¥0.196,输出费为 0.2 × ¥0.392。上线前应从真实日志取输入、输出的 P50 与 P95,而不是用一条短提示外推整批费用。
5. 哪些任务适合,哪些应升级
| 任务状态 | 优先选择 | 验收方式 |
|---|---|---|
| 标签集合固定、字段少、可规则校验 | MiMo v2.5 | 检查枚举值、字段数量和空值率 |
| 批量改写允许人工抽检 | MiMo v2.5 | 按业务类别分层抽样,不只看平均通过率 |
| 复杂指令经常漏字段或破坏 JSON | 失败样本升级 MiMo v2.5 Pro | 保存失败原因,只升级未通过校验的请求 |
| 涉及图片输入、事实核验或不可逆写入 | 改用对应能力模型或增加人工确认 | 不要用低价文本模型替代缺失的能力与审核 |
三类常见接入问题
这页的选择建议只基于当前公开价格、代号和任务约束,不把“最低价档”当作质量或速度证明。上线前可先用一组固定样本做小批量验收:记录输入与输出 token、结构化字段通过情况、人工抽检结果和失败原因,再决定是否扩大用量。若任务包含事实核验、代码执行或不可逆写入,应把 MiMo v2.5 放在草稿或分类环节,并由规则或人工完成最终确认。
当模型列表、价格或可用分组发生变化时,应以控制台实时数据为准,并同步更新本页表格、成本算例和调用示例;历史账单不能直接推断下一周期价格。这样可以让页面上的成本结论保持可复核,也避免把一次配置状态误写成长期服务承诺。
批次执行还应保存任务 ID 和幂等键,网络重试时先查已有结果,避免相同输入重复扣费或覆盖已审核数据。若抽检发现错误率超出业务阈值,应暂停该批次、保留失败样本并回滚下游写入,而不是继续追加模型重试。
对于批处理,建议把任务拆成“预检、调用、校验、抽检”四步:预检过滤空文本和超长输入,调用阶段固定模型代号,校验阶段拒绝缺字段或非法枚举,抽检阶段保存少量脱敏样本。每一步都应记录批次日期、token 统计和失败类型;这些记录比单次成功响应更适合判断是否继续使用该型号。
- 返回格式漂移:在提示词中给出 JSON Schema,并在应用侧验证;校验失败后最多重试一次,再升级型号,避免无限重放。
- 缓存费用没有下降:确认固定前缀完全一致、缓存字段已启用且控制台账单出现缓存读用量;提示词中动态时间戳会破坏命中。
- 调用显示模型不存在:API 参数使用
mimo-v2.5,同时确认密钥分组可见该模型;不要从页面 URLmimo-v2-5反推调用代号。
6. API 调用示例
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.5",
"messages": [
{"role": "user", "content": "判断这条用户评论的情感倾向,输出 positive/negative/neutral"}
]
}'
Python SDK
from openai import OpenAI
client = OpenAI(
base_url="https://www.codex789.com/v1",
api_key="sk-codex789-your-api-key",
)
resp = client.chat.completions.create(
model="mimo-v2.5",
messages=[{"role": "user", "content": "把这一万条商品标题统一成「品牌+品类+规格」格式"}],
)
print(resp.choices[0].message.content)
7. 常见问题
小米 MiMo v2.5 的调用代号是什么?
调用代号为 mimo-v2.5,由小米提供,具体可用状态以控制台模型列表为准。
MiMo v2.5 有多便宜?
本站售价输入 ¥0.196、输出 ¥0.392 每百万 tokens,是本站国产模型的最低价档;缓存读仅 ¥0.00392,约为输入价的 1/50。
v2.5 和 v2.5 Pro 怎么选?
v2.5 Pro 输入 ¥0.609、输出 ¥1.218,约为 v2.5 的 3 倍价。高吞吐简单任务用 v2.5 控成本,效果不足时再升 Pro,缓存读两者都极低。
倍率是多少?
站内倍率 0.2x,国产模型人民币渠道统一(DeepSeek 除外为 0.3x);以控制台实时展示为准。