1. Highspeed 档是什么
MiniMax-M2.7-highspeed 是 MiniMax M2.7 的高速档版本:面向对响应速度更敏感的场景。本站渠道目录未公布该档位的公开对标价格,所以本页无法给出渠道目录/本站倍数对照,本站售价以控制台展示为准、计费以控制台账单为准。
可以对照的已知信息:标准档 M2.7 与 M3 本站输入 ¥0.42、输出 ¥1.68,缓存读 ¥0.084、缓存写免费。高速档的缓存读写单价以控制台展示为准,本页不作预估;上下文等规格参数同样以控制台模型列表为准。
2. 人民币价格表与缓存计费差异
| 计费项(元 / 百万 tokens) | 渠道目录参考价 | 本站售价 |
|---|---|---|
| 输入 | —(未公布) | 以控制台为准 |
| 输出 | —(未公布) | 以控制台为准 |
| 缓存读 | —(未公布) | 以控制台为准 |
| 缓存写 | —(未公布) | 以控制台为准 |
与标准档的对照:标准档 M2.7 本站 ¥0.42/¥1.68(缓存读 ¥0.084、缓存写免费),价格透明可预算;高速档售价以控制台为准,选型时建议先小批量实测两者的延迟与质量差异再定。
结算口径:站内倍率与 MiniMax 标准档一致为 0.2x,全天统一价,具体单价与明细以控制台账单为准。
3. 选型参考:高速档值不值
- 适合高速档的场景:交互式产品(实时对话、流式补全)对首字延迟敏感的场景,与标准档的单价差相对体验收益通常很小。
- 适合标准档的场景:批量离线处理、高复用系统提示词的任务——标准档价格公开透明(输入 ¥0.42、缓存读 ¥0.084、缓存写免费),综合成本更好预估。
- 一个实用判断:如果单次会话的上下文只写入一次、反复读取(长系统提示词 + 多轮对话),高速档缓存写成本可摊薄;如果每次请求都重建上下文,优先标准档。
4. API 调用示例
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M2.7-highspeed",
"messages": [
{"role": "user", "content": "流式输出这段营销文案的三个备选开头"}
]
}'
Python SDK(流式)
from openai import OpenAI
client = OpenAI(
base_url="https://www.codex789.com/v1",
api_key="sk-codex789-your-api-key",
)
stream = client.chat.completions.create(
model="MiniMax-M2.7-highspeed",
messages=[{"role": "user", "content": "实时总结这段会议转写"}],
stream=True,
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
5. 常见问题
highspeed 和标准档 M2.7 有什么区别?
highspeed 是 M2.7 的高速档版本,面向响应速度更敏感的场景;本站渠道目录未列出该档位的对标价格,本站售价以控制台展示为准。可对照的标准档 M2.7 本站 ¥0.42/¥1.68,缓存读 ¥0.084、缓存写免费。
为什么渠道目录参考价显示为「—」?
MiniMax 本站渠道目录未列出 highspeed 档的公开对标价格,因此无法给出渠道目录/本站倍数对照;站内倍率与 MiniMax 标准档一致为 0.2x,具体售价以控制台展示为准。
高速档的缓存计费要注意什么?
高速档的缓存读写单价同样以控制台展示为准,本页不作预估;已知标准档 M2.7 与 M3 缓存写免费、缓存读 ¥0.084,频繁重建上下文的工作负载建议优先标准档。