1. DeepSeek V4 Flash 是什么
DeepSeek V4 Flash(deepseek-v4-flash-0731)是 DeepSeek V4 系列中面向轻量与高性价比场景的 Flash 档型号,代号后缀 0731 对应其版本日期。在本站它属于国产模型人民币按量渠道,与 Claude、GPT、Grok、Gemini 等美元渠道型号共用同一个 OpenAI 兼容网关。
两点在接入前需要知道:
- 计费货币为人民币:价格直接对照 DeepSeek 官网人民币目录价折算,站内倍率输入/输出 0.3x、缓存读 0.7x。
- 分时段计价:DeepSeek 官方将一天划分为平常与高峰两个时段,两个时段的基准价不同,本站售价同步跟随。
模型的上下文窗口等规格参数以控制台模型列表与 DeepSeek 官方目录为准,本页不另行标注。
2. 人民币价格与分时段计费
| 计费项(元 / 百万 tokens) | 时段 | 官网价格 | 本站售价 |
|---|---|---|---|
| 输入 | 平常 | ¥1.54 | ¥0.462 |
| 高峰 | ¥3.08 | ¥0.924 | |
| 输出 | 平常 | ¥4.62 | ¥1.386 |
| 高峰 | ¥9.24 | ¥2.772 | |
| 缓存读 | 平常 | ¥0.049 | ¥0.0343 |
| 高峰 | ¥0.098 | ¥0.0686 | |
| 计费倍率 | 输入/输出 0.3x、缓存读 0.7x | ||
| 缓存写 | 官方未提供单价,不计费 | ||
时段划分(北京时间):平常时段为 0–9 时、12–14 时、18–24 时;高峰时段为 9–12 时、14–18 时。工作日白天的大部分调用会落在高峰时段,如果任务对延迟不敏感,把批量任务安排在平常时段执行可以直接把单价压低一半。
结算口径:本站售价按官网价格 × 站内倍率计算(输入/输出 0.3x、缓存读 0.7x),调用明细与时段归属以控制台账单为准。
价格口径:本站分时倍率和最终扣费以控制台为准;上游缓存、输入与输出计费规则可对照 DeepSeek 官方定价说明。核对日期:2026-08-29。
3. 选型参考
基于价格事实的选型建议:
- 与 V4 Pro 的关系:V4 Pro(0813 版)平常时段输入 ¥1.386、输出 ¥4.158,约为 Flash 档的 3 倍单价;预算敏感的常规任务优先 Flash 档,重推理任务再升级 Pro。
- 与其他国产模型对比:国产渠道中 MiniMax、GLM、Kimi、MiMo、Qwen 的倍率为 0.2x,DeepSeek 输入/输出为 0.3x、缓存读为 0.7x——但 DeepSeek 官网基准价本身较低,折算后的本站单价仍处于国产渠道的中低区间,应以最终售价而非倍率做横向比较。
- 缓存利用:本站缓存读单价约为输入价的 1/12(平常时段),重复前缀明显的批量任务(固定系统提示词、模板化文档处理)收益明显。
4. API 调用示例
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-0731",
"messages": [
{"role": "user", "content": "用三句话总结分时段计费对批量任务成本的影响"}
]
}'
Python SDK
from openai import OpenAI
client = OpenAI(
base_url="https://www.codex789.com/v1",
api_key="sk-codex789-your-api-key",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "把这份需求文档拆成任务清单"}],
)
print(resp.choices[0].message.content)
5. 常见问题
DeepSeek V4 Flash 的调用代号是什么?
调用代号为 deepseek-v4-flash-0731,由 DeepSeek 提供,具体可用状态以控制台模型列表为准。
为什么 DeepSeek 系列的倍率是 0.3x?
国产模型人民币渠道按厂商统一倍率,DeepSeek 输入/输出为 0.3x、缓存读为 0.7x,其余国产模型为 0.2x;倍率以控制台实时展示为准。
平常时段和高峰时段怎么划分?
按北京时间划分:平常时段为 0–9 时、12–14 时、18–24 时;高峰时段为 9–12 时、14–18 时。高峰时段官网基准价上调,本站售价随之上浮。
缓存命中怎么计费?
缓存读按官网价 × 0.7 计费:平常时段本站 ¥0.0343 每百万 tokens(官网 ¥0.049);高峰时段本站 ¥0.0686(官网 ¥0.098)。官方未提供缓存写单价,故不计费。
怎么接入调用?
使用 OpenAI 兼容接口,Base URL 为 https://www.codex789.com/v1,将 model 参数设为 deepseek-v4-flash-0731 即可,与调用其他模型的方式一致。