本站参考价:输入 ¥0.1386 / 输出 ¥0.4158 每百万 tokens(官网目录价 × 0.3x;最终扣费以控制台为准)。

DeepSeek · 文本模型 · 人民币渠道

DeepSeek V4 Flash API 中转

DeepSeek V4 系列的 Flash 档型号,模型代号为 deepseek-v4-flash-0731,通过 island AI Coding 的 OpenAI 兼容接口中转调用。走国产模型人民币按量渠道:站内倍率 0.3x(输入/输出;缓存读 0.7x),并按 DeepSeek 官方的平常/高峰分时段规则计价——本页价格均来自站点定价目录的公开数据。

更新日期:2026-08-25·模型代号:deepseek-v4-flash-0731

1. DeepSeek V4 Flash 是什么

DeepSeek V4 Flash(deepseek-v4-flash-0731)是 DeepSeek V4 系列中面向轻量与高性价比场景的 Flash 档型号,代号后缀 0731 对应其版本日期。在本站它属于国产模型人民币按量渠道,与 Claude、GPT、Grok、Gemini 等美元渠道型号共用同一个 OpenAI 兼容网关。

两点在接入前需要知道:

  • 计费货币为人民币:价格直接对照 DeepSeek 官网人民币目录价折算,站内倍率输入/输出 0.3x、缓存读 0.7x。
  • 分时段计价:DeepSeek 官方将一天划分为平常与高峰两个时段,两个时段的基准价不同,本站售价同步跟随。

模型的上下文窗口等规格参数以控制台模型列表与 DeepSeek 官方目录为准,本页不另行标注。

2. 人民币价格与分时段计费

计费项(元 / 百万 tokens)时段官网价格本站售价
输入平常¥1.54¥0.462
高峰¥3.08¥0.924
输出平常¥4.62¥1.386
高峰¥9.24¥2.772
缓存读平常¥0.049¥0.0343
高峰¥0.098¥0.0686
计费倍率输入/输出 0.3x、缓存读 0.7x
缓存写官方未提供单价,不计费

时段划分(北京时间):平常时段为 0–9 时、12–14 时、18–24 时;高峰时段为 9–12 时、14–18 时。工作日白天的大部分调用会落在高峰时段,如果任务对延迟不敏感,把批量任务安排在平常时段执行可以直接把单价压低一半。

结算口径:本站售价按官网价格 × 站内倍率计算(输入/输出 0.3x、缓存读 0.7x),调用明细与时段归属以控制台账单为准。

价格口径:本站分时倍率和最终扣费以控制台为准;上游缓存、输入与输出计费规则可对照 DeepSeek 官方定价说明。核对日期:2026-08-29。

3. 选型参考

基于价格事实的选型建议:

  • 与 V4 Pro 的关系:V4 Pro(0813 版)平常时段输入 ¥1.386、输出 ¥4.158,约为 Flash 档的 3 倍单价;预算敏感的常规任务优先 Flash 档,重推理任务再升级 Pro。
  • 与其他国产模型对比:国产渠道中 MiniMax、GLM、Kimi、MiMo、Qwen 的倍率为 0.2x,DeepSeek 输入/输出为 0.3x、缓存读为 0.7x——但 DeepSeek 官网基准价本身较低,折算后的本站单价仍处于国产渠道的中低区间,应以最终售价而非倍率做横向比较。
  • 缓存利用:本站缓存读单价约为输入价的 1/12(平常时段),重复前缀明显的批量任务(固定系统提示词、模板化文档处理)收益明显。

4. API 调用示例

cURL · OpenAI 兼容调用
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-0731",
    "messages": [
      {"role": "user", "content": "用三句话总结分时段计费对批量任务成本的影响"}
    ]
  }'

Python SDK

Python · openai SDK
from openai import OpenAI

client = OpenAI(
    base_url="https://www.codex789.com/v1",
    api_key="sk-codex789-your-api-key",
)

resp = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "把这份需求文档拆成任务清单"}],
)
print(resp.choices[0].message.content)

5. 常见问题

DeepSeek V4 Flash 的调用代号是什么?

调用代号为 deepseek-v4-flash-0731,由 DeepSeek 提供,具体可用状态以控制台模型列表为准。

为什么 DeepSeek 系列的倍率是 0.3x?

国产模型人民币渠道按厂商统一倍率,DeepSeek 输入/输出为 0.3x、缓存读为 0.7x,其余国产模型为 0.2x;倍率以控制台实时展示为准。

平常时段和高峰时段怎么划分?

按北京时间划分:平常时段为 0–9 时、12–14 时、18–24 时;高峰时段为 9–12 时、14–18 时。高峰时段官网基准价上调,本站售价随之上浮。

缓存命中怎么计费?

缓存读按官网价 × 0.7 计费:平常时段本站 ¥0.0343 每百万 tokens(官网 ¥0.049);高峰时段本站 ¥0.0686(官网 ¥0.098)。官方未提供缓存写单价,故不计费。

怎么接入调用?

使用 OpenAI 兼容接口,Base URL 为 https://www.codex789.com/v1,将 model 参数设为 deepseek-v4-flash-0731 即可,与调用其他模型的方式一致。