1. DeepSeek V4 Flash Vision 是什么
DeepSeek V4 Flash Vision(deepseek-v4-flash-vision-exp)在 V4 Flash 的基础上加入图像输入能力,代号中的 vision 标识视觉能力,exp 标识实验版本。它与 DeepSeek V4 Flash(0731 版)共享同一套人民币价格表:平常时段本站输入 ¥0.462、输出 ¥1.386 每百万 tokens。
接入前需要知道的两件事:
- 实验版本:exp 版本可能随官方迭代调整或下线,生产链路应把模型代号做成可配置项,可用状态以控制台模型列表为准。
- 计费规则与文本版一致:图像按本站渠道计费规则折算为 tokens 后进入统一用量,分时段规则同样适用。
2. 人民币价格与分时段计费
| 计费项(元 / 百万 tokens) | 时段 | 渠道目录参考价 | 本站售价 |
|---|---|---|---|
| 输入 | 平常 | ¥1.54 | ¥0.462 |
| 高峰 | ¥3.08 | ¥0.924 | |
| 输出 | 平常 | ¥4.62 | ¥1.386 |
| 高峰 | ¥9.24 | ¥2.772 | |
| 缓存读 | 平常 | ¥0.049 | ¥0.0343 |
| 高峰 | ¥0.098 | ¥0.0686 | |
| 缓存写 | 渠道目录未列出单价,不计费 | ||
| 计费倍率 | 输入/输出 0.3x、缓存读 0.7x | ||
时段划分(北京时间):平常为 0–9 时、12–14 时、18–24 时;高峰为 9–12 时、14–18 时。图像类批处理任务(截图归档、批量票据识别等)通常不要求实时,安排在平常时段执行可把单价减半。
结算口径:本站售价按渠道目录参考价 × 站内倍率计算(输入/输出 0.3x、缓存读 0.7x),明细与时段归属以控制台账单为准。
3. 选型参考
- 视觉任务的价格下限:它是本站人民币渠道中带视觉输入的低价选项——如需更强推理,可对比 DeepSeek V4 Pro;如需多模态旗舰,可对比美元渠道的 Gemini、GPT 系列型号。
- 实验版风险控制:建议在业务侧同时配置
deepseek-v4-flash-0731作为纯文本回退,视觉输入不可用时降级为 OCR 前置 + 文本模型的两段式流程。 - 缓存读单价约为输入价的 1/12:固定系统提示词 + 大批量同类图片的流水线,命中缓存后成本优势明显。
4. 图像输入调用示例
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-vision-exp",
"messages": [
{
"role": "user",
"content": [
{"type": "text", "text": "识别这张图表的坐标轴单位"},
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}
]
}
]
}'
Python SDK(Base64 图像)
import base64
from openai import OpenAI
client = OpenAI(
base_url="https://www.codex789.com/v1",
api_key="sk-codex789-your-api-key",
)
with open("invoice.png", "rb") as f:
b64 = base64.b64encode(f.read()).decode()
resp = client.chat.completions.create(
model="deepseek-v4-flash-vision-exp",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "提取发票金额与开票日期,输出 JSON"},
{"type": "image_url", "image_url": {"url": f"data:image/png;base64,{b64}"}},
],
}],
)
print(resp.choices[0].message.content)
5. 常见问题
deepseek-v4-flash-vision-exp 和 deepseek-v4-flash-0731 是什么关系?
vision-exp 是 V4 Flash 的视觉实验版本,代号带 exp 后缀,支持图像输入;两者的输入、输出、缓存读单价完全一致,按同一分时段规则计价。
实验版(exp)型号稳定吗?
exp 表示实验版本,后续可能随官方迭代调整或下线;生产链路建议做好模型代号可替换的抽象,可用状态以控制台模型列表为准。
图像输入怎么计费?
图像输入按本站渠道计费规则折算为 tokens 后计入输入用量,单价与文本输入一致:平常时段本站 ¥0.462、高峰时段 ¥0.924 每百万 tokens。
这个模型的倍率是多少?
站内倍率 0.3x,与 DeepSeek 系列其他型号一致;国产渠道其余厂商为 0.2x。