本站参考价:输入 ¥0.20 / 输出 ¥0.80 每百万 tokens(官方目录价 × 0.2x;最终扣费以控制台为准)。

DeepSeek · 1M 上下文 · 原生视觉

DeepSeek V4.1 Flash API 中转站

官方推荐调用代号是 deepseek-flash,不要把新闻标题或旧别名直接填入 model。V4.1 Flash 提供 1M 上下文、原生视觉理解、Thinking / Non-thinking、Tool Calls、Responses API 和 Anthropic API;本站通过 OpenAI 兼容网关提供统一接入。

更新日期:2026-09-11·模型 ID:deepseek-flash
上下文1M tokens
最大输出384K tokens
本站倍率0.2x
能力视觉 · Thinking · Tools
2026-09-11 对本站 GET /v1/models 未携带 API Key 的请求返回 HTTP 401 和 API_KEY_REQUIRED
2026-09-11 探针:GET https://www.codex789.com/v1/models 未携带 Key,返回 HTTP 401,code=API_KEY_REQUIRED。这只证明认证门禁存在,不证明 DeepSeek V4.1 Flash 的延迟、成功率和质量。

1. 先给结论

DeepSeek V4.1 Flash 适合已经在用 OpenAI 兼容客户端、需要长文档、代码仓库阅读和带图理解,又希望把国产模型接到同一条 Base URL 的团队。官方推荐 API ID 是 deepseek-flash,上下文 1M tokens,最大输出 384K tokens,具备原生视觉、Thinking / Non-thinking、Tool Calls,以及 Responses API 与 Anthropic API 能力边界。

本站渠道按国产模型统一 0.2x 展示目录参考价:输入 ¥0.20 / MT、输出 ¥0.80 / MT。这是目录参考,不是全天固定实付,也不是官方美元价的直接换算。最终扣费以控制台为准。

公开详情页是DeepSeek V4.1 Flash 模型页,接入步骤见DeepSeek V4.1 Flash API 中转指南。统一入口为 https://www.codex789.com/v1

2. 模型身份与能力边界

页面标题里的 V4.1 Flash 用于识别型号,请求里的 model 只能填控制台可见 ID。官方发布说明把新一代通用模型写作 deepseek-flash。旧别名 deepseek-v4-flashdeepseek-v4-flash-vision-exp 可能被路由兼容,但新项目应固定记录 deepseek-flash,避免日志、缓存和费用报表被拆成多个名字。

1M 上下文适合长文档检索、代码仓库分析和多轮代理;它不是每个账户的保证额度。单次可用上限仍受控制台、请求参数、余额和客户端超时影响。最大输出 384K 同样是官方规格上限,生产环境应按任务设 max_tokens,不要默认拉满。

原生视觉表示模型可以处理请求中的图片内容,不代表本站所有客户端都会自动上传图片。请先按客户端协议验证 content 数组。Thinking 开启时应给足够超时,并同时记录 reasoning 字段与最终 content;不要把空 content 直接判失败。

3. 官方与本站价格口径

计费项(官方 / 百万 tokens)闲时高峰本站目录参考
缓存命中¥0.02¥0.04以控制台为准
缓存未命中输入¥1¥2¥0.20 / ¥0.40
输出¥4¥8¥0.80 / ¥1.60

本站目录采用官方目录价 × 0.2。表内本站数字只用于估算,不承诺促销或最终账单。不要把闲时价当成全天固定价,也不要把倍率误读成并发上限。缓存命中、时段和账户规则都会改变实付。

官方价格与规格核对日期:2026-09-11。来源:DeepSeek 定价V4.1 Flash 发布说明。本站最终扣费以控制台为准。

4. 可核对费用例子

下面只按目录参考价估算,假设闲时、缓存未命中、无促销。实际账单以控制台流水为准。

任务输入 / 输出官方基准本站 0.2x 参考
短问答4K / 1K¥0.008¥0.0016
文档归纳80K / 4K¥0.096¥0.0192
长仓库阅读400K / 8K¥0.432¥0.0864

长上下文的主要成本在输入。把无关历史整段塞进请求,会让目录参考价看起来“便宜”、账单却变高。生产上应按任务拆文档、复用缓存、避免失败后无幂等重试。

5. OpenAI 兼容接口与探针

本站统一入口为 https://www.codex789.com/v1。调用时将 model 设为 deepseek-flash。temperature、max_tokens、tools 是否可用,以控制台路由和上游文档为准。

cURL · Chat Completions
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-flash",
    "messages": [{"role":"user","content":"总结这份文档的三项风险"}],
    "max_tokens": 512
  }'

2026-09-11 未携带 Key 的 GET /v1/models 返回 HTTP 401,code=API_KEY_REQUIRED。该结果只验证鉴权分支,不能外推模型是否对当前账户可见,也不能外推速度或质量。

视觉请求按 OpenAI 多模态格式传入文本和图片 URL;若网关返回 400,先检查 content 数组,再检查模型 ID 和权限。Responses API、Anthropic API 与工具调用属于独立协议面,迁移时保留请求 ID、模型 ID、状态码和原始错误码。

6. 同系列怎么选

页面 / ID用途本页口径
deepseek-flash新项目默认1M 上下文,0.2x 目录参考
DeepSeek V4 Flash 0731旧日期版本对照不要用旧页价格推断 V4.1
DeepSeek V4 Pro 0813需要 Pro 档时再选日期版本与 Flash 不是同一个 SKU

同类国产长上下文也可以看 Kimi K3GLM-5.3。选择依据是任务、上下文、思考模式和目录价,而不是口头上的“谁更强”。

7. 适合 / 不适合任务

适合:长上下文代码审查、中文资料归纳、带图片的文档理解、需要工具调用的代理流程,以及希望在 OpenAI 兼容客户端中统一管理多个供应商的项目。

不适合:把 1M 上下文当成每个账户的保证额度;没有验证图片协议就直接批量上传;未记录模型 ID 和版本就做不可回滚的生产切换;以单次探针推断长期成功率、速度或质量排名。

9. 上线前只核对这几件事

把 Key 放在服务端。控制台按项目拆分测试 Key 和生产 Key,过期或泄露时只轮换对应项目。日志保留请求 ID、模型 ID、usage 和错误码,不要保留完整 Prompt、图片原图或用户标识。

思考模式会拉长等待时间,应单独设置超时,并把 reasoning 与最终回答分开存储。视觉任务先用一张公开可访问的小图验证协议,再上生产图库。长上下文先用 20K–80K 文档确认账单量级,再逐步加大,避免第一次就把 1M 窗口打满。

官方限速说明不能写成中转 SLA。客户端仍要有队列、幂等和退避。本站可用范围以控制台当前分组为准,页面规格只解释官方能力边界。

10. 目录价如何进入预算

预算表应分三列:官方挂牌、本站目录参考、控制台实付。官方挂牌用于理解上游分时和缓存;本站目录参考用于立项估算;控制台实付才是财务口径。三列不一致时,以控制台为准,而不是改页面数字去“对齐”。

和 GPT、Claude、Gemini 共用同一 Base URL 时,权限仍按 Key 的模型分组生效。一把 Key 能调 Flash,不代表同一把 Key 自动拥有 Pro 或视觉实验别名。切换模型前先打 /v1/models 或看控制台分组,避免把 401/403 解释成模型质量问题。

本页不提供成功率、首 token 时延或排名。需要调用步骤时,转到API 中转指南;需要比较国产型号时,转到国产模型怎么选

11. 和旧 Flash 页的差别

站内仍保留 0731 与视觉实验页,是为了旧链接和日期版本对照,不是让新项目继续用旧 ID。新项目的规范 ID 只有 deepseek-flash。旧页上的倍率和价格不能用来倒推 V4.1 Flash;本页 0.2x 只作用于当前型号。

如果控制台分组里暂时看不到 deepseek-flash,先核对账户权限,而不是改写页面上的官方规格。规格来自官方文档,权限来自本站控制台,两套事实不能互相替代。

12. 出问题先看哪一层

401 看 Key 和请求头。400 看模型 ID 和多模态字段。429 看客户端队列。账单异常看 usage 和是否重复提交。官方规格变化看定价页和发布说明,本站扣费变化看控制台。分层之后,才不会把所有异常都写成“模型不行”。

8. 常见问题

请求里写 deepseek-v4.1-flash 可以吗?

官方推荐 ID 是 deepseek-flash。页面标题中的版本名用于识别模型,实际请求请以控制台可见 ID 为准。

本站为什么显示 0.2x?

这是本站 DeepSeek V4.1 Flash 的渠道倍率,与本站其他国产模型保持一致;目录参考价和最终扣费分开记录。

官方并发 2500 是本站承诺吗?

不是。2500 是官方账户限速说明,不能推导本站中转并发上限;客户端仍应实现队列、退避和幂等。

页面事实边界:官方规格、价格和限速均附来源;本站可用模型、余额和最终账单以控制台实时状态为准。核对日期:2026-09-11。