Google · Flash 文本模型

Gemini 3.8 Flash API 中转

Gemini 3.8 Flash是Google于2026年9月2日正式发布的GA模型,面向长周期软件工程、自主Agent和复杂企业工作流。本站控制台已经开放gemini-3.8-flash,Gemini系列统一采用0.2x倍率。

更新日期:2026-09-03·模型代号:gemini-3.8-flash

当前本站参考价:输入 $0.15 / 输出 $0.75 每百万 tokens;最终扣费以控制台为准。

1M官方输入窗口
64K官方最大输出
0.2xGemini 统一倍率

1. Gemini 3.8 Flash是什么

Gemini 3.8 Flash(gemini-3.8-flash)是Google Gemini 3系列的Flash工作马模型。Google将它定位为当前最智能的Flash型号,重点提升长周期软件工程、Agent工具编排和知识密集型多步任务,同时保留Flash系列面向生产部署的速度与成本定位。

Google公开的HLE-Verified成绩为54.9%。这项数字只能说明官方评测中的多步推理表现,不能直接换算为本站调用成功率、响应速度或具体业务准确率。选型时仍应使用自己的代码仓库、文档和工具链做小样本复测。

2. 官方规格与能力边界

项目Google官方规格本站说明
稳定模型IDgemini-3.8-flash控制台已上线同名渠道
输入与输出1,048,576输入tokens;65,536最大输出tokens实际请求上限受当前渠道配置约束
输入模态文本、图片、视频、音频、PDF使用多模态前先以最小请求验证兼容格式
输出模态文本不是图片、音频或视频生成模型
思考档位lowmediumhighminimal会被Google原生API拒绝
原生工具函数调用、结构化输出、代码执行、搜索与URL上下文等原生能力不等于兼容网关全部透传,按端点逐项验证

模型卡给出的知识截止说明存在领域差异:总体更新至2026年3月,但部分领域仍可能接近2025年1月。涉及新闻、价格、政策或版本状态时,应配合检索工具或外部数据源,不把参数规模和知识时效混为一谈。

Gemini 3.8 Flash 在生产模型列表和十次最小请求中的脱敏核验结果
第一手核验:2026-09-03 生产 /v1/models 返回 HTTP 200,59 个可见模型中包含 gemini-3.8-flash;随后 10 个固定合成任务均返回 HTTP 200,响应模型 ID 一致,答案校验 10/10。图中不含 API Key、用户数据或回答正文。

3. 适合与不适合哪些任务

优先测试的场景

  • 长周期软件工程:跨文件修改、测试失败定位、重构计划和持续工具调用。
  • 自主Agent:需要反复执行、检查结果并继续下一步的工具链工作流。
  • 复杂知识任务:金融、法律、科研等需要多步分析、归纳和结构化输出的任务。
  • 多模态文档:文本与图片、音频、视频或PDF共同参与理解的输入。

需要谨慎的场景

简单分类、短摘要和高并发低延迟任务不一定需要3.8的更高推理投入。Google明确说明,该模型在复杂任务中可能主动执行更多推理步骤和工具调用,从而增加token消耗;效率优先的成熟业务可以继续保留3.7 Flash作为对照组。

4. 通过OpenAI兼容接口调用

本站控制台已经开放gemini-3.8-flash。最小验证先只发送文本消息,确认鉴权、路由和模型代号正确,再逐项增加流式输出、多模态或工具调用参数。

cURL最小请求
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.8-flash",
    "messages": [
      {"role": "user", "content": "用三点说明这段代码的并发风险"}
    ],
    "stream": false
  }'

若需要Google原生的thinking_level、Search grounding或Computer Use,应先确认当前端点是否提供对应字段映射。OpenAI兼容接口保证通用请求结构,不自动代表Google原生工具能力全部可用。

5. Gemini 3.8 Flash与3.7 Flash有什么区别

维度Gemini 3.8 FlashGemini 3.7 Flash
发布时间2026-09-022026-08-13
官方定位长周期工程、复杂Agent和专业工作流日常编程、工具调用和效率优先工作流
输入/输出上限1M / 64K1M / 64K
当前官方介绍价$0.75 / $3.75$0.75 / $3.75
本站倍率0.2x0.2x
使用边界复杂任务可能使用更多推理tokens效率敏感的成熟任务可继续使用

迁移不是简单地只替换模型ID。Google的3.8迁移说明要求检查采样参数、thinking_budgetthinking_level的变化,以及函数响应字段。完整迁移清单见Gemini Flash系列对比与迁移文章

6. 价格、0.2x倍率与生效日期

计费阶段Google官方输入/输出价本站参考输入/输出价
截至2026-12-31$0.75 / $3.75每百万tokens$0.15 / $0.75每百万tokens
自2027-01-01$1.50 / $7.50每百万tokens届时以控制台实际配置为准

本站Gemini系列统一采用0.2x倍率。当前参考价按Google介绍价乘以0.2计算,输出价包含thinking tokens;实际扣费还取决于请求的输入、输出、缓存和工具使用情况,最终以控制台账单为准。

来源:Google模型规格Google迁移说明Google定价页Google DeepMind模型卡。核对日期:2026-09-03。

7. 常见问题

Gemini 3.8 Flash的调用代号是什么?

本站控制台调用代号为gemini-3.8-flash,不要把页面URL中的gemini-3-8-flash当作模型ID。

本站倍率和参考价是多少?

Gemini系列统一为0.2x。按当前官方介绍价计算,本站参考输入价为$0.15、输出价为$0.75每百万tokens,最终扣费以控制台为准。

所有Google原生工具都能通过兼容接口调用吗?

不能默认等同。函数调用、搜索、代码执行和Computer Use是Google原生规格,兼容接口是否映射对应字段需要逐项验证。

应该从3.7升级到3.8吗?

复杂代码和长周期Agent值得优先测试3.8;对成本和延迟更敏感的稳定任务,应先做同一输入的并行对照再迁移。