本站参考价:输入 $0.15 / 输出 $0.75 每百万 tokens(官网目录价 × 0.2x;最终扣费以控制台为准)。

Google · 文本模型

Gemini 3.7 Flash API 中转

Google 于 2026 年 8 月 13 日发布的最新 Flash 工作马模型,通过 island AI Coding 的 OpenAI 兼容接口调用,模型代号为 gemini-3.7-flash。基于 3.6 Flash 架构迭代,编程与 Agent 能力显著增强,1M tokens 上下文,思考强度三档可调。

更新日期:2026-09-03·模型代号:gemini-3.7-flash

1. Gemini 3.7 Flash 是什么

Gemini 3.7 Flash(gemini-3.7-flash)是 Google 于 2026 年 8 月 13 日正式发布(GA)的 Flash 系列新版工作马模型,官方定位为「目前最智能的工作马模型」,基于 Gemini 3.6 Flash 的架构迭代而来,重点强化编码、调试与 Agent 多步执行

它的核心特点:

  • 编程与 Agent 增强:官方基准显示长程软件工程任务(DeepSWE v1.1)得分 65.3%,较 3.6 Flash 的 49% 大幅提升。
  • 1M 上下文 + 多模态输入:支持文本、图片、音频、视频与 PDF 输入,最大输出 64K tokens。
  • 思考强度可调thinking_level 提供 low / medium / high 三档,在质量、成本与延迟间自由权衡。
  • OpenAI 兼容网关:经 island AI Coding 中转后统一 Base URL 与鉴权,现有 SDK 只改 model 参数即可切换。

2. thinking_level 档位调优

这是本代模型最实用的工程特性:同一个模型,通过思考档位适配不同任务强度。island AI Coding 已透传该参数,可直接在请求体中指定:

档位适用任务权衡特征
low分类、抽取、格式转换等轻任务最快响应、最低消耗
medium(默认)常规问答、代码补全、文档摘要质量与速度均衡
high复杂推理、多步 Agent 规划、疑难调试质量优先,延迟与成本上升

两个注意事项:其一,3.7 Flash 不支持 minimal 档位,传入会直接报错(官方文档明示);其二,建议在批量任务中按任务类型显式声明档位——让轻任务跑 low、关键链路才用 high,是控制账单最直接的杠杆。

3. 适合哪些业务场景

Agent 编程工作流

多步规划、工具调用链与终端自动化是本代的强化方向,适合驱动 CI 中的自动修复 Agent 与 IDE 编排类应用。

大规模文档分析

1M tokens 上下文配合 PDF 输入,可整卷处理合同、财报、论文;知识密集领域(金融、法律、生医)的准确度为本代官方强调的提升点。

多模态内容处理

图片、音频、视频混合输入的单模型流水线,如会议录音转纪要、视频内容审阅与图表理解。

高并发在线服务

作为 Flash 档保持快速响应特性,配合 low 档思考强度承担线上高 QPS 请求,成本可控。

4. API 最小示例

cURL · 指定思考档位调用
curl https://www.codex789.com/v1/chat/completions \
  -H "Authorization: Bearer sk-codex789-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.7-flash",
    "messages": [
      {"role": "user", "content": "审查这段代码的并发安全问题并给出修复"}
    ],
    "thinking_level": "high"
  }'

sk-codex789-your-api-key 替换为控制台生成的真实 Key;省略 thinking_level 时默认 medium。CLI 用户可参考 Gemini CLI 配置教程接入。

5. 与 3.6 Flash 的差异对比

维度Gemini 3.7 Flash(本页)Gemini 3.6 Flash
发布时间2026-08-132026 年 7 月
架构关系3.7 基于 3.6 Flash 架构迭代(官方模型卡说明)
DeepSWE v1.1 长程软件工程*65.3%49%
AutomationBench 商业流程自动化*30.4%17%
上下文 / 输出均为 1M tokens / 64K tokens
官方基准价*均为 $0.75 / $3.75 每百万 tokens(优惠价至 2026-12-31)
平台倍率0.2x0.2x

* 带 * 号数据引自 Google 官方模型卡与定价页(2026 年 8 月口径),仅供选型参考;实际效果以自己的任务实测为准。若追求极致低价而非能力上限,可考虑更轻的 gemini-3.1-flash-lite

需要评估下一代型号时,查看Gemini 3.8 Flash 模型详情3.8、3.7、3.6 Flash 同题对比;不要仅按版本号迁移。

6. 价格与倍率说明

计费项说明
站内倍率0.2x,与 Gemini 系列现役型号一致,以控制台实时展示为准
官方基准价$0.75 / $3.75 每百万 tokens(input/output),官方标注为优惠价、至 2026-12-31
计费方式按 Token 用量 × 倍率结算,明细以控制台账单为准
用量查询登录控制台查看 Token 消耗与费用明细

提醒:官方优惠价到期后基准价将上调,依赖该模型的中长期项目应在预算中预留价格波动空间,或关注站内公告。

价格口径:本站倍率和实际结算以控制台为准;上游模型价格与优惠期限可对照 Google Gemini API 官方定价页。核对日期:2026-08-29。

7. 常见问题

Gemini 3.7 Flash 的调用代号是什么?

调用代号为 gemini-3.7-flash,URL 路径中的连字符写法为 gemini-3-7-flash,具体可用状态以控制台模型列表为准。

gemini-3.7-flash 和 gemini-3.6-flash 有什么区别?

3.7 Flash 基于 3.6 Flash 架构迭代,是 Google 目前最强的 Flash 工作马型号:编程与 Agent 任务显著增强(官方基准 DeepSWE 65.3% 对 49%),上下文同为 1M tokens,价格档位一致。

thinking_level 参数如何使用?

可选 lowmedium(默认)、high 三档,不支持 minimal。档位越高推理质量越好,延迟与成本相应上升;island AI Coding 已透传该参数,在请求体中直接指定即可。

支持哪些输入模态和上下文长度?

支持文本、图片、音频、视频与 PDF 输入,输出为文本;上下文窗口 1M tokens,最大输出 64K tokens(官方规格)。

Gemini 3.7 Flash 如何接入?

将 Base URL 设置为 https://www.codex789.com/v1,使用平台 API Key,model 设为 gemini-3.7-flash 即可在现有 OpenAI 兼容 SDK 中调用;CLI 用法可参考 Gemini CLI 配置教程