1. Gemini 3.7 Flash 是什么
Gemini 3.7 Flash(gemini-3.7-flash)是 Google 于 2026 年 8 月 13 日正式发布(GA)的 Flash 系列新版工作马模型,官方定位为「目前最智能的工作马模型」,基于 Gemini 3.6 Flash 的架构迭代而来,重点强化编码、调试与 Agent 多步执行。
它的核心特点:
- 编程与 Agent 增强:官方基准显示长程软件工程任务(DeepSWE v1.1)得分 65.3%,较 3.6 Flash 的 49% 大幅提升。
- 1M 上下文 + 多模态输入:支持文本、图片、音频、视频与 PDF 输入,最大输出 64K tokens。
- 思考强度可调:
thinking_level提供 low / medium / high 三档,在质量、成本与延迟间自由权衡。 - OpenAI 兼容网关:经 island AI Coding 中转后统一 Base URL 与鉴权,现有 SDK 只改 model 参数即可切换。
2. thinking_level 档位调优
这是本代模型最实用的工程特性:同一个模型,通过思考档位适配不同任务强度。island AI Coding 已透传该参数,可直接在请求体中指定:
| 档位 | 适用任务 | 权衡特征 |
|---|---|---|
low | 分类、抽取、格式转换等轻任务 | 最快响应、最低消耗 |
medium(默认) | 常规问答、代码补全、文档摘要 | 质量与速度均衡 |
high | 复杂推理、多步 Agent 规划、疑难调试 | 质量优先,延迟与成本上升 |
两个注意事项:其一,3.7 Flash 不支持 minimal 档位,传入会直接报错(官方文档明示);其二,建议在批量任务中按任务类型显式声明档位——让轻任务跑 low、关键链路才用 high,是控制账单最直接的杠杆。
3. 适合哪些业务场景
Agent 编程工作流
多步规划、工具调用链与终端自动化是本代的强化方向,适合驱动 CI 中的自动修复 Agent 与 IDE 编排类应用。
大规模文档分析
1M tokens 上下文配合 PDF 输入,可整卷处理合同、财报、论文;知识密集领域(金融、法律、生医)的准确度为本代官方强调的提升点。
多模态内容处理
图片、音频、视频混合输入的单模型流水线,如会议录音转纪要、视频内容审阅与图表理解。
高并发在线服务
作为 Flash 档保持快速响应特性,配合 low 档思考强度承担线上高 QPS 请求,成本可控。
4. API 最小示例
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [
{"role": "user", "content": "审查这段代码的并发安全问题并给出修复"}
],
"thinking_level": "high"
}'
将 sk-codex789-your-api-key 替换为控制台生成的真实 Key;省略 thinking_level 时默认 medium。CLI 用户可参考 Gemini CLI 配置教程接入。
5. 与 3.6 Flash 的差异对比
| 维度 | Gemini 3.7 Flash(本页) | Gemini 3.6 Flash |
|---|---|---|
| 发布时间 | 2026-08-13 | 2026 年 7 月 |
| 架构关系 | 3.7 基于 3.6 Flash 架构迭代(官方模型卡说明) | |
| DeepSWE v1.1 长程软件工程* | 65.3% | 49% |
| AutomationBench 商业流程自动化* | 30.4% | 17% |
| 上下文 / 输出 | 均为 1M tokens / 64K tokens | |
| 官方基准价* | 均为 $0.75 / $3.75 每百万 tokens(优惠价至 2026-12-31) | |
| 平台倍率 | 0.2x | 0.2x |
* 带 * 号数据引自 Google 官方模型卡与定价页(2026 年 8 月口径),仅供选型参考;实际效果以自己的任务实测为准。若追求极致低价而非能力上限,可考虑更轻的 gemini-3.1-flash-lite。
需要评估下一代型号时,查看Gemini 3.8 Flash 模型详情及3.8、3.7、3.6 Flash 同题对比;不要仅按版本号迁移。
6. 价格与倍率说明
| 计费项 | 说明 |
|---|---|
| 站内倍率 | 0.2x,与 Gemini 系列现役型号一致,以控制台实时展示为准 |
| 官方基准价 | $0.75 / $3.75 每百万 tokens(input/output),官方标注为优惠价、至 2026-12-31 |
| 计费方式 | 按 Token 用量 × 倍率结算,明细以控制台账单为准 |
| 用量查询 | 登录控制台查看 Token 消耗与费用明细 |
提醒:官方优惠价到期后基准价将上调,依赖该模型的中长期项目应在预算中预留价格波动空间,或关注站内公告。
价格口径:本站倍率和实际结算以控制台为准;上游模型价格与优惠期限可对照 Google Gemini API 官方定价页。核对日期:2026-08-29。
7. 常见问题
Gemini 3.7 Flash 的调用代号是什么?
调用代号为 gemini-3.7-flash,URL 路径中的连字符写法为 gemini-3-7-flash,具体可用状态以控制台模型列表为准。
gemini-3.7-flash 和 gemini-3.6-flash 有什么区别?
3.7 Flash 基于 3.6 Flash 架构迭代,是 Google 目前最强的 Flash 工作马型号:编程与 Agent 任务显著增强(官方基准 DeepSWE 65.3% 对 49%),上下文同为 1M tokens,价格档位一致。
thinking_level 参数如何使用?
可选 low、medium(默认)、high 三档,不支持 minimal。档位越高推理质量越好,延迟与成本相应上升;island AI Coding 已透传该参数,在请求体中直接指定即可。
支持哪些输入模态和上下文长度?
支持文本、图片、音频、视频与 PDF 输入,输出为文本;上下文窗口 1M tokens,最大输出 64K tokens(官方规格)。
Gemini 3.7 Flash 如何接入?
将 Base URL 设置为 https://www.codex789.com/v1,使用平台 API Key,model 设为 gemini-3.7-flash 即可在现有 OpenAI 兼容 SDK 中调用;CLI 用法可参考 Gemini CLI 配置教程。