1. Gemini 2.5 Flash 是什么
Gemini 2.5 Flash(gemini-2-5-flash)是 2.5 代际的快速响应档,现已被 3.x 系列接棒,但在站内保持正常可调用,服务于尚未安排升级的既有系统。
它的目录画像:
- 512K tokens 上下文:窗口规格与多数现役型号看齐。
- 能力标签:快速响应——单标签型号,定位纯粹的轻快交互。
- $1.2/$6 每百万 tokens:渠道目录参考价与 3.6 Flash Tiered 版持平——这让「先老后新」的过渡策略没有额外的费率代价。
2. 存量流程迁移前自检三步
当决定把跑在本型号上的流程升级到 3.x 系时,建议按以下顺序完成自查:
- 第一步 · 输出解析复核:新代际的行文风格可能微调,凡是用正则或固定分隔符解析模型输出的环节,先跑历史样本回归;
- 第二步 · 上下文水位确认:统计现有请求的最大输入长度——只要低于新旧两代窗口的较小值,切换即无截断风险;
- 第三步 · 提示词角色校准:少数依赖特定语气或格式约束的 system prompt,需对照新代际做一轮人工评审。
三步全部通过后,采用灰度方式切流并保留一行 model 参数的回滚能力,整个迁移通常半天内可以收尾;若中途发现行为差异超出预期,回滚同样只是把参数改回来。
3. 适用场景
老版对话与工单入口
已上线多年的客服或内部问答入口,交互模式成熟,重点在于维持可用性而非追逐新能力。
定时摘要与巡检报告
每日定时运行的汇总类任务,输出结构长期不变,是最典型的「能用就不动」场景——放在夜间跑批,连延迟敏感度都一并归零。
过渡期的双轨验证
作为升级评估的基线侧:新旧两档并行跑同一批样本,两份结果并排摆放,切换与否一目了然。
4. API 最小示例
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer sk-codex789-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2-5-flash",
"messages": [
{"role": "user", "content": "为这条变更生成面向用户的更新公告"}
]
}'
Python SDK
from openai import OpenAI
client = OpenAI(
base_url="https://www.codex789.com/v1",
api_key="sk-codex789-your-api-key",
)
resp = client.chat.completions.create(
model="gemini-2-5-flash",
messages=[{"role": "user", "content": "把这段会议要点整理成邮件正文"}],
)
print(resp.choices[0].message.content)
5. 价格与倍率说明
| 计费项 | 说明 |
|---|---|
| 站内倍率 | 0.2x,Gemini 系列统一,以控制台实时展示为准 |
| 渠道目录参考价 | $1.2 / $6 每百万 tokens(input/output),为公开目录信息 |
| 结算方式 | 按 Token 用量 × 倍率结算,明细以控制台账单为准 |
| 成本定位 | 中位低价档——上代规格换取与现役 Tiered 版相同的单价水平 |
6. 常见问题
Gemini 2.5 Flash 的调用代号是什么?
调用代号为 gemini-2-5-flash,具体可用状态以控制台模型列表为准。
它和 3.6 Flash Tiered 渠道目录价格相同,该怎么理解?
两者基准价同为 $1.2/$6 每百万 tokens,但分属不同代际与定位:本页是上代标准快档,Tiered 版是现役 3.6 的分层定价变体。新负载建议优先在现役型号间比选。
把旧流程迁到 3.x 系要注意什么?
核心检查三点:输出格式解析是否依赖本型号的行文习惯、上下文用量水位在新窗口下是否安全、提示词中的角色设定是否需要按新代际微调。灰度切流并保留回滚配置即可。
现有 OpenAI SDK 代码需要改动吗?
不需要改业务代码。base_url 指向 https://www.codex789.com/v1、密钥换为平台 Key 后,model 参数写 gemini-2-5-flash 即可继续使用。
这一档的计费口径是什么?
渠道目录参考价 $1.2/$6 每百万 tokens(input/output),站内倍率 0.2x,费用随 Token 用量逐条计入控制台账单。