1. AI Studio、Vertex AI、Gemini API 与 CLI 的关系
它们不是四个互换的 Base URL。AI Studio 更像面向开发者的项目与密钥入口;Vertex AI 走 Google Cloud 项目、权限和计费;Gemini API 是接口产品名称;Gemini CLI 则是客户端。某社区 的渠道讨论中,已采纳回复把 AI Studio 概括为较低优先级渠道,把 Vertex 描述为纯付费、高优先级路径。具体配额和可用模型仍应以官方控制台为准。
| 你正在配置 | 先核对 | 不要混淆 |
|---|---|---|
| 官方 Gemini SDK | 项目、密钥、官方端点 | 不要把 Vertex 凭据当作 AI Studio Key |
| Gemini CLI | 登录方式、模型和客户端版本 | CLI 的 OAuth 不是普通 API Key |
| OpenAI 兼容中转站 | 统一 Base URL、Bearer Key、模型代号 | 兼容请求格式不代表所有 Gemini 字段都相同 |
2. 使用 AI API 中转站统一接入
如果项目已经使用 OpenAI SDK,可以把 Base URL 指向 https://www.codex789.com/v1,再从模型广场或密钥分组复制可用的 Gemini 模型代号。这样 Gemini、GPT、Claude、Grok 和国产模型都能沿用同一套密钥管理与用量记录。
curl https://www.codex789.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"MODEL_ID","messages":[{"role":"user","content":"返回连接成功"}]}'MODEL_ID 必须从当前密钥可见列表复制,不能根据“Pro”“Flash”展示名称自行拼写。需要 Gemini 原生思考摘要或多模态字段时,先确认中转站是否开放原生端点;某社区 的New-API 讨论明确提醒,OpenAI 格式与 Gemini 原生格式的返回能力并不完全相同。
3. 429 RESOURCE_EXHAUSTED 怎么分层
某社区 的Gemini CLI 转 API 主题记录了 Pro 很快触发 429、换 Flash 后继续的现象。它更像模型级容量或速率窗口,而不是单纯“余额没了”。建议按下面顺序判断:
- 只一个模型失败:固定同一密钥换一个可用模型,观察是否恢复。
- 所有模型失败:检查账户额度、密钥分组和全局并发。
- 网关无请求记录:先查 Base URL、DNS、代理和认证,问题尚未到上游。
- CLI 反复 Thinking:记录版本并停止无限 fallback,改用一次最小 REST 请求。
429 只做有限次数指数退避,不要对写入或扣费操作无限重放。本站的Gemini CLI 429 专题给出日志判别和退避示例。
4. 五分钟最小验证流程
- 记录客户端版本、时间、模型代号和完整状态码。
- 在控制台确认密钥分组可见该模型。
- 用上面的 cURL 发送一句短提示,关闭流式和工具调用。
- 成功后再逐一恢复长上下文、流式输出和多模态输入。
- 若仍失败,提交脱敏的请求 ID 和错误正文,不要发送 API Key。
现役 Flash 型号可查看Gemini 3.8 Flash 详情及Gemini Flash 3.8、3.7、3.6 同题对比;兼容参数见OpenAI 兼容 API 教程。
5. 常见问题
AI Studio 和 Vertex AI 能共用一个 Key 吗?
不要假设可以。两者的项目、权限和计费链路不同,按你实际创建的凭据和官方文档配置。
中转站能消除 Gemini 的 429 吗?
不能保证。中转站只能把网关、密钥和上游错误分层记录;模型容量、上游配额和客户端并发仍会触发 429。
为什么 OpenAI 请求没有思考摘要?
兼容层通常只映射通用字段。需要原生 Gemini 字段时,确认当前网关是否提供 Gemini 格式端点和对应模型能力。
调研来源:某社区 渠道关系讨论、Gemini CLI 转 API、New-API 接入排错、Gemini 思考摘要。社区案例用于归纳问题,不代表本站或上游的固定配额承诺。