1. 倍率是什么:核心公式
倍率是计算实际扣费的系数,公式只有一条:
实际扣费 = 官方价 × 倍率
示例:Claude Opus 5 官方输入价 $5 / 百万 Token
倍率 0.1 时 → 实际 $0.5 / 百万 Token
倍率 0.2 时 → 实际 $1.0 / 百万 Token(成本翻倍)
同一个模型,倍率 0.1 和 0.2 的实际成本相差一倍。因此看倍率之前,先确认模型与分组——同一个站的不同分组,倍率可能完全不同。
2. 定价的 4 个构成层
真实价格由四层共同决定,只盯"倍率"容易漏掉其他三层:
| 层级 | 含义 | 典型陷阱 |
|---|---|---|
| ① 官方价基准 | 厂商的明码标价(按模型、按输入/输出) | 基准不同,倍率同价不同 |
| ② 汇率层 | 充值 1 美元 = 多少平台币 | "充 7 元=1 美元"而非 1:1 的暗加价 |
| ③ 倍率分组 | 不同渠道/模型组的倍率 | 宣传低倍率,实际按高倍率分组计费 |
| ④ 缓存计费 | 缓存读写的独立单价 | 只给总 token 不拆明细、缓存价过高 |
其中汇率层最隐蔽:如果站点把"1 美元 = 7 元"设为默认(而非市场汇率),等于在倍率之外又收了一道约 7 倍的加价空间——社区讨论中这类"文字游戏"被反复吐槽。
3. 主流模型官方价基准表
以下是 2026 年主流模型官方价(每百万 Token,公开数据),倍率的作用就是在这些基准上缩放:
| 模型 | 输入价($ / MT) | 输出价($ / MT) | 上下文 |
|---|---|---|---|
| Claude Fable 5 | $10 | $50 | 1M |
| Claude Opus 5 | $5 | $25 | 200K |
| Claude Sonnet 5 | $3 | $15 | 200K |
| GPT-5.6 Sol | $5 | $30 | 1M |
| GPT-5.6 Terra | $3 | $18 | 512K |
| Gemini 3.6 Flash | $1.5 | $7.5 | 1M |
| Grok 4.6 | $1 | $6 | 500K |
关键洞察:输出价差异远大于输入价。Fable 5 输出 $50 是 Sonnet 5($15)的 3.3 倍——同倍率下,你的输出 Token 越多,不同模型的实际费用差距越大。
国产模型走人民币按量渠道,站内倍率统一 0.2x(本站售价 = 官网价 × 0.2);DeepSeek 是唯一例外——输入/输出 0.3x、缓存读 0.7x,且按平常/高峰分时段计价,规则详见 DeepSeek V4 Flash 页。缓存计费规则也各不相同:GLM-5.3 缓存写免费,而 GLM-5.1 缓存读写都收费,预算时要把这一项单独算进去。
4. 缓存计费:最容易被忽略的隐藏成本
现代 API 的 token 计费通常拆成四类,很多人只盯着"输入/输出"两行:
| 计费项 | Claude 级参考价 | 说明 |
|---|---|---|
| 输入 token | $5 / MT | 每次请求的输入 |
| 输出 token | $25 / MT | 模型的回答 |
| 缓存写入 | $6.25 / MT | 首次写入缓存的前缀 |
| 缓存读取 | $0.5 / MT | 命中缓存后的前缀读取(便宜 50 倍) |
为什么重要:Codex / Claude Code 等工具连续使用时,后续请求大量内容应该走缓存读取。好渠道缓存命中率取决于请求结构与实现,成本变化应以实际账单为准;如果站点把缓存读取单价设得异常高、或干脆不拆分明细,你的"低倍率"账单会悄悄变贵。
判断方法:要求账单拆分输入/输出/缓存写入/缓存读取四项,并与请求日志对账。国产渠道里各家缓存规则差异同样明显:Kimi K2.6 缓存读约为输入价的 1/6、缓存写不计费,MiniMax M2.7 缓存读为输入价的 1/5 且缓存写免费。
5. 三步算出真实成本
- 估算月用量:统计你一个月大约消耗的输入 Token、输出 Token(可在控制台查询)。
- 查官方价与倍率:确定所用模型的官方价(输入/输出)与站点倍率。
- 套公式:月成本 ≈ 输入量×输入官方价×倍率 + 输出量×输出官方价×倍率 + 缓存费用。
模型:Claude Sonnet 5(官方输入 $3、输出 $15),倍率 0.1
月用量:输入 100 万 Token + 输出 20 万 Token
输入成本 = 1,000,000 ÷ 1,000,000 × $3 × 0.1 = $0.3
输出成本 = 200,000 ÷ 1,000,000 × $15 × 0.1 = $0.3
缓存费用 ≈ 0(若缓存命中率高可大幅降低)
月成本 ≈ $0.6 ≈ 4.4 元
用同一套公式代入不同倍率/汇率,就能比较两个中转站的真实价格——这就是"精算"的核心。
6. 常见倍率陷阱对照
| 陷阱 | 表现 | 真实差距示例 |
|---|---|---|
| 分组偷换 | 宣传 0.1x,实际按 0.2x 分组 | Sonnet 5 月成本从 $0.6 → $1.2(翻倍) |
| 汇率加价 | 充值 7 元=1 美元(非市场汇率) | 同样 $10 额度,实际多付约 30-40 元 |
| 缓存不拆 | 只给总 token,缓存价异常 | 长会话场景成本虚高 2-5 倍 |
| 只报最低档 | 宣传基础档 0.03 元/张、0.1x | 实际常用档位价格更高 |
7. island AI Coding 倍率公开对照
作为中转服务方,我们同样用这套"精算"标准自检,倍率随模型列表公开:
| 模型 | 站内倍率 | 输入官方价 | 输出官方价 |
|---|---|---|---|
| Claude Opus 5 | 0.1x | $5 / MT | $25 / MT |
| Claude Sonnet 5 | 0.1x | $3 / MT | $15 / MT |
| Claude Fable 5 | 0.1x | $10 / MT | $50 / MT |
| GPT-5.6 Sol | 0.05x | $5 / MT | $30 / MT |
| Gemini 3.6 Flash | 0.2x | $1.5 / MT | $7.5 / MT |
| Grok 4.6 | 0.1x | $1 / MT | $6 / MT |
完整 40+ 模型与倍率见模型广场。我们支持账单明细核对,可按上面三步公式自行验算真实成本。
8. 常见问题
中转站倍率是什么意思?
倍率是计算实际扣费的系数:实际价 = 官方价 × 倍率。例如 Claude Opus 5 官方输入价 $5/百万 Token、倍率 0.1,则实际约 $0.5/百万 Token。
倍率低就一定便宜吗?
不一定。真实价格由官方价基准、汇率、倍率分组、缓存计费四层决定。只宣传"0.1x"但分组不透明、账单不拆分的站,实际可能更贵。
如何计算中转站的真实成本?
月成本 ≈ 输入量×输入官方价×倍率 + 输出量×输出官方价×倍率 + 缓存费用。用月用量代入公式,再与账单明细对账即可。
为什么同倍率下不同模型成本差很多?
因为实际扣费 = 官方价 × 倍率,官方价本身差异巨大。例如 Fable 5 输出官方价 $50 是 Sonnet 5($15)的 3 倍多,同倍率下实际费用同样放大。
* 本文为 island AI Coding 技术团队原创内容,官方价格为公开厂商数据(2026-08),成本计算为示例,实际扣费以各平台实时展示为准。