计费与倍率
全站最该先搞懂的一页。公式只有一句话:实付价 = 基准价 × 分组倍率。
模型广场上看到的数字不是你要付的钱。
广场显示基准价,不含分组倍率。你实际被扣的是「基准价 × 你令牌所属分组的倍率」, 这个数字叫实付价。
按广场数字算预算,会在 顶享 这类高倍率分组上把成本算少一半甚至更多。
核心公式
实付价 = 基准价 × 分组倍率| 概念 | 在哪里看到 | 含倍率吗 |
|---|---|---|
| 基准价 | 模型广场 https://cn.fluxtoken.ai/model-plaza | 不含 |
| 实付价 | 价格接口返回的 input_price / output_price | 含 |
也就是说:
- 模型广场是「这个模型本身值多少钱」
- 实付价是「你在这个分组里用它,实际按多少钱扣」
- 同一个模型名,换一个分组,实付价就变了——变的不是模型,是倍率
本站的模型价格表和下面的浏览器展示的都是实付价,已经乘好了。
例子:同一个模型,三种价格
用 claude-opus-4-6 举例。它的基准输入价是 $5 / 1M tokens, 在三个 Claude 分组里的实付价是这样:
| 分组 | 分组倍率 | 实付输入价 |
|---|---|---|
【Claude】Max · 惠享 | ×0.5 | $2.5 / 1M |
【Claude】Max · 稳享(主) | ×1 | $5 / 1M |
【Claude】Max · 顶享 | ×2 | $10 / 1M |
同一个模型名,最高和最低差 4 倍。 你为贵的部分买的不是「更聪明的模型」, 而是稳定性和优先级——理由写在怎么选分组里。
公式是理解用的,不要拿来自己算钱
绝大多数模型严格符合「基准价 × 倍率」,但有例外: 个别模型的基准价本身会随分组变化。例如 claude-opus-5-5, 在 【Claude】Max · 惠享 里基准输入价是 $5 / 1M,在 【Claude】Max · 稳享(主) 和 【Claude】Max · 顶享 里基准输入价是 $4 / 1M。
也有模型的缓存价不是整齐的倍数关系。
所以:理解倍率的含义用这条公式;真要算钱,请查模型价格表里的实付价。 那张表直接取自计费接口的结果,不是用公式推出来的。
这就是为什么选分组等于选价格
分组不只是「能用哪些模型」,它同时决定了这些模型按什么倍率扣费。 所以「我该选哪个分组」这个问题,本质是「我愿意为稳定性付多少钱」。
怎么查实付价
两种方式,任选:
下面这个浏览器把全部 17 个分组 × 41 个模型的实付价放在一起,可以搜模型名、按平台筛选:
| 模型 ↕ | 分组 ↕ | 倍率 ↕ | 输入 $/1M ↕ | 输出 $/1M ↕ | 缓存读 $/1M |
|---|---|---|---|---|---|
| claude-haiku-5-5 ·分档 | 【Claude】Max · 惠享 | ×0.5 | 0.05 | 0.25 | — |
| claude-haiku-5-5 ·分档 | 【Claude】Max · 稳享(主) | ×1 | 0.1 | 0.5 | — |
| gpt-5.6-terra ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.12 | 0.72 | 0.012 |
| gpt-6-sol ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.12 | 0.6 | 0.012 |
| gpt-6.1-sol ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.12 | 0.6 | 0.006 |
| glm-5.3-flash | 【GLM】智谱 · 福利 | ×0.2 | 0.16 | 0.56 | 0.046 |
| deepseek-v4.1-flash | 【Deepseek】稳定 · 福利 | ×0.18 | 0.18 | 0.72 | 0.0036 |
| gpt-5.6-terra | 【Codex】Plus · 轻享 | ×0.1 | 0.2 | 1.2 | 0.02 |
| gpt-6-sol | 【Codex】Plus · 轻享 | ×0.1 | 0.2 | 1 | 0.02 |
| gpt-6.1-sol | 【Codex】Plus · 轻享 | ×0.1 | 0.2 | 1 | 0.01 |
| grok-4.5 ·分档 | 【Grok】Heavy· 福利 | ×0.1 | 0.2 | 0.6 | 0.03 |
| grok-4.6 ·分档 | 【Grok】Heavy· 福利 | ×0.1 | 0.2 | 0.6 | 0.05 |
| grok-4.7 ·分档 | 【Grok】Heavy· 福利 | ×0.1 | 0.2 | 0.6 | 0.05 |
| claude-haiku-5-5 ·分档 | 【Claude】Max · 顶享 | ×2 | 0.2 | 1 | — |
| gemini-3.7-flash | 【Gemini】Pro · 企业级 | ×0.3 | 0.225 | 1.125 | 0.0225 |
| gemini-3.8-flash | 【Gemini】Pro · 企业级 | ×0.3 | 0.225 | 1.125 | 0.0225 |
| gpt-5.6-terra | 【Codex】Pro · 惠享 | ×0.14 | 0.28 | 1.68 | 0.028 |
| gpt-6-sol | 【Codex】Pro · 惠享 | ×0.14 | 0.28 | 1.4 | 0.028 |
| gpt-6.1-sol | 【Codex】Pro · 惠享 | ×0.14 | 0.28 | 1.4 | 0.014 |
| grok-4.5 ·分档 | 【Grok】Heavy· 稳享 | ×0.14 | 0.28 | 0.84 | 0.042 |
| grok-4.6 ·分档 | 【Grok】Heavy· 稳享 | ×0.14 | 0.28 | 0.84 | 0.07 |
| grok-4.7 ·分档 | 【Grok】Heavy· 稳享 | ×0.14 | 0.28 | 0.84 | 0.07 |
| gpt-5.5 ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.3 | 1.8 | 0.03 |
| gpt-5.6 ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.3 | 1.8 | 0.03 |
| gpt-5.6-luna ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.3 | 1.8 | 0.0012 |
| gpt-5.6-sol ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.3 | 1.8 | 0.03 |
| deepseek-v4-flash | 【Deepseek】稳定 · 福利 | ×0.18 | 0.36 | 1.44 | 0.0072 |
| gpt-5.6-terra | 【Codex】Pro · 稳享 | ×0.2 | 0.4 | 2.4 | 0.04 |
| gpt-6-sol | 【Codex】Pro · 稳享 | ×0.2 | 0.4 | 2 | 0.04 |
| gpt-6.1-sol | 【Codex】Pro · 稳享 | ×0.2 | 0.4 | 2 | 0.02 |
| gpt-5.5 | 【Codex】Plus · 轻享 | ×0.1 | 0.5 | 3 | 0.05 |
| gpt-5.6 | 【Codex】Plus · 轻享 | ×0.1 | 0.5 | 3 | 0.05 |
| gpt-5.6-luna | 【Codex】Plus · 轻享 | ×0.1 | 0.5 | 3 | 0.002 |
| gpt-5.6-sol | 【Codex】Plus · 轻享 | ×0.1 | 0.5 | 3 | 0.05 |
| gpt-6-astra ·分档 | 【Codex】反代 · 福利 | ×0.06 | 0.6 | 3 | 0.06 |
| gpt-5.6-terra | 【Codex】Pro · 尊享 | ×0.3 | 0.6 | 3.6 | 0.06 |
| gpt-6-sol | 【Codex】Pro · 尊享 | ×0.3 | 0.6 | 3 | 0.06 |
| gpt-6.1-sol | 【Codex】Pro · 尊享 | ×0.3 | 0.6 | 3 | 0.03 |
| gemini-3.1-pro ·分档 | 【Gemini】Pro · 企业级 | ×0.3 | 0.6 | 3.6 | 0.06 |
| gpt-5.5 | 【Codex】Pro · 惠享 | ×0.14 | 0.7 | 4.2 | 0.07 |
| gpt-5.6 | 【Codex】Pro · 惠享 | ×0.14 | 0.7 | 4.2 | 0.07 |
| gpt-5.6-luna | 【Codex】Pro · 惠享 | ×0.14 | 0.7 | 4.2 | 0.0028 |
| gpt-5.6-sol | 【Codex】Pro · 惠享 | ×0.14 | 0.7 | 4.2 | 0.07 |
| gpt-6-astra | 【Codex】Plus · 轻享 | ×0.1 | 1 | 5 | 0.1 |
| gpt-5.5 | 【Codex】Pro · 稳享 | ×0.2 | 1 | 6 | 0.1 |
| gpt-5.6 | 【Codex】Pro · 稳享 | ×0.2 | 1 | 6 | 0.1 |
| gpt-5.6-luna | 【Codex】Pro · 稳享 | ×0.2 | 1 | 6 | 0.004 |
| gpt-5.6-sol | 【Codex】Pro · 稳享 | ×0.2 | 1 | 6 | 0.1 |
| claude-sonnet-5 | 【Claude】Max · 惠享 | ×0.5 | 1 | 5 | 0.1 |
| claude-sonnet-5-5 | 【Claude】Max · 惠享 | ×0.5 | 1 | 5 | 0.1 |
| kimi-k2.7-code | 【Kimi】稳定 · 福利 | ×0.16 | 1.04 | 4.32 | 0.208 |
| gpt-5.6-terra ·分档 | 【Codex】满血 · 官Key | ×0.6 | 1.2 | 7.2 | 0.12 |
| gpt-6-sol ·分档 | 【Codex】满血 · 官Key | ×0.6 | 1.2 | 6 | 0.12 |
| gpt-6.1-sol ·分档 | 【Codex】满血 · 官Key | ×0.6 | 1.2 | 6 | 0.06 |
| gpt-6-astra | 【Codex】Pro · 惠享 | ×0.14 | 1.4 | 7 | 0.14 |
| gpt-5.5 | 【Codex】Pro · 尊享 | ×0.3 | 1.5 | 9 | 0.15 |
| gpt-5.6 | 【Codex】Pro · 尊享 | ×0.3 | 1.5 | 9 | 0.15 |
| gpt-5.6-luna | 【Codex】Pro · 尊享 | ×0.3 | 1.5 | 9 | 0.006 |
| gpt-5.6-sol | 【Codex】Pro · 尊享 | ×0.3 | 1.5 | 9 | 0.15 |
| claude-sonnet-4-6 | 【Claude】Max · 惠享 | ×0.5 | 1.5 | 7.5 | 0.15 |
| glm-5.1 | 【GLM】智谱 · 福利 | ×0.2 | 1.6 | 5.6 | 0.4 |
| glm-5.3 | 【GLM】智谱 · 福利 | ×0.2 | 1.6 | 5.6 | 0.4 |
| deepseek-v4-pro | 【Deepseek】稳定 · 福利 | ×0.18 | 1.62 | 4.86 | 0.054 |
| gpt-6-astra | 【Codex】Pro · 稳享 | ×0.2 | 2 | 10 | 0.2 |
| claude-sonnet-5 | 【Claude】Max · 稳享(主) | ×1 | 2 | 10 | 0.2 |
| claude-sonnet-5-5 | 【Claude】Max · 稳享(主) | ×1 | 2 | 10 | 0.2 |
| claude-opus-4-6 | 【Claude】Max · 惠享 | ×0.5 | 2.5 | 12.5 | 0.25 |
| claude-opus-4-7 | 【Claude】Max · 惠享 | ×0.5 | 2.5 | 12.5 | 0.25 |
| claude-opus-4-8 | 【Claude】Max · 惠享 | ×0.5 | 2.5 | 12.5 | 0.25 |
| claude-opus-5 | 【Claude】Max · 惠享 | ×0.5 | 2.5 | 12.5 | 0.25 |
| claude-opus-5-5 | 【Claude】Max · 惠享 | ×0.5 | 2.5 | 12.5 | 0.25 |
| gpt-6-astra | 【Codex】Pro · 尊享 | ×0.3 | 3 | 15 | 0.3 |
| gpt-5.5 ·分档 | 【Codex】满血 · 官Key | ×0.6 | 3 | 18 | 0.3 |
| gpt-5.6 ·分档 | 【Codex】满血 · 官Key | ×0.6 | 3 | 18 | 0.3 |
| gpt-5.6-luna ·分档 | 【Codex】满血 · 官Key | ×0.6 | 3 | 18 | 0.012 |
| gpt-5.6-sol ·分档 | 【Codex】满血 · 官Key | ×0.6 | 3 | 18 | 0.3 |
| claude-sonnet-4-6 | 【Claude】Max · 稳享(主) | ×1 | 3 | 15 | 0.3 |
| kimi-k3 | 【Kimi】稳定 · 福利 | ×0.16 | 3.2 | 16 | 0.32 |
| claude-opus-5-5 | 【Claude】Max · 稳享(主) | ×1 | 4 | 20 | 0.2 |
| claude-sonnet-5 | 【Claude】Max · 顶享 | ×2 | 4 | 20 | 0.4 |
| claude-sonnet-5-5 | 【Claude】Max · 顶享 | ×2 | 4 | 20 | 0.4 |
| claude-fable-5 | 【Claude】Max · 惠享 | ×0.5 | 5 | 25 | 0.5 |
| claude-opus-4-6 | 【Claude】Max · 稳享(主) | ×1 | 5 | 25 | 0.5 |
| claude-opus-4-7 | 【Claude】Max · 稳享(主) | ×1 | 5 | 25 | 0.5 |
| claude-opus-4-8 | 【Claude】Max · 稳享(主) | ×1 | 5 | 25 | 0.5 |
| claude-opus-5 | 【Claude】Max · 稳享(主) | ×1 | 5 | 25 | 0.5 |
| gpt-6-astra ·分档 | 【Codex】满血 · 官Key | ×0.6 | 6 | 30 | 0.6 |
| claude-sonnet-4-6 | 【Claude】Max · 顶享 | ×2 | 6 | 30 | 0.6 |
| claude-opus-5-5 | 【Claude】Max · 顶享 | ×2 | 8 | 40 | 0.4 |
| claude-fable-5 | 【Claude】Max · 稳享(主) | ×1 | 10 | 50 | 1 |
| claude-fable-5-1 | 【Claude】Max · 稳享(主) | ×1 | 10 | 50 | 0.25 |
| claude-opus-4-6 | 【Claude】Max · 顶享 | ×2 | 10 | 50 | 1 |
| claude-opus-4-7 | 【Claude】Max · 顶享 | ×2 | 10 | 50 | 1 |
| claude-opus-4-8 | 【Claude】Max · 顶享 | ×2 | 10 | 50 | 1 |
| claude-opus-5 | 【Claude】Max · 顶享 | ×2 | 10 | 50 | 1 |
| claude-fable-5 | 【Claude】Max · 顶享 | ×2 | 20 | 100 | 2 |
| claude-fable-5-1 | 【Claude】Max · 顶享 | ×2 | 20 | 100 | 0.5 |
| gemini-3-pro-image-preview | 【Gemini】banana生图模型 | ×0.6 | — | — | — |
| gemini-3.1-flash-image-preview | 【Gemini】banana生图模型 | ×0.6 | — | — | — |
| gpt-image-2 | 【GPT】生图模型 · 福利 | ×0.6 | — | — | — |
| gpt-image-2-4k | 【GPT】生图模型 · 福利 | ×0.6 | — | — | — |
| gpt-image-2-pro | 【GPT】生图模型 · 福利 | ×0.6 | — | — | — |
| gpt-image-2.5 | 【GPT】生图模型 · 福利 | ×0.6 | — | — | — |
| gpt-image-2.5-flare | 【GPT】生图模型 · 福利 | ×0.6 | — | — | — |
| gpt-image-2.5-sunburst | 【GPT】生图模型 · 福利 | ×0.6 | — | — | — |
计价单位
| 项 | 值 |
|---|---|
| 币种 | USD(美元) |
| 单位 | 每 100 万(1M)tokens |
看到 $5 / 1M 就是「每 100 万 tokens 收 5 美元」,不是「每次请求 5 美元」。
一次请求的 token 数通常远小于 100 万,所以单次花费很小。 真正让账单变大的通常是长上下文、批量任务、以及缓存没命中。
价格接口里的 currency 字段写着 CNY,别被绕进去
上游价格接口的 currency 字段声明为 CNY,但其数值语义实际是美元。 这是已知的上游字段瑕疵。
本站文档和组件里的金额一律按美元(USD)理解。
三类计价方式
FluxToken 上的模型分三种计费方式,不要用同一种直觉去估全部:
| 方式 | 适用 | 怎么算 |
|---|---|---|
| 按 token | 绝大多数对话模型 | 输入价 + 输出价 + 缓存价,按实际 token 数 |
| 分档计价 | 部分长上下文模型 | 按本次请求的上下文长度落到不同档位,单价跳升 |
| 按次计费 | 生图模型 | 每调用一次固定价格,不按 token |
一、按 token 计费
一次请求的扣费由三部分构成:
输入 tokens × 输入价
输出 tokens × 输出价
缓存 tokens × 缓存价输出价通常比输入价贵得多,而且输出 token 数由模型决定。 长回答、长代码生成是账单主要来源之一。
二、缓存计价:三个字段
支持缓存的模型在价格里有三个独立的字段,用途不同、价格差异很大:
| 字段 | 含义 | 特点 |
|---|---|---|
cache_write | 缓存写 —— 把当前上下文写入缓存 | 通常比普通输入价更贵 |
cache_write_1h | 1 小时缓存写 —— 写入有效期更长的缓存 | 一般比 cache_write 更贵 |
cache_read | 缓存读 —— 命中已缓存的内容 | 通常最便宜,常是输入价的十分之一以内 |
理解方式:第一次把长上下文写进缓存要花钱(cache_write), 之后每次命中缓存只花很少的钱(cache_read)。
所以「多轮长对话」和「反复喂同一份文档」这类场景, 缓存命中与否对成本影响极大。相关的客户端设置和用法见缓存优化。
缓存价不是所有模型都有
cache_read 这一栏在某些模型上显示为 —,表示该模型/该分组没有提供缓存计价数据, 不是「免费」也不是「报错」。
三、分档计价(长上下文)
部分模型按上下文长度分档计价。档位内的单价正常,超出档位后单价跳升。
常见的档位划分形如 ≤100K / >100K、≤200K / >200K、≤272K / >272K 等, 具体阈值和单价因模型而异。本站价格浏览器里这类模型会标注 「分档」。
实践含义:
- 塞进去的上下文越长,后面每一段 token 的单价可能不是同一个价
- 一次把 20 万 token 的仓库塞进模型,和分 10 次各塞 2 万, 在分档模型上成本结构完全不同
- 估算成本时先确认你要用的模型是不是分档模型
各分组的分档明细见对应的分组页(如 Claude 分组、Codex / GPT 分组)。
四、按次计费(生图)
生图模型用 per_request 计价:
- 价格浏览器里标 「按次」,输入 / 输出列显示
—,价格列显示按次 $x - 每调用一次扣一次固定费用,跟提示词长度无关
- 批量生图前先算清楚:调用次数 × 单次价格
详细说明见生图模型。
余额怎么被扣
- 余额是按账户算的,不区分分组。换分组不丢余额
- 余额不足会中断请求。余额耗尽时请求在网关层被拒, 不会转发到上游,也不产生模型用量费用
- 低余额会触发提醒(邮件 / 站内),提醒阈值见充值额度
- 充值余额与赠送额度可能分账记录,适用不同的使用顺序和期限
失败请求扣不扣费
按《服务特定条款》的一般规则:
| 情况 | 计费 |
|---|---|
| 未转发到上游(鉴权失败、余额不足、无效参数、平台主动拒绝) | 不收费 |
| 已转发但上游返回明确系统错误 | 按上游计费结果核验,必要时退回 |
| 已返回部分或全部结果 | 按实际用量计费 |
| 用户侧断网 / 主动取消,但上游已产生用量 | 可能正常计费 |
| 输出生成了但不符合主观预期 | 不视为平台错误,不退款 |
常见误判
「广场上写着 $5,为什么我被扣了 $10?」
因为广场展示的是基准价。你用的分组倍率是 ×2, 实付就是 $10。正确做法是看模型价格表里的实付价。
「为什么同样的对话,这次比上次贵?」
常见原因按概率排:
- 上下文更长 —— 多轮对话每轮都要带上历史,输入 token 线性增长
- 缓存没命中 —— 本该走
cache_read的部分变成了普通输入 - 输出更长 —— 输出价通常是输入价的数倍
- 踩到分档阈值 —— 上下文长度跨过了档位边界,单价跳升
看控制台的用量记录能分辨是哪一种。
「价格接口里的数字比广场大,是不是接口错了?」
接口是对的,它返回的就是实付价(已乘倍率),广场是基准价(未乘)。 这是设计如此,不是 bug。程序化接入见公开价格接口。