混合订阅成本隔离
同时使用 Plus 和 API 的开发者
验证账单独立性
防止因订阅混淆导致的预算超支
本站下一步 →官方 API / Token / 订阅对照表。官方 API / Token / 订阅 Plan 一页对照;用 SDK 打出的 usage 对上输入、输出、缓存三列。账号零售与 IDE 订阅由其它独立主题承担。
查「官方到底多少钱一兆 token」的专业对照表。

查的是「一兆 token 官方到底多少钱」。Plus 是订阅权益,API 按 Token 计量,两本账不能加在一起。
| 模型 | 输入 $/M | 输出 $/M | 缓存读 | 用途 |
|---|---|---|---|---|
| GPT-4o | — | — | — | 通用对话 / 工具调用 |
| Claude Sonnet 4.6 | $0.67/M | $3.33/M | — | 长文 / 编码折中 |
| Gemini 3 Flash Preview | $0.25/M | $6.00/M | — | 低价高吞吐 |
| DeepSeek V3 | $0.27/M | $1.10/M | $0.070/M | 推理 / 性价比 |
| Qwen Max | $0.33/M | $1.33/M | — | 中文 / 开源对照 |
| Grok 4.20 Non Reasoning | $0.63/M | $2.00/M | — | 编码 / Agent |
错 认为 Plus 订阅包含免费 API 额度
对 明确 Plus 与 API 是两套独立的计费体系
错 忽略长上下文中的重复部分,导致缓存失效
对 优化 Prompt 结构,最大化缓存命中区域
错 对所有任务都使用实时 API,忽视 Batch 选项
对 非实时任务优先选择 Batch API 以降低成本
输入 / 输出 / 缓存字段,服务对账而非代充
同一任务输出侧更吃预算
| 模型 | 家族 | 输入 | 输出 |
|---|---|---|---|
| GPT Image 2.5 Flare | openai | $0.00000000/M | $0.00000000/M |
| GPT Image 2.5 Flare | openai | $0.00000000/M | $0.00000000/M |
| GPT Image 2.5 Sunburst | openai | $0.00000000/M | $0.00000000/M |
| GPT Image 2.5 Sunburst | openai | $0.00000000/M | $0.00000000/M |
| gpt-image-2.5 | openai | $0.00000000/M | $0.00000000/M |
| Grok Imagine Image | xai | $0.00000000/M | $0.00000000/M |
| Grok Imagine Image 2.0 | xai | $0.00000000/M | $0.00000000/M |
| Grok Imagine Image Quality | xai | $0.00000000/M | $0.00000000/M |
输入/输出单价、缓存读写、免费额度与 Plan 限制一次讲清。
计费精算多数聊天/Agent 场景 completion 单价更高或量更大;优化输出比抠 prompt 更狠。
计费缓存读写单价不同;短请求可能不划算。
计费有效入/出 $/M ≈ 官方价 × 综合倍率;再乘用量得日费用。
计费精算报价单位混乱时的换算备忘。
计费精算Plus 不含无限 API;两套账单要分列。
官方定价页字段、抓取时间、公开汇率说明(若有 CNY 估算)。
缓存命中、失败重试、批处理延迟入账会造成账单与日志不一致。
中转低倍率若伴随降智或失败重试,有效成本可能高于官方。
不提供。本站是价表与计费说明,Key 在各云厂商或你选择的中转开通。
把 SDK 打印的 input / output / cache tokens 对上本站输入、输出、缓存三列单价,才能估账单。示例在 `/examples`,不代发请求。
账号零售不是本站主叙事,避免与「Token 单价」搜索意图撞车。本站回答一兆 token 多少钱。
缓存读通常远低于输入价,漏算会高估或低估账单,详见计费指南。
不能。Plus 是订阅权益,API 按 Token 计量,必须分项目对账。