API 计费路径
专业计费向脊柱。账号零售与中转测速引擎不在本站。
本站回答「一兆 token 多少钱」;通断检测请去 GrokCode。
官方 Token $/M:输入、输出、缓存怎么分账
查的是「一兆 token 官方到底多少钱」。Plus 是订阅权益,API 按 Token 计量,两本账不能加在一起。
- 本站只回答
- 官方输入/输出/缓存单价、Plan 与 API 如何分账、官方 SDK usage 如何对上三列、中转倍率怎么换成有效单价。
- 明确不写
- 卖号、验真实验室、IDE 订阅、把会员包装成 API 的接入教程——本站不做零售导购。
| 模型 | 输入 $/M | 输出 $/M | 缓存读 | 用途 |
|---|---|---|---|---|
| GPT-4o | — | — | — | 通用对话 / 工具调用 |
| Claude Sonnet 4.6 | $0.67/M | $3.33/M | — | 长文 / 编码折中 |
| Gemini 3 Flash Preview | $0.25/M | $6.00/M | — | 低价高吞吐 |
| DeepSeek V3 | $0.27/M | $1.10/M | $0.070/M | 推理 / 性价比 |
| Qwen Max | $0.33/M | $1.33/M | — | 中文 / 开源对照 |
| Grok 4.20 Non Reasoning | $0.63/M | $2.00/M | — | 编码 / Agent |
- ChatGPT Plus ≠ API 额度,必须分项目对账。
- 输出 Token 通常主导账单,只看输入单价会低估。
- Prompt Cache 只有长前缀重复命中时才省钱。
- 把 SDK 打印的 input / output / cache 对上本表三列,再估有效单价。
API账单精算指南
OpenAICN 专注解析官方 API 计费逻辑与账单路径,拒绝任何账号导购或黑产教程。本站核心在于厘清 Plus 订阅与 API 调用的资金隔离机制,确保开发者在混合使用场景下不产生重复扣费或账单混淆。我们将通过精确的数学模型,拆解输入/输出 Token 的主导成本结构,并量化 Prompt Cache 命中率对最终账单的实际影响。
我们提供标准化的成本计算框架,帮助技术团队建立透明的预算控制体系。内容严格基于官方定价文档,剔除所有非必要的营销噪音。无论是评估 Batch 批处理的经济性,还是实时调用的延迟成本,本站均提供数据驱动的决策依据。我们的目标是让每一分 API 支出都有据可查,每一行代码的成本都可被精准预测。
常见场景怎么走
把账算清楚
计算长文档 RAG 缓存收益
已知:输入 100k Token,缓存命中率 80%,模型 $0.0025/1k
- 识别缓存部分:100,000 × 80% = 80,000 Token
- 计算未缓存部分:100,000 × 20% = 20,000 Token
- 应用缓存折扣率(通常为 50%):80,000 × 0.5 × 0.0025 = $0.10
- 计算全价部分:20,000 × 1.0 × 0.0025 = $0.05
- 得出总输入成本:$0.15,对比全价 $0.25,节省 40%
结论:高命中率场景下,缓存可将输入成本减半以上
Batch 与实时调用成本对比
已知:每日处理 1M Token,实时单价 $0.005,Batch 单价 $0.00375
- 计算实时调用日成本:1,000,000 / 1,000 × 0.005 = $5.00
- 计算 Batch 调用日成本:1,000,000 / 1,000 × 0.00375 = $3.75
- 计算每日节省金额:$5.00 - $3.75 = $1.25
- 估算月度节省(22 工作日):$1.25 × 22 = $27.50
- 确认 Batch 适用性:任务非实时且允许异步处理
结论:对于非实时任务,Batch 模式可降低 25% 的输入成本
验证 Plus 与 API 账单隔离
已知:用户拥有 Plus 订阅,同时开启 API 额度 $100
- 登录 OpenAI 控制台,进入 Billing 页面
- 检查 'Subscription' 部分,确认 Plus 月费已扣
- 检查 'Usage' 部分,确认 API 调用仅消耗预充值额度
- 验证 API 账单中不包含任何 Plus 订阅费用
- 确认两者资金池完全独立,互不抵扣
结论:Plus 订阅不抵扣 API 费用,需分别管理预算
本站术语
- Prompt Cache
- OpenAI 缓存系统,对重复出现的上下文部分提供折扣计费
- Batch API
- 异步批量处理接口,单价低于实时 API,适用于非即时任务
- Input Token
- 用户发送给模型的提示词及上下文数据,按字符分词计费
- Output Token
- 模型生成的回复内容,通常比输入 Token 单价更高
- Hit Rate
- 缓存命中的 Token 占总输入 Token 的比例,直接影响成本节约
- Billing Path
- 从 API 调用到最终账单扣款的财务追踪链路
- Rate Limit
- API 调用的频率限制,超出可能导致请求被拒或额外费用
- Effective Price
- 考虑缓存折扣和批量优惠后的实际每千 Token 单价
别这样比
错 认为 Plus 订阅包含免费 API 额度
对 明确 Plus 与 API 是两套独立的计费体系
错 忽略长上下文中的重复部分,导致缓存失效
对 优化 Prompt 结构,最大化缓存命中区域
错 对所有任务都使用实时 API,忽视 Batch 选项
对 非实时任务优先选择 Batch API 以降低成本
错 仅关注输出 Token,忽略输入 Token 的主导成本
对 全面监控输入/输出比例,优化整体 Token 效率
错 使用过时的定价文档进行成本估算
对 定期查阅官方最新价格表,确保计算准确
还想确认的
- Plus 订阅能抵扣 API 费用吗?
- 不能。Plus 订阅与 API 调用是完全独立的计费系统。Plus 订阅提供的是 ChatGPT 网页版或 App 的高级功能额度,而 API 调用需要单独充值或使用预付费额度。两者资金池不互通,订阅费不会自动转化为 API 余额。
- 如何计算 Prompt Cache 的实际节省?
- 缓存节省取决于命中率。假设输入 10k Token,命中率 100%,且折扣率为 50%,则实际计费输入量为 5k Token。若原价为 $0.0025/1k,则节省 50% 的输入成本。需通过监控工具或日志统计重复上下文比例来估算命中率。
- Batch API 比实时 API 慢多少?
- Batch API 并非即时响应,通常需等待数分钟至数小时,具体取决于队列长度和任务复杂度。它适用于邮件生成、数据批量处理等非实时场景。若业务要求秒级响应,则必须使用实时 API,尽管其单价更高。
- 输入 Token 和输出 Token 哪个更贵?
- 通常情况下,输出 Token 的单价高于输入 Token。例如,GPT-4o 的输入价格为 $0.0025/1k,输出价格为 $0.01/1k。因此,优化 Prompt 减少输入长度,以及控制输出长度,是降低总成本的关键策略。
- 如何监控 API 账单以防止超支?
- 建议设置预算警报。在 OpenAI 控制台的 Billing 页面中,可以设置月度支出上限。当消耗达到预设阈值(如 80%、100%)时,系统会发送通知。此外,结合代码层面的日志记录,可实时监控每次调用的 Token 消耗。
- 缓存只对同一个模型有效吗?
- 是的,Prompt Cache 仅在同一个模型版本内有效。例如,GPT-4o 的缓存不能用于 GPT-4o-mini。此外,缓存有效期通常较短,若间隔时间过长,缓存可能失效。因此,保持会话连贯性和模型一致性对利用缓存至关重要。
- 有没有第三方工具可以自动优化 Token 成本?
- 目前官方未提供自动优化 Token 的工具。开发者需自行通过代码逻辑优化 Prompt,或使用第三方分析工具监控 Token 消耗。本站提供的计算框架可帮助手动估算成本,建议结合官方文档进行精细化成本控制。
- API 账单中是否包含其他隐藏费用?
- OpenAI API 账单主要基于 Token 消耗量。除特定模型外,通常没有其他隐藏费用。但需注意,若触发速率限制(Rate Limit),可能导致重试增加 Token 消耗。此外,某些高级功能或特定区域的服务可能有额外条款,建议仔细阅读官方定价页。
接着读
- 官方 API 接入文档 获取最新的接口规范与安全指南
- 最新模型定价表 核对各模型的具体单价与缓存折扣
- 账单路径详解 理解从调用到扣款的完整财务链路
- Token 价格阅读指南 学习如何准确解析 Token 计费细节
- 计划与 API 双重支付说明 澄清订阅与 API 费用的隔离机制
会员权益不是 Token 合同 · 把订阅包装成 API,对不上本站输入 / 输出 / 缓存三列。
计费工作流一览
专业计费向脊柱 · 账号零售不在本站
- 1. 读 Token 主表
- 锁定模型输入/输出单价。
- 2. 打印 usage
- SDK 片段对上三列。
- 3. 缓存与 Batch
- 别漏字段。
- 4. Plan 是否另付
- 会员 ≠ 无限 API。
- 5. 中转有效价
- 官方 × 综合倍率。
- 6. 交互速算
- GrokCode Token 成本工具。
- 7. 对账习惯
- 账单 vs 业务日志。
- $/M
- 缓存
- 发票
- 对账
- 1
读 Token 主表
锁定模型输入/输出单价。
- 2
打印 usage
SDK 片段对上三列。
- 3
缓存与 Batch
别漏字段。
- 4
Plan 是否另付
会员 ≠ 无限 API。
- 5
中转有效价
官方 × 综合倍率。
- 6
交互速算
GrokCode Token 成本工具。
- 7
对账习惯
账单 vs 业务日志。
计费精选
如何读官方 API Token 价表($/M)
输入/输出单价、缓存读写、免费额度与 Plan 限制一次讲清。
计费精算为什么账单常被输出 Token 吃掉
多数聊天/Agent 场景 completion 单价更高或量更大;优化输出比抠 prompt 更狠。
计费Prompt 缓存价:什么时候真的省钱
缓存读写单价不同;短请求可能不划算。
计费中转综合倍率如何换算成有效 Token 价
有效入/出 $/M ≈ 官方价 × 综合倍率;再乘用量得日费用。
计费精算Token 单位速查:1M / 1K / 中文字符
报价单位混乱时的换算备忘。
计费精算会员 + API 会不会付两次
Plus 不含无限 API;两套账单要分列。