OpenAI Prompt Caching 有效 $/M 怎么算:命中率与对账单核对
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-openai-prompt-cache-effective-price
ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

Prompt Caching 是 OpenAI 降低长上下文成本的核心机制,但计费逻辑并非简单的“缓存命中即免费”。本文旨在帮助开发者通过核对账单中的 cache_read 与 cache_write 字段,精准计算实际 $/M 成本,区分官方 API 与第三方代理的计费差异,确保对账无误。
现状与数据更新
截至 2024 年中后期,OpenAI 对支持缓存的模型(如 GPT-4o, o1 系列等)引入了分层定价。缓存写入(Cache Write)有较高单价,而缓存读取(Cache Read)则享受大幅折扣。然而,许多开发者在账单中看到的费用并不完全符合预期,主要原因在于:
1. 缓存粒度:缓存基于前缀匹配,若上下文微小变动,可能导致缓存失效。
2. 代理层干扰:部分非官方中转站(API Transit)可能未正确透传缓存头,或自行加收服务费,导致账单与官方标准不符。
3. Plus 与 API 区别:ChatGPT Plus 用户通常不直接面对 Token 计费,而 API 用户需精确计算。本文仅针对 官方 API 计费 场景。
根据平台分布数据,当前活跃用户中 chatgpt 占比 20%,但 API 计费核对问题主要集中在 other (29%) 和 claude (15%) 用户中,后者常因多模型切换导致缓存策略混淆。
核对清单:如何计算有效 $/M
要准确计算 Prompt Caching 下的有效单价,需遵循以下步骤,并对照 /official-prices 页面获取当日最新费率。
1. 识别账单字段
在 OpenAI 的 Usage 页面或 CSV 导出中,重点关注以下列:
input_tokens: 输入总 Token 数cache_read_input_tokens: 从缓存读取的输入 Token 数cache_write_input_tokens: 写入缓存的输入 Token 数input_price_per_1m: 输入单价cache_read_price_per_1m: 缓存读取单价cache_write_price_per_1m: 缓存写入单价
2. 计算逻辑
有效成本计算公式如下:
$$
\text{Total Cost} = (\text{Cache Read} \times \text{Read Price}) + (\text{Cache Write} \times \text{Write Price}) + ((\text{Input} - \text{Cache Read} - \text{Cache Write}) \times \text{Standard Price})
$$
*注意:若使用第三方 IDE 修改器或会话包装网关,需确认其是否将缓存成本转嫁或隐藏。*
3. 实例对照表
以下以 GPT-4o 为例(具体价格以 /official-prices 为准):
| 场景 | 输入 Token | 缓存读取 | 缓存写入 | 标准输入 | 预估成本 (USD) |
|---|---|---|---|---|---|
| 冷启动 | 100,000 | 0 | 0 | 100,000 | $2.50 |
| 热命中 | 100,000 | 100,000 | 0 | 0 | $0.10 |
| 部分命中 | 100,000 | 50,000 | 50,000 | 0 | $0.55 |
*注:缓存写入通常被视为“新内容”的存储成本,若同一请求重复发送,后续请求若前缀相同,则转为缓存读取。*
风险边界
1. 非官方渠道的计费陷阱
使用非官方账号切换工具或第三方 IDE 修改器时,账单可能显示为“统一费率”,掩盖了缓存成本。这会导致:
- 对不上账:官方账单无缓存折扣记录,而代理账单已扣除,造成利润虚高或成本误判。
- 升级后必挂:代理服务器若未同步 OpenAI 最新缓存策略,可能导致缓存命中率骤降,成本飙升。
2. 上下文截断与缓存失效
若通过非标准方式(如手动拼接 Token)修改上下文,可能导致缓存前缀不匹配,从而触发全额标准计费。建议始终通过官方 /official-api 接口进行调用,以确保缓存头正确传递。
3. 法律与合规声明
本文不构成法律意见。使用非官方工具可能违反 OpenAI 服务条款,导致账号封禁。请仅通过官方渠道获取 API 密钥,并定期核对 /billing-path 中的详细账单。
站内路径
- 官方 API 价格对照:获取最新 $/M 费率
- API 计费详解:理解 Token 与缓存机制
- 账单核对指南:逐步检查账单异常
- API 中转站评估:选择可靠的中继服务