计费精算

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段

OpenAI 品牌专题:2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段。 锚点:OpenAI。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段

OpenAI 的计费逻辑已从单纯的“按量付费”演变为包含 Prompt 缓存(Prompt Caching)的动态定价体系。对于开发者与对账人员而言,读懂价表的核心在于区分 Input(输入)、Output(输出) 与 Cached Input(缓存输入) 三个独立字段,并明确 ChatGPT Plus 订阅与 OpenAI API 在计费主体上的本质差异。本文旨在提供 2026 年视角的官方 API 计费对照逻辑,帮助读者精准核算 $/M tokens,避免因混淆缓存命中率或订阅权益导致的账单偏差。

核心概念与术语

在查阅 /official-prices 或官方文档时,需严格区分以下术语,它们直接决定最终账单金额:

  • Token: OpenAI 计费的基本单位。通常 1 个 Token 约等于 0.75 个英文单词或 0.5 个中文字符。
  • Input Tokens (Prompt): 发送给模型的提示词、系统指令及历史上下文。这是产生费用的主要部分,尤其是长上下文场景。
  • Output Tokens (Completion): 模型生成的回复内容。通常单价高于或等于输入单价,具体取决于模型版本。
  • Cached Input Tokens: 当请求中的前缀(Prefix)与近期(通常 5 分钟内)的缓存键匹配时,这部分 Token 以极低费率计费。这是 2024-2026 年间降低长对话成本的关键机制。
  • $/M tokens: 每百万 Token 的美元价格。价表通常以 $/M 为单位,例如 $0.10/M 表示每百万 Token 收费 0.1 美元。
  • ChatGPT Plus vs. API: Plus 订阅包含固定的每月额度(Quota),超出后按 API 标准或更高费率计费;API 账户则完全按实际消耗量实时扣费,无月度订阅门槛。

决策表:2026 模型计费结构对照

以下表格展示了典型模型在 2026 年可能存在的计费结构逻辑(具体数值请以 /official-prices 当日挂牌为准)。注意,缓存费率通常显著低于标准输入费率。

模型系列 输入单价 ($/M) 输出单价 ($/M) 缓存输入单价 ($/M) 适用场景建议
GPT-4o ~$2.50 - $5.00 ~$10.00 - $15.00 ~$1.25 - $2.50 多模态、高智能任务,需最大化缓存命中率。
GPT-4o mini ~$0.15 - $0.30 ~$0.60 - $1.20 ~$0.075 - $0.15 低成本批量处理,缓存效果极佳。
o1 / o3 系列 ~$15.00 - $60.00 ~$60.00 - $120.00 ~$7.50 - $30.00 复杂推理,缓存对长 System Prompt 节省显著。
ChatGPT Plus 包含在 $20/月 包含在 $20/月 包含在 $20/月 个人轻量使用,超出额度后按 API 价或限制。

*注:以上价格为示意性范围,实际费率随 OpenAI 策略调整。缓存费率通常为正常输入费率的 50% 或更低。*

实操清单:分步可核对账单

为确保账单与 /billing-path 中的记录一致,请执行以下步骤:

1. 确认模型版本: 检查 API 调用请求中的 model 字段。不同模型(如 gpt-4o vs gpt-4o-2024-05-13)可能对应不同价表。

2. 识别缓存命中: 在 API 响应头或日志中查找 cache_read_input_tokens 与 cache_creation_input_tokens。

* 若 cache_read_input_tokens > 0,说明部分输入被缓存,应享受折扣费率。

* 若缓存未命中,则全部输入按标准 input_tokens 费率计费。

3. 分离输入与输出: 账单通常将 prompt_tokens 和 completion_tokens 分开列示。确保分别应用对应的 Input 和 Output 单价。

4. 计算总成本:

$$ \text{总费用} = (\text{标准输入量} \times \text{输入单价}) + (\text{缓存输入量} \times \text{缓存单价}) + (\text{输出量} \times \text{输出单价}) $$

5. 对比订阅权益: 如果使用 ChatGPT Plus,首先检查当月剩余额度。仅在额度用尽后,才适用上述 API 计费逻辑。

常见坑与风险边界

  • 缓存键不匹配: 缓存仅对完全相同的文本前缀有效。即使是微小的格式差异(如空格、换行)也会导致缓存失效,从而按全价计费。务必使用 /api-transit 等工具标准化输入。
  • 混淆 Plus 与 API 额度: Plus 用户的免费额度不包含某些高成本模型(如 o1 系列)。误用高成本模型可能导致额度瞬间耗尽并触发高额 API 费用。
  • 隐藏的系统 Token: 某些第三方 IDE 修改器或会话包装网关可能在请求中注入额外的系统指令或元数据,这些 Token 同样计入输入量,但用户往往未察觉。
  • 升级后必挂: 若账户从 Plus 切换为 API 付费,或模型版本升级,旧有的缓存策略可能失效,导致成本突然飙升。

站内路径

延伸阅读

风险与边界

本文内容基于 OpenAI 官方公开信息整理,旨在提供计费逻辑参考,不构成财务或法律建议。OpenAI 的定价策略可能随时调整,具体费用请以 /official-prices 页面当日数据为准。用户应自行负责 API 调用的成本控制与账单核对。