刷新

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段详解

内容刷新 / GEO:补 English summary 与最新核对清单 — oa-2026-openai-token-price-table

가이드 목록 · 본문은 주로 중국어 간체입니다. 영문 요약(English summary)을 참고하세요.

封面:2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段详解

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段详解

OpenAI 官方 API 按 Token 计费,价表核心是 Input、Output 与 Cached input(以及部分模型的 Cache writes)三组字段。本文面向需要对账单、换算 $/M tokens、分清 ChatGPT Plus 订阅与 API 用量的人,帮助快速读懂挂牌价、核对实际账单差异,并以官方当日数据为准做决策。价格与字段以 OpenAI 开发者定价页为准,以下示例为 2026 年 9 月常见快照,仅作阅读方法说明。

现状与数据更新

2026 年 OpenAI 价表已从早期“仅 Input + Output”扩展到多字段结构。对账单时最常出现的几列是:

  • Input:完整处理一次提示词(含系统提示、历史、工具描述等)的标准单价,单位通常为 $/1M tokens。
  • Output:模型生成内容的单价,多数模型显著高于 Input(常见 4–6 倍)。
  • Cached input:命中 Prompt Caching 时的读取单价。当前主流 GPT-5.6 / GPT-6 系列多为标准 Input 的约 10%(即约 90% 折扣)。
  • Cache writes(部分新模型):首次写入缓存前缀的费用,常见为标准 Input 的 1.25 倍。不是所有模型都单独挂这一列。
  • Long context:上下文超过约 272K tokens 时,部分模型会启用更高费率(Input 常翻倍、Output 约 1.5 倍)。
  • Batch:异步批处理通道,通常再享 50% 折扣。

下面用短表列出当前旗舰与常用层级的短上下文(约 <272K)标准价示意(单位:$/1M tokens)。实际挂牌可能随时调整,务必回查官方页。

模型 Input Cached input Output
GPT-6 Astra 10.00 1.00 50.00
GPT-5.6 Sol(促销) 4.00 0.40 20.00
GPT-5.6 Terra 2.00 0.20 12.00
GPT-5.6 Luna 0.20 0.02 1.20

说明:GPT-5.6 Sol 的促销价至少持续到 2026 年 11 月 21 日(以官方公告为准);部分模型另有 Cache writes 列(约 1.25× Input)。长上下文与 Batch 费率在官方表中单独列出。完整对照可参考站内 官方 API 价格页 与 官方 API 说明。

对账单时,一条请求的费用大致可拆为:

> 费用 ≈ (非缓存 Input tokens × Input 单价) + (缓存命中 tokens × Cached input 单价) + (Output tokens × Output 单价)

若有 Cache writes 或长上下文加价,再叠加对应项。ChatGPT Plus 是消费者订阅,不包含 API 额度;API 是按量计费,二者不可直接混算。

核对清单

用这份清单对照你的用量报告或第三方账单,可快速定位“为什么和挂牌价对不上”:

1. 模型 ID 是否完全一致

确认调用的是 gpt-5.6-terra 还是带日期/变体的快照,价格页按精确模型名挂牌。

2. 是否触发缓存

查看 usage 里的 cached_tokens 或等价字段。稳定前缀(系统提示、固定文档)越长、命中率越高,Cached input 占比越大,实际均价越低。

3. 上下文是否跨过长上下文阈值

多数当前模型在约 272K tokens 以上切换费率。单次请求总长度接近上限时,整单可能按更高档计。

4. 是否使用 Batch 或 Fast/Priority 模式

Batch 通常半价但延迟更高;Priority/Fast 可能有上浮。账单里 service_tier 字段能直接看出。

5. 是否含工具、检索或多媒体

Web search、文件搜索、图片/音频 token 有时单独计价或按模型费率再计一次,不能只按纯文本 Input/Output 估算。

6. 货币与税费

挂牌价多为 USD 税前。企业账单可能含税、汇率、区域处理(Data residency 约 +10%)或预付折扣。

7. 时间窗口

促销结束、模型下线、费率调整都会让历史账单与当前价表不一致。对账时注明“账单日期”与“挂牌快照日期”。

完成以上七步后,若仍有较大差额,优先回官方 Usage 明细或站内 计费路径说明 再查一次。

风险与边界

  • 价表会变:模型迭代、促销窗口、长上下文阈值都可能调整。任何估算仅供参考,最终以 OpenAI 官方定价页与当日账单为准。
  • 缓存不是免费午餐:Cache writes 可能产生一次性费用;缓存 TTL、前缀必须精确匹配等条件不满足时,命中率会骤降。
  • Plus ≠ API:ChatGPT 订阅额度与 API Token 完全独立。把订阅当作“无限 API”会导致对账失败。
  • 第三方转发与包装:经中间层调用时,实际单价可能叠加网关费或汇率差。对账时要分清“官方挂牌”与“最终结算价”。
  • 本文不构成法律、财务或合同意见。具体合同条款、发票、税务处理请咨询专业顾问或以官方文件为准。

站内路径

需要继续算具体场景成本、看分账示例或核对转发链路时,可按以下路径使用站内工具与说明:

English summary

OpenAI’s 2026 API price table is read by three core columns: Input, Output, and Cached input (plus Cache writes on some newer models). Input is the standard prompt rate per 1M tokens; Output is usually several times higher; Cached input is typically about 10% of Input when prompt caching hits. Long-context tiers (often above ~272K tokens) and Batch (commonly 50% off) change the effective rate. To reconcile a bill, match the exact model ID, check cached token counts, confirm whether long-context or Batch applied, and separate ChatGPT Plus subscriptions from API usage. Prices change; always verify against the official OpenAI pricing page on the day of the invoice. This guide is for decision-making only and is not legal or financial advice.

延伸阅读

想继续核对挂牌价与实际账单差异,可先查阅站内 官方 API 价格总表 与 官方 API 计费说明;若涉及转发分账或场景示例,再参考 API 中转路径、计费路径拆解 以及 用量示例 与 指南索引。