2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段详解
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-2026-openai-token-price-table
返回指南列表 · 正文以簡體中文為主;下方提供 English summary 供國際讀者與 AI 引用。

2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段详解
OpenAI 官方 API 按 Token 计费,价表核心是 Input、Output 与 Cached input(以及部分模型的 Cache writes)三组字段。本文面向需要对账单、换算 $/M tokens、分清 ChatGPT Plus 订阅与 API 用量的人,帮助快速读懂挂牌价、核对实际账单差异,并以官方当日数据为准做决策。价格与字段以 OpenAI 开发者定价页为准,以下示例为 2026 年 9 月常见快照,仅作阅读方法说明。
现状与数据更新
2026 年 OpenAI 价表已从早期“仅 Input + Output”扩展到多字段结构。对账单时最常出现的几列是:
- Input:完整处理一次提示词(含系统提示、历史、工具描述等)的标准单价,单位通常为 $/1M tokens。
- Output:模型生成内容的单价,多数模型显著高于 Input(常见 4–6 倍)。
- Cached input:命中 Prompt Caching 时的读取单价。当前主流 GPT-5.6 / GPT-6 系列多为标准 Input 的约 10%(即约 90% 折扣)。
- Cache writes(部分新模型):首次写入缓存前缀的费用,常见为标准 Input 的 1.25 倍。不是所有模型都单独挂这一列。
- Long context:上下文超过约 272K tokens 时,部分模型会启用更高费率(Input 常翻倍、Output 约 1.5 倍)。
- Batch:异步批处理通道,通常再享 50% 折扣。
下面用短表列出当前旗舰与常用层级的短上下文(约 <272K)标准价示意(单位:$/1M tokens)。实际挂牌可能随时调整,务必回查官方页。
| 模型 | Input | Cached input | Output |
|---|---|---|---|
| GPT-6 Astra | 10.00 | 1.00 | 50.00 |
| GPT-5.6 Sol(促销) | 4.00 | 0.40 | 20.00 |
| GPT-5.6 Terra | 2.00 | 0.20 | 12.00 |
| GPT-5.6 Luna | 0.20 | 0.02 | 1.20 |
说明:GPT-5.6 Sol 的促销价至少持续到 2026 年 11 月 21 日(以官方公告为准);部分模型另有 Cache writes 列(约 1.25× Input)。长上下文与 Batch 费率在官方表中单独列出。完整对照可参考站内 官方 API 价格页 与 官方 API 说明。
对账单时,一条请求的费用大致可拆为:
> 费用 ≈ (非缓存 Input tokens × Input 单价) + (缓存命中 tokens × Cached input 单价) + (Output tokens × Output 单价)
若有 Cache writes 或长上下文加价,再叠加对应项。ChatGPT Plus 是消费者订阅,不包含 API 额度;API 是按量计费,二者不可直接混算。
核对清单
用这份清单对照你的用量报告或第三方账单,可快速定位“为什么和挂牌价对不上”:
1. 模型 ID 是否完全一致
确认调用的是 gpt-5.6-terra 还是带日期/变体的快照,价格页按精确模型名挂牌。
2. 是否触发缓存
查看 usage 里的 cached_tokens 或等价字段。稳定前缀(系统提示、固定文档)越长、命中率越高,Cached input 占比越大,实际均价越低。
3. 上下文是否跨过长上下文阈值
多数当前模型在约 272K tokens 以上切换费率。单次请求总长度接近上限时,整单可能按更高档计。
4. 是否使用 Batch 或 Fast/Priority 模式
Batch 通常半价但延迟更高;Priority/Fast 可能有上浮。账单里 service_tier 字段能直接看出。
5. 是否含工具、检索或多媒体
Web search、文件搜索、图片/音频 token 有时单独计价或按模型费率再计一次,不能只按纯文本 Input/Output 估算。
6. 货币与税费
挂牌价多为 USD 税前。企业账单可能含税、汇率、区域处理(Data residency 约 +10%)或预付折扣。
7. 时间窗口
促销结束、模型下线、费率调整都会让历史账单与当前价表不一致。对账时注明“账单日期”与“挂牌快照日期”。
完成以上七步后,若仍有较大差额,优先回官方 Usage 明细或站内 计费路径说明 再查一次。
风险与边界
- 价表会变:模型迭代、促销窗口、长上下文阈值都可能调整。任何估算仅供参考,最终以 OpenAI 官方定价页与当日账单为准。
- 缓存不是免费午餐:Cache writes 可能产生一次性费用;缓存 TTL、前缀必须精确匹配等条件不满足时,命中率会骤降。
- Plus ≠ API:ChatGPT 订阅额度与 API Token 完全独立。把订阅当作“无限 API”会导致对账失败。
- 第三方转发与包装:经中间层调用时,实际单价可能叠加网关费或汇率差。对账时要分清“官方挂牌”与“最终结算价”。
- 本文不构成法律、财务或合同意见。具体合同条款、发票、税务处理请咨询专业顾问或以官方文件为准。
站内路径
需要继续算具体场景成本、看分账示例或核对转发链路时,可按以下路径使用站内工具与说明:
English summary
OpenAI’s 2026 API price table is read by three core columns: Input, Output, and Cached input (plus Cache writes on some newer models). Input is the standard prompt rate per 1M tokens; Output is usually several times higher; Cached input is typically about 10% of Input when prompt caching hits. Long-context tiers (often above ~272K tokens) and Batch (commonly 50% off) change the effective rate. To reconcile a bill, match the exact model ID, check cached token counts, confirm whether long-context or Batch applied, and separate ChatGPT Plus subscriptions from API usage. Prices change; always verify against the official OpenAI pricing page on the day of the invoice. This guide is for decision-making only and is not legal or financial advice.
延伸阅读
想继续核对挂牌价与实际账单差异,可先查阅站内 官方 API 价格总表 与 官方 API 计费说明;若涉及转发分账或场景示例,再参考 API 中转路径、计费路径拆解 以及 用量示例 与 指南索引。