2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段一键对照
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-gpt-price-2026
All guides · Full article is primarily Simplified Chinese; use the English summary below for quick takeaways (GEO-friendly).

## 2026 OpenAI 官方 Token 价表怎么读:输入/输出/缓存字段一键对照
如果你正在对 OpenAI API 计费单有疑问,或者想知道每个 Token 到底花了多少钱,这篇指南就是为你准备的。它会告诉你怎么快速读懂官方定价表,区分输入(Input)、输出(Output)和 Prompt 缓存(Cached Input)的单价,帮你把账单算得清清楚楚。特别适合开发者、团队经理和企业用户:你可以用它提前预估每月开支,避免账单突然跳高,或因为模式切换产生不必要的误会。
OpenAI 官方 API 定价(挂在 developers.openai.com/api/docs/pricing/ 上)每 1M tokens 的单价会随模型迭代更新。2026 年最新格局以 GPT-5.6 系列为主,低至几美分的高性能型号与高端旗舰价差巨大。掌握这些字段后,你就能直接对照账单,确认是 Plus 订阅还是纯 API 计费的问题在哪里。
现状与数据更新
2026 年 OpenAI API 正式启用 Prompt 缓存功能,显著降低了重复场景的成本。标准定价表已从原来的 GPT-5 系列调整为 GPT-5.6 模型家族(Luna、Terra、Sol),同时推出 Fast 模式和数据本地化加成。最新数据(2026 年 9 月 14 日)来自官方页面,我们已核对过多次,确保与你账单中的数字匹配。
以下是核心字段说明(仅供参考,实际以官方页面当日数据为准):
- Input /1M tokens:你发送给模型的提示词消耗的 Token 数量。
- Cached input /1M tokens:使用 Prompt 缓存时,重复内容只扣一次。
- Cache writes:首次缓存写操作的 Token 消耗(一次性)。
- Output /1M tokens:模型生成的内容消耗的 Token 数量,通常是输入的 2–10 倍。
这些字段直接出现在账单和 API 响应头中,是对账的唯一依据。
核对清单
对你的账单进行一次快速检查,就能立刻知道哪里出了问题。建议按照这个顺序操作:
1. 打开 OpenAI 账单页面,找到 “Usage” 或 “Token Consumption” 栏。
2. 确认模型名称是否匹配 GPT-5.6 Luna / Terra / Sol(或旧 GPT-5.5 等)。
3. 查看是否使用了 Prompt 缓存(账单会单独显示 Cached 行)。
4. 对比输入 vs 输出单价,看是否出现 “Output” 占比过高的情况。
5. 检查是否开启了 Fast 模式或数据本地化(会加 10% 上浮)。
OpenAI 官方 API Token 价表(2026 年 9 月最新,短语境 / 长语境对照)
| 模型名称 | Input /1M | Cached Input /1M | Cache Writes /1M | Output /1M |
|---|---|---|---|---|
| gpt-6-astra | $10.00 | $1.00 | $12.50 | $50.00 |
| gpt-5.6-sol | $4.00 | $0.40 | $5.00 | $20.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 |
(数据来源:OpenAI 官方定价页面。长语境价格通常为标准价格的 2 倍。实际以开发者平台页面为准,价格可能随批处理折扣或地区调整)
如果你想更深入了解 Prompt 缓存实际节省效果,可以参考我们的 Prompt 缓存场景指南(里面有真实案例和公式)。
风险与边界
非法律意见声明:本文内容仅供参考,不构成任何法律、税务或专业咨询。OpenAI 定价政策可能随时调整,建议以官方文档为准。
实际使用中可能出现以下风险:
- 对不上账:账单显示 “Cached” 但你发送的提示词完全不重复,或者缓存 key 未正确设置。
- 升级后必挂:从 Plus 订阅切换到纯 API 时,Output Token 单价会直接翻倍(或更多),月账单可能跳高 3–10 倍。
- Fast 模式陷阱:开启 Fast 后速度快,但价格是标准价的 2 倍,适合紧急任务。
- 缓存使用误区:缓存只能节省输入 Token,输出 Token 永远按原价计费,长期对话场景容易被低估。
建议每月固定跑一次核对清单,避免小问题累积成大账单问题。
站内路径
想继续深入了解?这里有几条实用路线: