
## 2026 OpenAI API 官方 Token 价表怎么读:输入/输出/缓存字段详解
OpenAI GPT-5.6 系列(Sol、Terra、Luna)官方定价 $0.02-$30/M,缓存仅 $0.02-$1/M,Batch 半价,读者可直接对照账单字段计算真实成本。
本指南专为 OpenAI API 用户设计,教你从对账单读懂每个字段、快速算出实际 $/M 成本。适用于开发者、产品团队和企业采购者,能帮你避免预算超支、优化 Prompt 缓存策略,同时清晰区分 ChatGPT Plus 与纯 API 计费。
以 2026 年 7 月 30 日 OpenAI 官方定价页面为准,数据可能随时间调整,建议实时查阅。
1. 官方定价入口与更新时间(2026 年 7 月 30 日重大下调)
OpenAI 官方 API 定价入口在 https://openai.com/api/pricing/ 和开发者文档 https://developers.openai.com/api/docs/pricing。
2026 年 7 月 30 日起,GPT-5.6 Terra 价格下调 20%,Luna 下调 80%,Sol 保持不变。调整后,Luna 成为最亲民选择,适合高频小任务;Terra 平衡性强;Sol 仍是前沿旗舰。
更新后,标准定价(上下文 <270K tokens)已公开。长上下文和缓存机制也同步调整,企业用户可通过 Regional Processing 页面进一步确认数据主权规则。
2. GPT-5.6 核心模型单价速查表(Sol/Terra/Luna 短语境与长语境对比)
| 模型 | 短语境输入 | 短语境缓存 | 短语境输出 | 长语境输入 | 长语境缓存 | 长语境输出 |
|---|---|---|---|---|---|---|
| Sol | $5.00 | $0.50 | $30.00 | $10.00 | $1.00 | $45.00 |
| Terra | $2.00 | $0.20 | $12.00 | $4.00 | $0.40 | $18.00 |
| Luna | $0.20 | $0.02 | $1.20 | $0.40 | $0.04 | $1.80 |
这些为标准处理模式下的单价(每百万 tokens)。长语境触发条件为输入 >270K tokens。Cache Writes 字段单独列出(Sol $6.25、Terra $2.50、Luna $0.25),适用于新 Prompt 首次写入缓存场景。
3. 输入/输出/缓存字段完整解读与示例
- 输入:你发送给模型的 Prompt tokens(包括系统提示、用户消息)。
示例:一次询问“请总结这篇长文”的 Prompt 消耗 8K tokens,输入单价按模型而定。
- 输出:模型生成的内容 tokens(回答、代码、JSON 等)。通常输出单价是输入的 6 倍(Sol $30、Terra $12、Luna $1.20)。
- 缓存:Prompt 缓存(Cache Reads)会按大幅折扣计费(Luna $0.02、Terra $0.20、Sol $0.50)。缓存仅读不写,成本远低于标准输入。
- Cache Writes:新写入的 Prompt(通常在第一次使用后,缓存存活至少 30 分钟)。单价为标准输入的 1.25 倍(Sol $6.25 等),适合优化重复 Prompt。
4. Cache Writes 与长语境额外字段说明
Cache Writes 单独出现在账单,是首次提交 Prompt 时产生的费用。启用 Prompt Caching 后,相同系统提示或工具定义后续请求将命中缓存,节省 80%-90% 成本。
长语境额外字段:
- 长语境输入 / 长语境缓存 / 长语境输出
上下文超过 270K tokens 时,OpenAI 按 2x 输入、1.5x 输出的倍率额外计费。缓存也按相应倍率调整。
这对需要分析超长文档或代码库的开发者是重要提醒,建议优先拆分或启用缓存。
5. Batch API 与 Fast mode 折扣规则
Batch API 将输入和输出单价各砍半价(例如 Sol 短语境输入 $2.50、输出 $15),适合离线批量任务(如多轮数据处理)。实际可用时长约 24 小时内完成,需在 API 调用时指定 Batch 模式。
Fast mode(原 Priority Processing)仅对 Sol 模型生效:标准速度 2.5 倍,但价格翻倍(Sol 输入 $10、输出 $60)。适合需要极快响应的实时场景,其他模型暂无 Fast 模式。
6. 账单字段对应实战:如何从对账单读懂实际 $/M
OpenAI 账单通常按请求分组显示字段:
1. 记录请求 ID、模型(gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna)、上下文长度。
2. 统计 Input tokens、Output tokens、Cached input tokens、Cache writes。
3. 按模型单价乘以对应 tokens 数量,得到每条请求成本。
4. 总成本 ÷ 总 tokens(输入+输出)= 实际平均 $/M。
实战示例(Sol 模型):
- 10K tokens 短 Prompt(输入)+ 2K 输出 + 3K 缓存命中 = 总成本约 $0.10。
- 实际 $/M = (总 tokens 12K 的 1/1M)× 1000 = $1.00/M(已含缓存优势)。
建议下载官方 Billing 报告或使用第三方对账工具 https://www.grokcode.cn/tools/bill-reconcile 自动匹配字段。
7. 不同语境长度下的实际成本估算工具
结合官方数据,我们提供了简单估算公式:
短语境总成本($/M) = (Input × 输入单价 + Output × 输出单价 + Cached × 缓存单价) / 总 tokens × 1,000,000
长语境总成本 = 按倍率乘以相应字段
完整估算工具页:https://www.grokcode.cn/tools/token-cost(可导入你的账单 CSV 一键计算)。
8. 企业用户必看:数据主权与 Regional Processing 上浮规则
OpenAI 提供 Regional Processing 端点(数据主权可选),适用于需要符合 GDPR、CCPA 等法规的客户。2026 年 3 月 5 日后发布的模型在此类端点上,数据主权功能会额外收取 10% 上浮费用(例如 Luna 长语境输入从 $0.40 升至 $0.44)。
企业建议:
- 优先选择支持数据主权的 Regional 端点。
- 通过 https://openai.com/api/pricing/ 选择对应区域查看详情。
- 可内联阅读 https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/ 获取完整调整背景。
风险与边界
以上信息基于 2026 年 7 月 30 日 OpenAI 官方定价页面,实际以页面最新显示为准。部分价格可能随促销或模型更新调整,缓存缓存存活期(至少 30 分钟)也可能变化。
非法律意见声明:本文仅供参考,不构成任何财务、法律或合同建议。如需精确对账,请直接对照 OpenAI 开发者仪表盘或联系 OpenAI 企业销售团队。价格变动风险由用户自行承担。