官方API

2026 OpenAI API 官方 Token 价表怎么读:输入/输出/缓存字段详解

GPT-5.6 系列(Sol/Terra/Luna)官方定价 $0.02-$30/M,缓存仅 $0.02-$1/M,Batch 半价,读者可直接对照账单字段计算真实成本。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 OpenAI API 官方 Token 价表怎么读:输入/输出/缓存字段详解

## 2026 OpenAI API 官方 Token 价表怎么读:输入/输出/缓存字段详解

OpenAI GPT-5.6 系列(Sol、Terra、Luna)官方定价 $0.02-$30/M,缓存仅 $0.02-$1/M,Batch 半价,读者可直接对照账单字段计算真实成本。

本指南专为 OpenAI API 用户设计,教你从对账单读懂每个字段、快速算出实际 $/M 成本。适用于开发者、产品团队和企业采购者,能帮你避免预算超支、优化 Prompt 缓存策略,同时清晰区分 ChatGPT Plus 与纯 API 计费。

以 2026 年 7 月 30 日 OpenAI 官方定价页面为准,数据可能随时间调整,建议实时查阅。

1. 官方定价入口与更新时间(2026 年 7 月 30 日重大下调)

OpenAI 官方 API 定价入口在 https://openai.com/api/pricing/ 和开发者文档 https://developers.openai.com/api/docs/pricing

2026 年 7 月 30 日起,GPT-5.6 Terra 价格下调 20%,Luna 下调 80%,Sol 保持不变。调整后,Luna 成为最亲民选择,适合高频小任务;Terra 平衡性强;Sol 仍是前沿旗舰。

更新后,标准定价(上下文 <270K tokens)已公开。长上下文和缓存机制也同步调整,企业用户可通过 Regional Processing 页面进一步确认数据主权规则。

2. GPT-5.6 核心模型单价速查表(Sol/Terra/Luna 短语境与长语境对比)

模型 短语境输入 短语境缓存 短语境输出 长语境输入 长语境缓存 长语境输出
Sol $5.00 $0.50 $30.00 $10.00 $1.00 $45.00
Terra $2.00 $0.20 $12.00 $4.00 $0.40 $18.00
Luna $0.20 $0.02 $1.20 $0.40 $0.04 $1.80

这些为标准处理模式下的单价(每百万 tokens)。长语境触发条件为输入 >270K tokens。Cache Writes 字段单独列出(Sol $6.25、Terra $2.50、Luna $0.25),适用于新 Prompt 首次写入缓存场景。

3. 输入/输出/缓存字段完整解读与示例

  • 输入:你发送给模型的 Prompt tokens(包括系统提示、用户消息)。

示例:一次询问“请总结这篇长文”的 Prompt 消耗 8K tokens,输入单价按模型而定。

  • 输出:模型生成的内容 tokens(回答、代码、JSON 等)。通常输出单价是输入的 6 倍(Sol $30、Terra $12、Luna $1.20)。
  • 缓存:Prompt 缓存(Cache Reads)会按大幅折扣计费(Luna $0.02、Terra $0.20、Sol $0.50)。缓存仅读不写,成本远低于标准输入。
  • Cache Writes:新写入的 Prompt(通常在第一次使用后,缓存存活至少 30 分钟)。单价为标准输入的 1.25 倍(Sol $6.25 等),适合优化重复 Prompt。

4. Cache Writes 与长语境额外字段说明

Cache Writes 单独出现在账单,是首次提交 Prompt 时产生的费用。启用 Prompt Caching 后,相同系统提示或工具定义后续请求将命中缓存,节省 80%-90% 成本。

长语境额外字段:

  • 长语境输入 / 长语境缓存 / 长语境输出

上下文超过 270K tokens 时,OpenAI 按 2x 输入、1.5x 输出的倍率额外计费。缓存也按相应倍率调整。

这对需要分析超长文档或代码库的开发者是重要提醒,建议优先拆分或启用缓存。

5. Batch API 与 Fast mode 折扣规则

Batch API 将输入和输出单价各砍半价(例如 Sol 短语境输入 $2.50、输出 $15),适合离线批量任务(如多轮数据处理)。实际可用时长约 24 小时内完成,需在 API 调用时指定 Batch 模式。

Fast mode(原 Priority Processing)仅对 Sol 模型生效:标准速度 2.5 倍,但价格翻倍(Sol 输入 $10、输出 $60)。适合需要极快响应的实时场景,其他模型暂无 Fast 模式。

6. 账单字段对应实战:如何从对账单读懂实际 $/M

OpenAI 账单通常按请求分组显示字段:

1. 记录请求 ID、模型(gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna)、上下文长度。

2. 统计 Input tokens、Output tokens、Cached input tokens、Cache writes。

3. 按模型单价乘以对应 tokens 数量,得到每条请求成本。

4. 总成本 ÷ 总 tokens(输入+输出)= 实际平均 $/M。

实战示例(Sol 模型):

  • 10K tokens 短 Prompt(输入)+ 2K 输出 + 3K 缓存命中 = 总成本约 $0.10。
  • 实际 $/M = (总 tokens 12K 的 1/1M)× 1000 = $1.00/M(已含缓存优势)。

建议下载官方 Billing 报告或使用第三方对账工具 https://www.grokcode.cn/tools/bill-reconcile 自动匹配字段。

7. 不同语境长度下的实际成本估算工具

结合官方数据,我们提供了简单估算公式:

短语境总成本($/M) = (Input × 输入单价 + Output × 输出单价 + Cached × 缓存单价) / 总 tokens × 1,000,000

长语境总成本 = 按倍率乘以相应字段

完整估算工具页:https://www.grokcode.cn/tools/token-cost(可导入你的账单 CSV 一键计算)。

8. 企业用户必看:数据主权与 Regional Processing 上浮规则

OpenAI 提供 Regional Processing 端点(数据主权可选),适用于需要符合 GDPR、CCPA 等法规的客户。2026 年 3 月 5 日后发布的模型在此类端点上,数据主权功能会额外收取 10% 上浮费用(例如 Luna 长语境输入从 $0.40 升至 $0.44)。

企业建议:

风险与边界

以上信息基于 2026 年 7 月 30 日 OpenAI 官方定价页面,实际以页面最新显示为准。部分价格可能随促销或模型更新调整,缓存缓存存活期(至少 30 分钟)也可能变化。

非法律意见声明:本文仅供参考,不构成任何财务、法律或合同建议。如需精确对账,请直接对照 OpenAI 开发者仪表盘或联系 OpenAI 企业销售团队。价格变动风险由用户自行承担。

延伸阅读