官方API

2026 OpenAI GPT-5.6 官方 API 价格表详解:Sol / Terra / Luna 如何读账单

最新 GPT-5.6 系列(Sol / Terra / Luna)官方 Token 单价、缓存折扣、长上下文倍率及 Batch API 折扣一文读懂,帮对账单的用户精确计算每月花费。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 OpenAI GPT-5.6 官方 API 价格表详解:Sol / Terra / Luna 如何读账单

## 2026 OpenAI GPT-5.6 官方 API 价格表详解:Sol / Terra / Luna 如何读账单

OpenAI GPT-5.6 系列(Sol、Terra、Luna)官方 API 价格表已于 2026 年 7 月 9 日正式上线,读者可以直接对照账单精确计算每月 Token 消耗。适合企业开发者、数据科学家和企业用户,决策关键在于根据场景选择模型并启用缓存与 Batch API 来控制成本,避免 Plus 订阅的额外溢出。

## 1. 2026 GPT-5.6 家族三大模型核心特点

OpenAI GPT-5.6 采用新命名体系,将模型世代与能力等级分离。Sol 为旗舰模型,Terra 为均衡选项,Luna 为速度与成本优化版本。所有模型支持 105 万上下文窗口、128K 最大输出,知识截止日期为 2026 年 2 月 16 日。

  • Sol:最强推理与复杂任务(编码、生物、赛博)。支持 max 推理模式与 Ultra 加速子代理。
  • Terra:日常高负载工作,性能接近 GPT-5.5 但成本更低。
  • Luna:最快、最便宜,适合高频总结、自动化与日常处理。

这些特点让用户在官方 API 中灵活切换,避免单一模型的局限。

## 2. 官方标准价格表(短上下文 / 长上下文)

官方 API 定价按 1M tokens 计算,短上下文(<270K)与长上下文(>270K)使用不同倍率。缓存与 Batch API 可进一步降低费用。

模型 短上下文输入 短上下文缓存 短上下文输出 长上下文输入 长上下文缓存 长上下文输出
GPT-5.6 Sol $5.00 $0.50 $30.00 $10.00 $1.00 $45.00
GPT-5.6 Terra $2.00 $0.20 $12.00 $4.00 $0.40 $18.00
GPT-5.6 Luna $0.20 $0.02 $1.20 $0.40 $0.04 $1.80

注意:数据来源于 官方定价页面,实际以当日挂牌为准。缓存写入费为 uncached 输入的 1.25 倍(例如 Sol 写入 $6.25 /M)。

## 3. Prompt Caching 精确折扣规则(读/写/命中率)

Prompt Caching 是 OpenAI API 2026 新增机制,核心是分离输入、输出与缓存命中。读缓存保持约 90% 输入折扣,写入新缓存按 1.25 倍 uncached 输入收费,缓存有 30 分钟最低存活期。

  • 读缓存:稳定成本,推荐在对话历史或固定系统提示中使用。
  • 写缓存:一次性成本较高,适合大段稳定内容。
  • 命中率:高命中率可将整体成本降至原输入的 10% 附近。

## 4. Batch API vs 实时 API:50% 折扣详解

Batch API 通过异步批量处理支持 50% 输入输出折扣,适合高量非实时任务(如多文件分析或日志处理)。实时 API 保持即时响应但无折扣。

  • 使用场景:Cron 任务、数据导出、研究报告生成。
  • 优缺点对比:

| 维度 | 实时 API | Batch API(50% 折扣) |

|----------|----------|-----------------------|

| 延迟 | 即时 | 24 小时队列 |

| 成本 | 原价 | 50% |

| 适用场景 | 单次查询 | 批量处理 |

更多信息见 官方 API 页面

## 5. 长上下文(270K+)收费倍率及中文 Token 换算

长上下文(270K+)输入按 2 倍标准收费,输出按 1.5 倍。中文 Token 与英文大致 1:1 比例,但实际使用时建议用官方 Token 计数器验证。

例如,一段 300K 中文字数可能对应约 150 万英文 Token。

## 6. 如何从账单中读出真实 $/M tokens 成本

账单会拆分实时消耗、缓存命中与 Batch 任务。查看 “Input tokens”、“Output tokens”、“Cached input tokens” 即可计算。

实用公式(USD / 百万 tokens):

  • 标准输入成本 = Input tokens / 1M × 输入单价
  • 缓存读成本 = Cached input tokens / 1M × 缓存单价
  • 总成本 = 标准输入 + 缓存读 + 输出

建议每月用 Token 成本工具 导入账单 CSV 自动计算,避免人工误差。

## 7. 典型对账单场景计算示例

场景一:每月 1000 万输入(含 300 万缓存读)、2000 万输出、少量 Batch。

Sol 标准:1000 万 × $5 = $50

缓存读:300 万 × $0.50 = $1.5

输出:2000 万 × $30 = $600

总计约 $651.5(无缓存读时更高)。

场景二:Luna 日常自动化,启用缓存后成本降至 Sol 的 1/5 左右。

启用缓存可将类似 1000 万输入成本控制在 $2.5 以下。

## 风险与边界

使用 OpenAI API 价格可能因汇率、区域处理或政策变化而调整。以官方定价页当日数据为准。以上内容非法律意见,仅供参考。定价与规则以 OpenAI 官网最新公告为准,请始终验证官方来源。

## 延伸阅读

## English summary

OpenAI's GPT-5.6 family (Sol, Terra, Luna) official API pricing in 2026 includes clear per-million-token rates for short and long context, plus caching and Batch API discounts. Readers can use the detailed tables and billing examples above to accurately calculate monthly costs from invoices. Sol is the flagship for complex tasks, Terra for balanced workloads, and Luna for high-volume efficiency. Caching delivers up to 90% input savings on repeated prompts, while Batch processing cuts costs by 50% on non-real-time jobs. Long-context (>270K tokens) uses 2x input rates. Always cross-check the latest official pricing page for any updates, as this is not legal advice.

(全文约 2450 字,含中文为主,适合 Google/Baidu 收录与移动端阅读。数据以官方 2026 年 8 月最新定价为基准。)