官方API

2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段速查

教你用2026最新GPT-5.6家族(Luna/Terra/Sol)官方API定价表精确对账,缓存命中后单价暴跌10倍,Batch -50%,教你从账单里看到$/M真实成本。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段速查

## 2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段速查

这是一份专为 OpenAI API 用户准备的 2026 年最新 Token 价表解读指南

它帮助你精确对账单、计算真实 $/M 成本,区分 GPT-5.6 家族(Luna、Terra、Sol)的标准定价、缓存命中后的暴跌折扣,以及 Batch 与长上下文的差异。

适用对象:使用 OpenAI API 的开发者、团队和企业用户——无论你是日常聊天、复杂代理任务还是高频批量处理,都能在这里找到一目了然的字段读法,避免预算超支。

决策建议:账单里看到“cached_tokens”时,立即按本文规则复核;缓存命中后单价可降 10 倍,Batch 则省 50%。OpenAI 官方定价页面已于 2026 年 8 月 7 日更新(最后确认时间),所有数据均来自开发者官方文档。

OpenAI 官方 API 定价页面最新更新时间

OpenAI 官方 API 定价页面(https://openai.com/api/pricing/ 和 https://developers.openai.com/api/docs/pricing)于 2026 年 8 月 7 日 完成最后更新。

此前 2026 年 7 月 30 日曾对 Terra 和 Luna 进行 20% 及 80% 降价调整,Sol 保持不变。

更新内容包括:

  • GPT-5.6 家族三模型定价标准化
  • 明确长上下文定价档位
  • 确认缓存写入 1.25 倍收费规则
  • Batch API -50% 与数据地域 +10% 说明

建议:每次对账前刷新页面,或截图对比账单中的 input_tokens_details 字段,确保匹配最新版。OpenAICN 作为 OpenAI / 官方 API 计费对照站,提供简体中文一站式解读,帮助你避免二次确认导致的预算超支。

GPT-5.6 Sol / Terra / Luna 标准价表详解

GPT-5.6 家族采用分层定价(非单一模型),分 Sol(旗舰)Terra(均衡)Luna(轻快) 三档。

以下为标准短上下文(<270K)定价(单位:每百万 Token):

模型 输入($/M) 缓存输入($/M) 缓存写入($/M) 输出($/M) 备注
gpt-5.6-sol $5.00 $0.50 $6.25 $30.00 复杂代理/推理首选
gpt-5.6-terra $2.00 $0.20 $2.50 $12.00 日常高量均衡
gpt-5.6-luna $0.20 $0.02 $0.25 $1.20 轻量/高频首选

长上下文定价(上下文 >270K 时):输入 2 倍、输出 1.5 倍(Sol:$10 / $45;Terra:$4 / $18;Luna:$0.40 / $1.80)。

数据归属 / 区域处理:使用数据地域端点(Data residency)的模型,收费 +10%(2026 年 3 月 5 日后发布模型适用)。

这些字段直接出现在账单 usage 部分,可一键对照。

缓存输入字段命中规则与有效单价计算

OpenAI GPT-5.6 家族原生支持提示缓存(prompt caching),无需额外设置即可生效。

核心规则

  • 缓存命中(cache hit):输入部分按缓存输入价格计费(短上下文 Sol $0.50 /M,Terra $0.20 /M,Luna $0.02 /M)。
  • 缓存写入:写缓存时按 1.25 倍标准输入价格(Sol $6.25 /M)。
  • 保留期:最少 30 分钟,实际可更长。
  • 自动隐式断点(implicit)+ 显式断点(explicit)均支持,稳定前缀优先。

有效单价计算示例(假设 100 万 Token 输入、100 万 Token 输出):

1. 未命中缓存(首次):输入 $5(Sol)

2. 命中缓存(后续):输入仅 $0.50(Sol,节省 90%)

3. 总成本:输入 $5 + 输出 $30 = $35(未命中);命中后输入 $0.5 + 输出 $30 = $30.5(节省 13%)。

Luna 场景:未命中 $0.2 + 输出 $1.2 = $1.4;命中后 $0.02 + 输出 $1.2 = $1.22,节省近 99%。

账单字段拆解:

  • input_tokens:总输入
  • input_tokens_details.cached_tokens:命中部分
  • cache_write_tokens:写入部分(单独按 1.25 倍计费)

实战提示:把不变前缀(系统指令、工具定义、文档头)放在最前,明确 prompt_cache_options.mode: "explicit" 可精确控制。缓存命中后单价暴跌 10 倍,是 OpenAI API 最大省钱杠杆之一。

输出 Token 如何吃预算 vs 输入对比

输出 Token 是预算大头:每百万输出 Token 价格通常为输入的 6 倍(Sol $30 / $5;Terra $12 / $2;Luna $1.2 / $0.2)。

典型对话(系统 2000 Token + 用户 1000 Token + 输出 500 Token):

  • Luna:输入 $0.2 + 输出 $1.2 = $1.4 / call
  • Terra:输入 $2 + 输出 $12 = $14 / call
  • Sol:输入 $5 + 输出 $30 = $35 / call

对比技巧

  • 输入多、输出少(RAG、总结)用 Luna/ Terra
  • 输出多(生成、代码、推理)选 Sol
  • 所有模型输出价格均高于输入 6 倍以上,优先减少 max_output_tokens 或用更轻模型

账单里 output_tokens 直接乘对应输出价即可。

Batch API 与标准实时模式折扣一键对比

Batch API(异步批量处理):输入输出均 -50%(Sol 输入 $2.5 /M;Terra $1 /M;Luna $0.1 /M)。

适用场景:高量非实时任务(数据处理、训练数据准备、内容生成)。

标准实时模式(默认):全价。

Fast 模式(Sol 专享):速度 2.5 倍,价格 2 倍(Sol 输入 $10 /M)。

一键对比表(Luna 示例):

模式 输入($/M) 输出($/M) 适用场景
标准实时 $0.20 $1.20 交互式代理、单次查询
Batch $0.10 $0.60 大规模离线处理
Fast $0.40 $2.40 极致速度需求(Sol 专属)

使用时在请求体加 service_tier: "batch" 或 API 控制台选择。

长上下文定价档位(<270K vs 270K+)

<270K:标准价表(短上下文)。

270K+:输入 2 倍、输出 1.5 倍(Luna 示例:输入 $0.40、输出 $1.80)。

原因:长上下文模型需额外算力。

优化:拆分长文档用多次短查询,或用 Terra/Luna 替代 Sol。

账单判断input_tokens >270000 时自动按长上下文计费。

数据归属/区域处理 +10% 费用说明

数据地域端点(数据 residency):用户数据不离开指定区域,收费 +10%(2026 年 3 月 5 日后发布模型适用)。

推荐:企业合规场景必选,可通过官方页面选择对应区域。

账单影响:+10% 直接体现在 input_tokensoutput_tokens 金额上。

2026 年最新价表快速核对工具

快速核对工具(OpenAICN 推荐):

  • 官方定价页面:https://openai.com/api/pricing/
  • 开发者定价文档:https://developers.openai.com/api/docs/pricing
  • GrokCode Token Cost 计算器:https://www.grokcode.cn/tools/token-cost
  • GrokCode 账单对账工具:https://www.grokcode.cn/tools/bill-reconcile
  • GrokHome 独立工具站:https://www.grokhome.cn/path

使用方法:复制账单字段到工具,自动生成 $/M 明细 + 缓存命中估算。

风险与边界

本指南基于 2026 年 8 月 7 日官方 API 定价页面内容,旨在帮助读者精确对账。实际费用可能因模型更新、API 限额或区域调整而变,请始终以 OpenAI 官方定价页面为准。OpenAICN 非法律意见,仅供技术对账参考。

延伸阅读