官方API

2026 OpenAI GPT-5.6 系列 Token 官方价表:Sol/Terra/Luna 输入输出缓存单价速读

最新 GPT-5.6 旗舰模型正式上线后的官方计费对照:Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20 输入输出缓存价表,含 Prompt Caching 写缓存、批量 API 折扣及长上下文有效单价计算方法,帮助读者直接对账单。

ガイド一覧 · 本文は主に簡体字中国語です。国際向けの要点は English summary をご利用ください。

封面:2026 OpenAI GPT-5.6 系列 Token 官方价表:Sol/Terra/Luna 输入输出缓存单价速读

# 2026 OpenAI GPT-5.6 系列 Token 官方价表:Sol/Terra/Luna 输入输出缓存单价速读\n\n这是 OpenAI 官方 API 的 GPT-5.6 系列(Sol、Terra、Luna)最新计费对照表,帮助读者直接从账单中对齐 Token $/M、Prompt Caching 写缓存与批量折扣。适用于所有 OpenAI API 用户,无论是独立开发者还是企业团队,通过精准计算能有效控制超支并优化长期成本。\n\n适用人群:日常使用 ChatGPT Plus / Pro 的用户、运行 Agent 任务的开发者、需要长上下文分析的企业团队。 \n决策依据:掌握价表后可即时判断哪个模型最划算,结合缓存命中率与 Batch API 直接算出月支出,避免因缓存规则或折扣误用而超支。 \n\nOpenAI 于 2026 年 7 月 30 日对 Terra 和 Luna 进行了大幅降价,Sol 保持原价,GPT-5.6 系列已全面上线并成为主力模型。掌握这些单价是 2026 年 OpenAI API 计费的必备技能。\n\n## 1. GPT-5.6 系列三大模型当前定价一览(2026 年 8 月最新)\n\nGPT-5.6 系列采用三档定价体系,分别对应不同场景:Sol 为旗舰智能体任务,Terra 为日常平衡,Luna 为高频低延迟工作。所有价格均为 USD per 1M tokens,标准上下文(短语境)下实时计算。\n\n| 模型 | 输入 $/M | 输出 $/M | 缓存读入 $/M(短上下文) | 适用场景 |\n|------------|----------|----------|---------------------------|---------------------------|\n| Sol | $5.00 | $30.00 | $0.50 | 复杂 Agent、深度推理、编码 |\n| Terra | $2.00 | $12.00 | $0.20 | 日常工作、平衡性能 |\n| Luna | $0.20 | $1.20 | $0.02 | 批量分类、总结、提取 |\n\n长上下文(超过 270K 输入 token)价格翻倍:输入 $10、缓存读入 $1、输出 $45(Sol 示例)。 \n数据来源:OpenAI 官方定价页面(截至 2026 年 8 月 8 日),所有价格含标准处理,无区域上浮。\n\n## 2. 输入输出缓存价格字段速查表(短语境 vs 长上下文)\n\nPrompt Caching 是 GPT-5.6 的核心功能,支持显式缓存断点,30 分钟内有效。缓存读入享受 90% 折扣,写入按 1.25 倍标准输入价。\n\n| 模型 | 短语境输入 | 短语境输出 | 短语境缓存读 | 短语境缓存写 | 长上下文输入 | 长上下文输出 | 长上下文缓存读 | 长上下文缓存写 |\n|------------|------------|------------|--------------|--------------|--------------|--------------|----------------|---------------|\n| Sol | $5.00 | $30.00 | $0.50 | $6.25 | $10.00 | $45.00 | $1.00 | $12.50 |\n| Terra | $2.00 | $12.00 | $0.20 | $2.50 | $4.00 | $18.00 | $0.40 | $5.00 |\n| Luna | $0.20 | $1.20 | $0.02 | $0.25 | $0.40 | $1.80 | $0.04 | $0.50 |\n\n速读技巧:默认走短上下文,缓存读入立即降低输入成本。长上下文仅在 1M+ 上下文需求时开启,价格按比例上涨。\n\n## 3. Prompt Caching 写缓存 $6.25/M 有效单价与命中率换算\n\n写缓存单价:Sol $6.25/M、Terra $2.50/M、Luna $0.25/M(均为 1.25 倍标准输入)。 \n读缓存单价:Sol $0.50/M(90% 折扣后),Terra $0.20/M,Luna $0.02/M。 \n\n命中率换算公式: \n设缓存命中率 = 重复前缀 Token / 总输入 Token。 \n每月有效输入成本 = [(总输入 - 命中 Token)/ 总输入] × 标准输入价 + [命中 Token / 总输入] × 缓存读入价。 \n\n示例(Sol,100 万输入,40% 命中): \n未缓存 = $50 \n40% 命中后 = $50 - 400,000 × $4.50(折扣差价)= $30 \n(实际每月节省约 40%,取决于命中率)。\n\n最佳实践:Agent 任务的 system prompt + 工具定义可固定缓存,连续 30 分钟内多次调用命中率 >30% 即可大幅降本。\n\n## 4. Batch API 50% 折扣后的最终 $/M 计算公式\n\nBatch API:异步批量处理,24 小时内完成,输入与输出均享 50% 折扣。 \n公式: \n最终输入 $/M = 标准输入 × 0.5 \n最终输出 $/M = 标准输出 × 0.5 \n\n叠加缓存:若同时使用缓存,读取部分仍按缓存价计算(批处理支持显式缓存)。 \n示例:Sol 10M 输入 + 2M 输出,标准 = $70 \nBatch 后 = $35 \n若 30% 输入缓存命中,实际可进一步降低至 $28 左右。\n\n适用场景:离线数据处理、批量分类、夜间同步任务。实时用户界面不推荐使用 Batch。\n\n## 5. 不同场景(如长上下文 Agent 任务)有效单价测试案例\n\n场景 1:长上下文 Agent(1.5M Token) \n- 输入:100 万(60% 缓存命中)+ 50 万长上下文 \n- 输出:20 万 \n- 总成本:输入 $45(缓存后) + 输出 $6 = $51(标准约 $130,节省 61%)。\n\n场景 2:高频批量分类(Luna) \n- 每日 100 万 Token,Luna 标准 $6 \n- Batch 50% 后 $3 \n- 缓存命中 80% 后实际 <$1。\n\n场景 3:混合 Sol/Terra \n- 20% 复杂推理用 Sol(Agent) \n- 80% 日常用 Terra(Luna 低延时) \n- 估算月均:Terra 主导 + Luna 批量 = $45(远低于全 Sol 的 $550)。\n\n## 6. 如何从账单中快速识别缓存命中与批量处理节省\n\n账单字段速辨: \n- OpenAI API 响应头中 cache_creation_input_tokens / cache_read_input_tokens 可直接查看。 \n- 账单明细中输入 Token 分「cached_input」与「total_input」。 \n- Batch API 任务提交时会显示 batch_id,完成后在响应中查看 input_tokensoutput_tokens 折扣标记。 \n\n快速检查步骤: \n1. 下载 JSONL 文件,搜索 cached 字段。 \n2. 对比 prompt_tokens vs cached_input_tokens。 \n3. Batch 任务完成后,检查 cost 字段是否为标准价的 50%。 \n4. 用公式:节省 = (未缓存部分 × 折扣差) + 批处理减半。\n\n## 7. 其他 2026 新模型(如 GPT-5.5)价表补充说明\n\nGPT-5.5 与 GPT-5.6 Sol 完全一致($5/$30),无新缓存或 Batch 变化。GPT-5.6 是 2026 年主力升级版,推荐优先路由到 GPT-5.6 系列。\n\n## 延伸阅读\n\n- 官方 API 入门指南 \n- GPT Token 单价详解 \n- ChatGPT API 多少钱 \n- Prompt 缓存价格 \n- 批量计费优化 \n\n## 风险与边界\n\nOpenAI API 定价可能随优化或促销调整,请以官方文档为准。以上内容仅供参考,非法律意见。实际计费以 OpenAI 账单为准。\n\n## English summary\n\nThis is the official OpenAI API GPT-5.6 series (Sol, Terra, Luna) pricing guide for August 2026, helping readers accurately match tokens on bills, calculate $ /M, and distinguish between Plus and API usage. GPT-5.6 Sol costs $5/$30 input/output, Terra $2/$12, Luna $0.20/$1.20 (post-July 30 adjustments). Prompt Caching offers 90% discounts on reads with $6.25/M writes; Batch API provides 50% off for async tasks. Long-context pricing doubles for >270K tokens. Real-world examples show 40-60% savings with caching in Agent workflows and Luna for high-volume tasks. Use billing fields like cache_creation_input_tokens to verify hits instantly. Always cross-check the latest OpenAI pricing page for updates.