官方API

2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段速查

针对对账单的读者,完整拆解 2026 GPT-5.6 系列(Sol/Terra/Luna)官方定价:标准输入输出、缓存输入折扣、长上下文倍率、缓存写收费。教你直接从账单字段判断单价,快速对账。

All guides · Full article is primarily Simplified Chinese; use the English summary below for quick takeaways (GEO-friendly).

封面:2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段速查

## 2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段速查\n\nOpenAICN = OpenAI / 官方 API 计费对照站。作为对账单的读者,你需要精准对照官方价表计算 Token 成本、区分 Plus 与 API 用量,并避免账单差异。这份完整指南专为 2026 GPT-5.6 系列(Sol/Terra/Luna)设计,直接从账单字段判断单价,快速对账与预算规划。OpenAI API 价格GPT Token 单价ChatGPT API 多少钱Prompt 缓存价格官方 API 计费$/M tokens 等关键词贯穿始终。\n\nOpenAI 于 2026 年 7 月底发布 GPT-5.6 家族,包括旗舰 Sol、平衡型 Terra 与高性价比 Luna。三款模型均支持 Prompt Caching(提示缓存),缓存输入提供高达 90% 折扣,但 cache write(缓存写)对 GPT-5.6 系列收取 1.25 倍未缓存输入价。长上下文(>272K)定价更高,账单字段如 input_tokensoutput_tokenscached_tokenscache_write_tokens 直接决定实际成本。\n\n### 1. GPT-5.6 家族三大模型核心字段说明\nGPT-5.6 Sol:旗舰模型,适合复杂代理工作。官方定价:标准输入 $5.00/M,缓存输入 $0.50/M(90% 折扣),输出 $30.00/M;长上下文输入 $10.00/M,缓存输入 $1.00/M,输出 $45.00/M;cache write $6.25/M(短上下文)。 \nGPT-5.6 Terra:日常高效工作首选。官方定价:标准输入 $2.00/M,缓存输入 $0.20/M,输出 $12.00/M;长上下文输入 $4.00/M,缓存输入 $0.40/M,输出 $18.00/M;cache write $2.50/M。 \nGPT-5.6 Luna:最快最便宜,适合高频任务。官方定价:标准输入 $0.20/M,缓存输入 $0.02/M,输出 $1.20/M;长上下文输入 $0.40/M,缓存输入 $0.04/M,输出 $1.80/M;cache write $0.25/M。 \n\n这些字段来自 OpenAI API 定价,支持短上下文(<272K)和长上下文区别。\n\n### 2. 标准输入与输出单价详解(Sol/Terra/Luna)\n标准模式下,GPT Token 单价 由模型决定: \n- Sol:输入 $5.00/M,输出 $30.00/M \n- Terra:输入 $2.00/M,输出 $12.00/M \n- Luna:输入 $0.20/M,输出 $1.20/M \n\nChatGPT API 多少钱 计算示例: \n若每月处理 1M 输入 + 0.5M 输出 tokens(Terra 标准): \n成本 = (1M × $2.00) + (0.5M × $12.00) = $8 + $6 = $14。 \n\nLuna 作为 GPT Token 单价 最低选项,适合预算敏感场景。\n\n### 3. 缓存输入价格与 90% 折扣规则\nPrompt Caching 自动或显式启用,缓存输入价格 提供 90% 折扣(仅 GPT-5.6 系列有效)。 \n缓存读(cached_tokens 字段)按 $0.50/M(Sol)、$0.20/M(Terra)、$0.02/M(Luna)计费,节省显著。 \n\n缓存写(cache_write_tokens 字段)收取 1.25 倍未缓存输入价(GPT-5.6 及以后模型独有): \n- Sol:$6.25/M \n- Terra:$2.50/M \n- Luna:$0.25/M \n\n提示优化:将静态提示置于开头,使用 prompt_cache_options.mode: "explicit" 只缓存可复用前缀,可避免不必要写费。\n\n### 4. 长上下文(>272K)定价差异与缓存写收费\n长上下文(>272K)输入价格翻倍:Sol $10.00/M,Terra $4.00/M,Luna $0.40/M;缓存输入相应 $1.00/M、$0.40/M、$0.04/M;输出也上调。 \ncache write 仍按 1.25 倍未缓存输入收费,但长上下文下有效期至少 30 分钟。 \n\n账单实际字段对照: \n- input_tokens:未缓存或总输入 \n- output_tokens:输出 \n- cached_tokens:缓存读 \n- cache_write_tokens:缓存写 \n\n官方 API 计费 示例(Terra,1M 输入含 400K 缓存写 + 600K 缓存读,0.5M 输出): \n- 缓存写:400K × $2.00/M × 1.25 = $1 \n- 缓存读:600K × $0.20/M = $0.12 \n- 未缓存输入:600K × $2.00/M = $1.20 \n- 输出:$6 \n总计 ≈ $8.32(节省近 50%)。\n\n### 5. 账单实际字段对照:如何从 API 响应看单价\n使用 OpenAI API 响应对象直接读取: \n``json\n{\n "usage": {\n "prompt_tokens": 1250000,\n "completion_tokens": 500000,\n "cached_tokens": 400000,\n "cache_write_tokens": 500000\n }\n}\n` \n单价计算:缓存读 $0.20/M × 400 = $0.08;写 $2.50/M × 1.25 × 500 = $1.56;未缓存输入 $2/M × 600K = $1.20;输出 $12/M × 500K = $6。快速对账 使用这些字段即可。\n\n### 6. 2026 年价表更新关键点与优化建议\n2026 年 7 月 30 日更新:Terra/Luna 价格下调 20%/80%,Sol 缓存输入仍 $0.50/M,输出不变。长上下文倍率、cache write 1.25× 规则正式生效。 \n\n优化建议: \n- 静态上下文优先缓存 \n- 定期清理缓存(30 分钟生命周期) \n- 优先 Luna/ Terra 替代 Sol(成本差异大) \n- 结合 Batch API(50% 折扣) \n\n### 7. 常见对账单误区与正确读法\n误区:忽略 cache_write_tokens 导致多算 25% 输入成本;或将 Plus 与 API 混淆(Plus 按订阅计费,API 按 Token $/M)。 \n正确读法:始终看官方定价表 + 账单 usage` 字段,按模型 + 上下文 + 缓存类型计算,避免误差。\n\n## 延伸阅读\n- 官方 API 定价页 \n- 提示缓存指南 \n- OpenAI API 总览 \n- 官方 API 计费指南 \n- API 迁移与 Transit 服务 \n\n## 风险与边界\n以上内容基于 2026 年 8 月 OpenAI 官方公开定价,实际以 openai.com/api/pricing 为准。非法律意见声明:本文不构成任何法律、财务或专业建议。定价可能随时间变化,建议实时核对官方文档。OpenAICN 仅供对账参考,不涉及任何零售、代充或推广。\n\n## English summary \nThis 2026 guide explains how to read OpenAI GPT-5.6 official token pricing for billing accuracy. The three models—Sol, Terra, and Luna—follow updated rates with 90% cache input discounts and 1.25x cache write charges on GPT-5.6+. Use billing fields like cached_tokens and cache_write_tokens to calculate exact costs, distinguishing API from Plus usage. Long contexts (>272K) double input prices. Key points include model-specific $/M rates, optimization tips for caching, and common billing mistakes. Always cross-check openai.com/api/pricing for the latest. This serves as a precise reference for readers planning API budgets and reconciling statements.