2026 OpenAI 官方 Token $/M 价表怎么读:GPT-5.6 Sol/Terra/Luna 输入输出缓存字段全解析
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-2026-gpt-5-6-official-token-price

2026 OpenAI 官方 Token $/M 价表怎么读:GPT-5.6 Sol/Terra/Luna 输入输出缓存字段全解析
如果你正在处理 OpenAI API 对账单,需要快速区分 GPT-5.6 Sol、Terra 和 Luna 的实际花费,这就是正确打开价表的方式。
这个指南专为开发者、产品经理和企业用户设计,帮助你一次性看懂每种模型的输入/输出单价、缓存折扣、长上下文加倍规则,以及不同场景下的真实成本。
结合 OpenAICN 的计费对照工具,你可以直接对照账单字段,找出每月超支的原因并优化 Prompt 结构。
现状与数据更新
2026 年 7 月 30 日,OpenAI 正式推出 GPT-5.6 模型家族,并同步调整 API 定价。
Luna 被定位为“最快最便宜”的日常模型,Terra 则适合中量级工作负载,Sol 仍保持较高智能但速度和价格未变。
这些调整直接影响了 API 实际消费,让大规模任务更具性价比。
最新核对清单(以官网 2026 年 9 月 20 日挂牌价为准,建议实时验证):
- 所有定价均以 per million tokens 计算。
- 缓存(prompt cache)读写字段已明确分开。
- 长上下文(>272,000 输入 tokens)触发 2 倍输入 / 1.5 倍输出费用。
- 推理(reasoning)token 按输出价计费,可能占总消耗的 20-40%。
- 批量(batch)或 Flex 处理可选折扣,详情请查 OpenAI 官方文档。
核对清单
1. 打开 OpenAI 开发者仪表盘(dashboard.openai.com)查看每日账单明细。
2. 对比你当前使用的模型 ID 与 gpt-5.6-terra / gpt-5.6-luna 字段。
3. 统计输入 vs 输出 token 数量,确认是否命中缓存。
4. 检查长上下文触发条件(>272k),是否产生额外费用。
5. 运行一次完整调用,记录实际 $/M 成本(OpenAICN 提供实时估算工具)。
6. 与 ChatGPT Plus/Pro 订阅的内部用量比对(API 与 Plus 计费完全独立)。
风险与边界
使用官方 API 计费数据仅供对账与规划,OpenAICN 站点不提供任何破解、注入或本地部署方案。
过度依赖廉价模型(如 Luna)可能导致质量波动,尤其在复杂代码或长链路任务中;若账单长期异常,建议升级到 Sol 高智能模式或切换其他提供商。
这些内容仅为通用参考,不构成法律意见,实际费用以 OpenAI 官网当天数据为准。
站内路径
- OpenAI 官方 API 价格对照:最新完整价表与模型 ID 对应表。
- 官方 API 计费指南:每月消费趋势分析与优化建议。
- API 事务流转与缓存设置:如何在代码中写入 cache 字段。
- 账单路径详解:精确识别输入输出缓存字段。
- 实际用例解析:Sol/Terra/Luna 场景代码示例。
- 对账工具使用:结合站内计算器直接对账。
GPT-5.6 模型与 Token $/M 价格对比表
以下表格基于 OpenAI 官方 July 30 2026 公告与 2026 年 9 月最新验证数据,包含缓存字段。
(移动端可横向滚动查看)
| 模型 | Uncached Input | Cached Input | Cache Writes | Output |
|---|---|---|---|---|
| Sol (gpt-5.6) | $5.00 | $0.50 | $6.25 | $30.00 |
| Terra (gpt-5.6-terra) | $2.50 | $0.25 | $3.125 | $15.00 |
| Luna (gpt-5.6-luna) | $1.00 | $0.10 | $1.25 | $6.00 |
说明:
- Luna 价格较 Terra 低 80%,Sol 价格不变(保持最高智能)。
- Cached Input 读入价通常为 Uncached 的 10%,大幅降低重复提示词成本。
- Cache Writes(首次写入)仍按 Uncached 价计费,但后续读入可节省 90%。
如何实际应用与节省成本
在 API 调用中,建议显式指定模型 ID(如 gpt-5.6-terra)。
对于高频查询,优先使用 Luna + 缓存;对于关键推理任务,切换 Sol 并开启 Fast 模式(速度提升 2.5 倍,价格不变)。
长上下文提示词建议拆分,减少重复上下文。
更多可执行步骤,请参阅站内 API 事务流转与缓存设置。
延伸阅读
English summary
OpenAI’s 2026 GPT-5.6 family (Sol, Terra, Luna) now offers clear, transparent pricing per million tokens, with dedicated fields for uncached input, cached input, cache writes, and output. Luna is the cheapest and fastest option at $1/$6 per million (80% cheaper than Terra), Terra balances cost and performance at $2.50/$15, while Sol remains premium-priced at $5/$30 for highest intelligence. Prompt caching delivers up to 90% savings on repeated context, but cache writes are charged at full uncached rates. Long prompts over 272,000 tokens incur double input and 1.5x output fees. OpenAICN helps readers read official bills accurately, separate API from ChatGPT Plus usage, and calculate real monthly costs for developer workflows. Always verify latest prices directly on OpenAI’s dashboard, as changes can occur. This guide provides a practical comparison table and decision framework for efficient token budgeting in 2026.