刷新

2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段全解析

内容刷新 / GEO:补 English summary 与最新核对清单 — oa-2026-gpt-5-6-api-price-how-to-read

返回指南列表

封面:2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段全解析

2026 OpenAI GPT-5.6 官方 Token 价表怎么读:输入/输出/缓存字段全解析

OpenAI GPT-5.6 官方 Token 价格表告诉你如何从对账单中直接读懂每笔花费。输入字段、输出字段和缓存字段分别对应什么,标准价、长上下文价、缓存写费如何计算,一目了然。适合所有在用 OpenAI API、ChatGPT Work 或 Codex 的开发者,对账、预算规划和成本优化都可一键完成。

2026 年 GPT-5.6 官方 Token 价格表(标准上下文)

OpenAI 官方已将 GPT-5.6 家族(Sol、Terra、Luna)定价更新至官方 API 平台,强调“每层更高效”。以下是最新挂牌价,单位均为 USD / 1M tokens(百万 tokens)。

模型名称 输入(标准) 输入(缓存) 缓存写费 输出(标准) 输出(长上下文)
GPT-5.6 Sol $4.00 $0.40 $5.00 $20.00 $30.00
GPT-5.6 Terra $2.00 $0.20 $2.50 $12.00 $18.00
GPT-5.6 Luna $0.20 $0.02 $0.25 $1.20 $1.80

长上下文特殊处理:输入 token 长度超过 272K 时,输入字段价格按 2 倍标准价收取,输出字段按 1.5 倍收取。缓存字段在长上下文中同样适用相应倍率。

缓存字段全解析:Prompt 缓存价格如何节省

Prompt 缓存(cached input)是 GPT-5.6 官方推出的新功能,可显著降低重复上下文的成本。例如你让模型处理同一份文档或代码库多次,缓存后的输入 token 价格仅为标准输入的 10%(Sol 示例)。

  • 缓存写费:将上下文首次写入缓存时产生的额外费用(一次写,多次读)。
  • 实际节省示例(以 Sol 为例,假设 50K token 上下文):

- 不缓存:输入 50K token 成本 = 50K / 1,000,000 × $4 = $0.20

- 缓存后:输入成本降至 50K / 1,000,000 × $0.40 = $0.02(节省 90%),加上一次缓存写 $5。

- 后续多轮调用,输入成本继续保持极低。

缓存适用范围:支持 Responses API、ChatGPT Work 和 Codex 的 GPT-5.6 系列。开启方式在官方 API 文档中已有说明,开启后账单会自动记录缓存 token。

如何从账单中读取 GPT-5.6 Token 花费

OpenAI 官方计费页明确列出“Short context”和“Long context”两栏,开发者可直接对照账单核对。

1. 登录 https://platform.openai.com/ 查看账单明细,每条记录会同时显示输入、缓存输入、缓存写费、输出等字段。

2. 换算公式(任意模型通用):

总成本 = (输入 tokens / 1,000,000 × 输入率) + (缓存输入 tokens / 1,000,000 × 缓存率) + (缓存写费) + (输出 tokens / 1,000,000 × 输出率)

(长上下文额外乘以倍率)

3. 常见场景:

- 纯对话:主要看输入 + 输出。

- 长时间编码或研究:注意长上下文倍率和缓存节省。

- 批量任务:使用 Batch API 可进一步降低整体 $/M。

站内工具推荐:访问 OpenAI 官方 API 价格页 或 API 计费路径指南,直接输入你的 token 数即可一键算出预计花费。

站内实用路径:从对账到优化

这些页面结合官方数据表和计算器,让你从“看不懂账单”变成“精确控制预算”。

风险与边界

OpenAI GPT-5.6 官方 Token 定价仅供参考,以平台官方页面为准。长上下文或 Fast mode 等功能会触发额外费用,建议在实际任务前查看最新详情。价格可能随服务升级或区域政策调整。以上内容非法律意见,仅供对账和规划参考,请以 OpenAI 官方计费为准。如有疑问,建议直接联系 OpenAI 支持或查看平台 dashboard。

延伸阅读

English summary

This guide explains how to read the official 2026 OpenAI GPT-5.6 token pricing table for input/output/cached fields. It covers GPT-5.6 Sol ($4/$0.40/$5/$20), Terra ($2/$0.20/$2.50/$12) and Luna ($0.20/$0.02/$0.25/$1.20) per 1M tokens, with doubled long-context rates above 272K. Prompt caching can cut input costs by up to 90% with one-time write fees. Step-by-step formulas and examples help reconcile bills, calculate exact $/M spend, and optimize workflows in ChatGPT Work, Codex or Responses API. Always verify live data on the official platform, as prices and features may update. Ideal for developers managing budgets and scaling agentic or coding projects with GPT-5.6 models.