官方 API 对照表

官方 API / Token 单价对照表

官方 API / Token / 订阅对照表官方 API / Token / 订阅 Plan 一页对照;用 SDK 打出的 usage 对上输入、输出、缓存三列。账号零售与 IDE 订阅由其它独立主题承担。

查「官方到底多少钱一兆 token」的专业对照表。

OpenAICN brand art

价表快照

模型数200
家族19
报价行200
  • 官方 Token $/M 与缓存价
  • 订阅 Plan 与 API 计费关系
  • 中转倍率 → 有效单价换算
  • 计费 FAQ 与账单对账入口说明
官方账本

官方 Token $/M:输入、输出、缓存怎么分账

查的是「一兆 token 官方到底多少钱」。Plus 是订阅权益,API 按 Token 计量,两本账不能加在一起。

本站只回答
官方输入/输出/缓存单价、Plan 与 API 如何分账、官方 SDK usage 如何对上三列、中转倍率怎么换成有效单价。
明确不写
卖号、验真实验室、IDE 订阅、把会员包装成 API 的接入教程——本站不做零售导购。
模型输入 $/M输出 $/M缓存读用途
GPT-4o通用对话 / 工具调用
Claude Sonnet 4.6$0.67/M$3.33/M长文 / 编码折中
Gemini 3 Flash Preview$0.25/M$6.00/M低价高吞吐
DeepSeek V3$0.27/M$1.10/M$0.070/M推理 / 性价比
Qwen Max$0.33/M$1.33/M中文 / 开源对照
Grok 4.20 Non Reasoning$0.63/M$2.00/M编码 / Agent
  1. ChatGPT Plus ≠ API 额度,必须分项目对账。
  2. 输出 Token 通常主导账单,只看输入单价会低估。
  3. Prompt Cache 只有长前缀重复命中时才省钱。
  4. 把 SDK 打印的 input / output / cache 对上本表三列,再估有效单价。

给谁看 · 不给谁看

适合
面向需要精确控制 API 成本的开发者与技术团队,提供基于官方数据的账单解析与成本优化方案。
请离开
不提供账号买卖、黑产教程、绕过平台限制或任何非官方渠道的接入服务。

先对号入座

混合订阅成本隔离

同时使用 Plus 和 API 的开发者

验证账单独立性

防止因订阅混淆导致的预算超支

本站下一步

长上下文缓存优化

处理长文档 RAG 应用

提升缓存命中率

显著降低重复 Token 的输入成本

本站下一步

异步批处理评估

非实时数据处理团队

对比 Batch 与实时单价

利用时间换空间获取更低单价

本站下一步

Token 成本预计算

预算敏感型产品经理

估算月消耗上限

在项目立项阶段确立财务边界

本站下一步

本站术语

Prompt Cache
OpenAI 缓存系统,对重复出现的上下文部分提供折扣计费
Batch API
异步批量处理接口,单价低于实时 API,适用于非即时任务
Input Token
用户发送给模型的提示词及上下文数据,按字符分词计费
Output Token
模型生成的回复内容,通常比输入 Token 单价更高

别这样比

  • 认为 Plus 订阅包含免费 API 额度

    明确 Plus 与 API 是两套独立的计费体系

  • 忽略长上下文中的重复部分,导致缓存失效

    优化 Prompt 结构,最大化缓存命中区域

  • 对所有任务都使用实时 API,忽视 Batch 选项

    非实时任务优先选择 Batch API 以降低成本

还想确认的

Plus 订阅能抵扣 API 费用吗?
不能。Plus 订阅与 API 调用是完全独立的计费系统。Plus 订阅提供的是 ChatGPT 网页版或 App 的高级功能额度,而 API 调用需要单独充值或使用预付费额度。两者资金池不互通,订阅费不会自动转化为 API 余额。
如何计算 Prompt Cache 的实际节省?
缓存节省取决于命中率。假设输入 10k Token,命中率 100%,且折扣率为 50%,则实际计费输入量为 5k Token。若原价为 $0.0025/1k,则节省 50% 的输入成本。需通过监控工具或日志统计重复上下文比例来估算命中率。
Batch API 比实时 API 慢多少?
Batch API 并非即时响应,通常需等待数分钟至数小时,具体取决于队列长度和任务复杂度。它适用于邮件生成、数据批量处理等非实时场景。若业务要求秒级响应,则必须使用实时 API,尽管其单价更高。
输入 Token 和输出 Token 哪个更贵?
通常情况下,输出 Token 的单价高于输入 Token。例如,GPT-4o 的输入价格为 $0.0025/1k,输出价格为 $0.01/1k。因此,优化 Prompt 减少输入长度,以及控制输出长度,是降低总成本的关键策略。

五步看完本站

  1. Day 1阅读官方定价文档
  2. Day 2理解 Plus 与 API 隔离
  3. Day 3学习 Token 成本计算
  4. Day 4分析缓存命中率影响
  5. Day 5评估 Batch 适用场景

计费决策框

SVG 结构化 · 对账单视角

Token 账单怎么读

输入 / 输出 / 缓存字段,服务对账而非代充

OpenAI
样本模型200
报价行200
指南23
Plus 与 API
必须分账
输出 tokens
通常主导账单
Prompt Cache
看命中率门槛
  • $/M
  • 倍率换算
  • 企业发票

成本敏感度

同一任务输出侧更吃预算

示意

Token 样本(官方)

完整价表 →
模型家族输入输出
GPT Image 2.5 Flareopenai$0.00000000/M$0.00000000/M
GPT Image 2.5 Flareopenai$0.00000000/M$0.00000000/M
GPT Image 2.5 Sunburstopenai$0.00000000/M$0.00000000/M
GPT Image 2.5 Sunburstopenai$0.00000000/M$0.00000000/M
gpt-image-2.5openai$0.00000000/M$0.00000000/M
Grok Imagine Imagexai$0.00000000/M$0.00000000/M
Grok Imagine Image 2.0xai$0.00000000/M$0.00000000/M
Grok Imagine Image Qualityxai$0.00000000/M$0.00000000/M

计费工作流

基线 → Plan → 倍率 → 工具

完整计费路径 →

价表模块

计费指南精选

全部 →

枢纽

模型家族排序

ChatGPT
Claude
Gemini
Qwen
DeepSeek
Kimi
GLM
Grok
Cursor
Windsurf

计费边界

可核验

官方定价页字段、抓取时间、公开汇率说明(若有 CNY 估算)。

需谨慎

缓存命中、失败重试、批处理延迟入账会造成账单与日志不一致。

风险提示

中转低倍率若伴随降智或失败重试,有效成本可能高于官方。

计费 FAQ

OpenAICN 提供 API Key 吗?

不提供。本站是价表与计费说明,Key 在各云厂商或你选择的中转开通。

官方 SDK 打出来的 usage 怎么对上三列?

把 SDK 打印的 input / output / cache tokens 对上本站输入、输出、缓存三列单价,才能估账单。示例在 `/examples`,不代发请求。

为什么不主打卡网账号?

账号零售不是本站主叙事,避免与「Token 单价」搜索意图撞车。本站回答一兆 token 多少钱。

缓存价格为什么单独列?

缓存读通常远低于输入价,漏算会高估或低估账单,详见计费指南。

会员 Plan 能当无限 API 用吗?

不能。Plus 是订阅权益,API 按 Token 计量,必须分项目对账。

对照资料与工具站

中转实测、IDE 订阅与新手会员说明见下列独立资料站;OpenAICN 只负责官方计费语义与价表。