OpenAI API 每百万 Token 单价详解:输入、输出与缓存费率全表
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-openai-api-cost-per-1m-tokens-breakdown

OpenAI API 每百万 Token 单价详解:输入、输出与缓存费率全表
如果你正在为 OpenAI API 账单做对账,或者想知道每次调用 GPT 系列模型到底花了多少美元,本指南就是给你准备的。它能直接帮你拆解输入、输出和 Prompt 缓存价格,分清 ChatGPT Plus 与官方 API 的费用差异,并帮你算出实际单价。
适用人群包括正在搭建智能应用、跑大模型推理、做代码补全或 agent 任务的开发者;或者那些需要精确控制成本的人群。通过这张完整费率对照表,你可以快速决策选哪个模型最划算。
---
现状与数据更新
2026 年 9 月,OpenAI API 继续优化效率,主力模型价格普遍下降,同时 Prompt 缓存(prompt caching)成为高频场景的必备功能,能把输入成本降低 10 倍左右。
官方最新挂牌数据(截至 2026 年 9 月 3 日)显示,旗舰模型如 gpt-5.6-sol 在标准输入下已低至 $4.00 / 1M tokens,缓存输入只需 $0.40 / 1M tokens。相比 2025 年同期,多数模型的输入价格已下降 50-70%。
注意:以官方 https://developers.openai.com/api/docs/pricing 为准,实际以你的项目 Key 拉取的 dashboard 显示为准。批量处理(Batch API)可再享 50% 折扣,数据留存(data residency)可能加收 10% 上浮。
---
核对清单
1. 登录 OpenAI API Dashboard 查看每月消耗和 Token 用量明细。
2. 使用官方 Token 计数工具或 API 文档中的 tiktoken 库统计输入输出 Token 数。
3. 检查是否开启 Prompt 缓存(通过 extra_headers 或请求头配置)。
4. 对照下方全表确认模型匹配你的项目需求(推荐 gpt-5.6-luna 用于日常,gpt-5.6-sol 用于复杂推理)。
5. 定期复核(每月一次)账单,匹配站内 /billing-path 工具页数据。
6. 对比 ChatGPT Plus 订阅(每 1M 约 $5.00 输入)与纯 API 使用成本,选择更优方案。
---
风险与边界
OpenAI API 价格为官方实时挂牌数据,可能随产品迭代或促销随时调整,请以官网最新公示为准。批量处理、数据留存等特殊模式价格不同;视觉/音频模型需额外参考图像成本计算器。
非法律意见声明:本指南仅供参考,不构成投资、法律或财务建议。开发者需自行承担使用 API 的全部责任,包括但不限于账单超支、数据安全或合规风险。
---
站内路径
- 查看官方定价详情与模型目录:/official-prices
- 了解 API 计费路径与对账工具:/billing-path
- 掌握 Token 计数与缓存配置:/api-transit
- 完整 API 指南与 Transit 说明:/official-api
- 更多实用技巧与决策指南:/guides
---
OpenAI API 每百万 Token 单价详解:输入、输出与缓存费率全表
以下是 OpenAI API 当前主流模型的每百万 Token 完整费率对照表(标准上下文长度下,单位:美元)。价格数据来自官方 2026 年 9 月挂牌页。
旗舰模型(推荐日常使用)
| 模型 | 输入($/1M) | 缓存输入($/1M) | 输出($/1M) | 备注 |
|---|---|---|---|---|
| gpt-5.6-sol | 4.00 | 0.40 | 20.00 | 顶级推理强,促销价(至 2026-11-21 可用) |
| gpt-5.6-terra | 2.00 | 0.20 | 12.00 | 平衡性最佳,高频任务首选 |
| gpt-5.6-luna | 0.20 | 0.02 | 1.20 | 速度快、性价比最高,日常编码/聊天推荐 |
其他主流模型
| 模型 | 输入($/1M) | 缓存输入($/1M) | 输出($/1M) | 备注 |
|---|---|---|---|---|
| gpt-5.3-codex | 1.75 | 0.175 | 14.00 | 代码生成专用 |
| chat-latest | 5.00 | 0.50 | 30.00 | 对应 ChatGPT 订阅功能 |
| gpt-4.1 | 1.00 | - | 4.00 | 上一代旗舰 |
Prompt 缓存价格说明:开启后,同一上下文(prompt)后续调用可享受显著折扣。Cache write(第一次写入)通常额外收取 1-2 倍成本。适用于长上下文聊天、代码补全、RAG 场景。
---
如何决策?实用建议
- 预算有限:选 gpt-5.6-luna + Prompt 缓存,1M Token 总成本通常低于 $1.5。
- 复杂推理:选 gpt-5.6-sol,缓存效果最佳。
- 批量任务:开启 Batch API 再减 50%。
- ChatGPT Plus vs API:纯 API 更灵活,批量场景成本可比 Plus 低 30-50%。
---
延伸阅读
---
English summary
This guide explains OpenAI API pricing in detail: input, output, and prompt caching rates per million tokens as of September 2026. Whether you are reconciling your own API bill, optimizing costs for ChatGPT Plus versus direct API usage, or building agents with GPT-5.6 series models, the full comparison table below helps you make the right model choice.
Key models like gpt-5.6-luna ($0.20 input, $0.02 cached) and gpt-5.6-sol ($4.00 input, $0.40 cached) offer dramatically better price/performance than previous generations. Prompt caching can cut input costs by up to 90% for repeated contexts. Batch processing adds another 50% discount.
核对清单 and 站内路径 link to official dashboard, token counting tools, and usage guides for accurate reconciliation. Prices are subject to change—always verify against the latest official page.
Ideal for developers running inference, code completion, or RAG applications who need to stay within budget while maximizing performance. Use the table above to compare options and avoid unexpected bills.