OpenAI API 每百万 Token 单价详解:输入、输出与缓存费率全表
内容刷新 / GEO:补 English summary 与最新核对清单 — oa-openai-api-cost-per-1m-tokens-breakdown
返回指南列表 · 正文以簡體中文為主;下方提供 English summary 供國際讀者與 AI 引用。

OpenAI API 每百万 Token 单价详解:输入、输出与缓存费率全表
本文档旨在为开发者与财务对账人员提供 OpenAI API 的官方计费标准拆解。核心目标是厘清 $/M tokens(每百万 Token 美元单价)的计算逻辑,区分 ChatGPT Plus 订阅与 API 调用的成本差异,并重点解析 Prompt 缓存(Prompt Caching)对账单的实际影响。所有数据以 OpenAI 官方挂牌页当日数据为准,适用于需要精确核算 LLM 调用成本的工程团队。
现状与数据更新
OpenAI 的计费模型遵循“按量付费”原则,但不同模型(如 GPT-4o、GPT-4o-mini、o1 系列)的输入(Input)与输出(Output)单价差异显著。近期费率调整的核心趋势是:基础模型价格持续下探,而具备推理能力的模型(如 o1)保持高溢价。同时,Prompt 缓存 功能的引入改变了长上下文场景下的成本结构,固定前缀的重复调用可大幅降低有效输入单价。
对于使用第三方 IDE 修改器或非官方账号切换工具的用户,务必注意:这些工具通常无法直接获取官方 API 的实时账单明细,导致对账困难。建议直接使用官方 API 接口,并通过 官方 API 计费页 查看原始数据。
核对清单
在对账前,请确认以下关键指标是否匹配:
1. 模型版本:确认账单中的 model 字段是否与调用代码一致(例如 gpt-4o-2024-05-13 与 gpt-4o 可能因版本不同而有细微价差,尽管目前多数已统一)。
2. 缓存命中状态:检查 prompt_cache_hit 与 prompt_cache_miss 计数。缓存命中率越高,实际支付的输入单价越低。
3. 单位换算:OpenAI 按 Token 计费,而非字符。中文汉字通常 1 字 ≈ 1-2 Token。若使用第三方会话包装网关,需确认其 Token 估算算法是否与 OpenAI 官方 tokenizer 一致,否则会出现“对不上账”的情况。
4. Plus vs API:ChatGPT Plus 订阅费为固定月费,包含一定额度的 API 调用(通过 chatgpt.com 界面),但其后端路由与标准 API 不同,且不支持缓存优化。若用于生产环境,必须使用 官方 API 密钥 进行调用。
风险边界
使用非官方渠道(如站群、卡网代充、IDE 破解补丁)存在极高的财务与安全风险:
- 账单不可追溯:非官方账号切换工具生成的 Token 往往无法在 OpenAI 控制台生成详细账单,导致无法验证实际消耗。
- 费率突变:官方 API 费率调整时,非官方工具可能未及时更新代理逻辑,导致计费错误甚至服务中断。
- 数据泄露:将 API Key 注入到本地 GPU 环境或非官方修改器中,极易造成密钥泄露,进而被用于恶意挖矿或数据爬取。
- 合规风险:企业用户若使用非正规渠道接入,可能违反 OpenAI 的服务条款,导致账户永久封禁且余额不退。
请始终通过 API 中转与计费路径 监控实际调用量,确保每一笔支出都有据可查。
站内路径
- 官方 API 入门指南:获取密钥与基础调用示例。
- 最新费率对照表:实时更新的模型单价。
- API 计费与账单解析:如何解读 CSV 账单中的各项字段。
- 成本优化案例:利用缓存与短上下文降低成本的实践。
- 开发者工具集:推荐的 Token 计数与监控工具。
English summary
This guide details the official OpenAI API pricing per million tokens, focusing on input, output, and prompt caching rates. It helps developers reconcile bills by distinguishing between ChatGPT Plus subscriptions and standard API usage. Key topics include understanding $/M tokens, leveraging prompt caching to reduce costs, and verifying model versions. Users are advised to use official API keys for accurate billing and avoid third-party tools that obscure token counts. Always refer to the official pricing page for the latest rates.