Responses API 的 usage 怎么对上输入 / 输出列
官方 JS SDK 的 responses.create:input_tokens / output_tokens 对上输入、输出列;cached_tokens 仍进缓存列,缺字段就记 0。
本页不发起请求;不收 Key;中转 curl 不在本站。
← 计费示例 · Token 主表 · 官方 usage 文档
输入usage.input_tokens
输出usage.output_tokens
缓存usage.input_tokens_details.cached_tokens
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.OPENAI_API_KEY,
});
const response = await client.responses.create({
model: "gpt-4o-mini",
input: "Reply with one word: ok",
});
const usage = response.usage ?? {};
const input = usage.input_tokens ?? 0; // 输入
const output = usage.output_tokens ?? 0; // 输出
const cached = usage.input_tokens_details?.cached_tokens ?? 0; // 缓存
console.log("输入", input);
console.log("输出", output);
console.log("缓存", cached);
| 字段 | 对上列 | 说明 |
|---|---|---|
usage.input_tokens | 输入 | Responses 的输入列。不要和 Chat Completions 的 prompt_tokens 混名。 |
usage.output_tokens | 输出 | Responses 的输出列。对账乘本站「输出」$/M。 |
usage.input_tokens_details.cached_tokens | 缓存 | 有命中才非 0。短 prompt 或首次请求通常是 0。 |