跳到主内容
选型对比7 分钟阅读发布于:2026-07-29更新于:2026-07-29

OpenAI API 定价详解(2026 指南)

全面理解 OpenAI API 定价:GPT-4o 和 o 系列模型价格、token 计费方式、输入/输出价格差异、缓存折扣、Batch API 节省,以及如何估算成本。

OpenAI API 定价机制

OpenAI 按 token 计费,不是按请求次数。一个 token 大约相当于 4 个英文字符,或 3/4 个单词。一篇 1,000 词的英文文章大约是 1,300 个 token。

每次 API 调用有两个 token 计数:输入 token(你发送的提示词)和输出 token(模型的回复)。它们按不同价格计费——输出 token 通常比输入 token 贵 3-4 倍。

中文每个字符消耗的 token 比英文多,因为分词器是为拉丁语系优化的。一个中文字符通常消耗 1-2 个 token,在估算中文应用成本时需要考虑这一点。

GPT-4o 和 GPT-4o-mini 定价

GPT-4o 是 OpenAI 的旗舰多模态模型,支持文本、图像和音频输入。GPT-4o-mini 是成本优化版本,推荐用于大多数通用任务。

  • GPT-4o:$2.50 / 百万输入 token,$10.00 / 百万输出 token
  • GPT-4o:$1.25 / 百万缓存输入 token(50% 折扣)
  • GPT-4o-mini:$0.15 / 百万输入 token,$0.60 / 百万输出 token
  • GPT-4o-mini:$0.075 / 百万缓存输入 token(50% 折扣)

o 系列推理模型定价

o 系列模型(o1、o3、o4-mini)专为数学、编程和科学分析等复杂推理任务设计。它们使用内部「思考」token,按输出 token 价格计费,因此每次调用的成本明显高于 GPT-4o 系列模型。

由于推理模型在生成最终答案之前会产生大量内部思维链,实际输出 token 数量可能远超可见回复的长度。务必用真实工作负载测试以了解实际成本。

  • o3:$10.00 / 百万输入 token,$40.00 / 百万输出 token
  • o3-mini:$1.10 / 百万输入 token,$4.40 / 百万输出 token
  • o4-mini:$1.10 / 百万输入 token,$4.40 / 百万输出 token
  • o 系列缓存输入:75% 折扣(如 o3-mini 为 $0.275 / 百万)

缓存输入 token 折扣

OpenAI 为重复前缀提供提示缓存。如果你的 API 请求共享相同的前缀提示(如系统指令、few-shot 示例),缓存部分按 GPT-4o 模型 50% 折扣、o 系列模型 75% 折扣计费。

缓存是自动的——无需任何配置。缓存在 5-10 分钟不活动后通常失效,最小可缓存前缀为 1,024 token。对于有长系统提示的应用,缓存可以显著降低成本。

Batch API(50% 折扣)

如果你的场景不需要实时响应,Batch API 在所有模型上提供 50% 折扣。你提交一批请求(每个文件最多 50,000 条),OpenAI 在 24 小时内处理完成(通常更快)。

Batch API 非常适合批量处理任务,如内容分类、文档摘要、数据富化和评估运行。请求格式与标准 API 完全相同——只需将请求包装在 JSONL 文件中,通过 batch 端点提交即可。

如何估算成本

要估算月度 API 成本,将每次请求的预期输入 token 数乘以输入价格,加上预期输出 token 数乘以输出价格,再乘以每月请求次数。

例如,使用 GPT-4o-mini,平均每次调用 500 输入 token 和 200 输出 token,每月 10,000 次调用:(500 × $0.15 + 200 × $0.60) / 1,000,000 × 10,000 = $1.95/月。这使得 GPT-4o-mini 对大多数应用来说非常实惠。

对于推理模型,估算时要格外小心。o3 上一个复杂的编程问题可能生成 5,000+ 隐藏推理 token,使单次调用成本达到 $0.20+,而不是你仅从可见输出预期的 $0.01。

python
# Cost estimation example for GPT-4o-mini
input_tokens_per_call = 500
output_tokens_per_call = 200
calls_per_month = 10_000

input_price = 0.15  # per 1M tokens
output_price = 0.60  # per 1M tokens

monthly_cost = (
    input_tokens_per_call * input_price
    + output_tokens_per_call * output_price
) / 1_000_000 * calls_per_month

print(f"Estimated monthly cost: ${monthly_cost:.2f}")
# Output: Estimated monthly cost: $1.95

估算 OpenAI API 月度成本的 Python 脚本

免费额度和试用

新注册的 OpenAI 账号可能会获得约 $5 的试用额度。这些额度在创建账号后几个月内过期,用于在正式付费前测试 API。

OpenAI API 没有永久免费层。试用额度用完或过期后,必须充值才能继续使用 API。建议设置计费提醒以避免意外支出。

常见问题

哪个 OpenAI 模型最便宜?

GPT-4o-mini 是 OpenAI 产品线中最实惠的模型,输入 $0.15/百万、输出 $0.60/百万 token。要进一步降低成本,可以使用 Batch API 获得额外 50% 折扣,降至输入 $0.075/百万、输出 $0.30/百万。

推理模型(o 系列)为什么这么贵?

推理模型在生成可见答案之前会产生内部思维链 token。这些隐藏 token 按输出 token 价格计费,长度可能是最终回复的 5-20 倍。这是更深推理的代价——o 系列模型专为准确度比成本更重要的任务设计。

如何降低 OpenAI API 成本?

可以使用以下策略:(1) 不需要 GPT-4o 级别智能的任务切换到 GPT-4o-mini。(2) 保持系统提示一致以启用提示缓存。(3) 非实时任务使用 Batch API 获得 50% 折扣。(4) 设置 max_tokens 限制防止回复失控。(5) 对相同查询在应用侧缓存 API 响应。

OpenAI API 全球定价一样吗?

是的,OpenAI API 全球定价一致,以美元计费。但根据你的银行卡和所在国家,银行可能会收取跨境交易费或货币转换费。

OpenAI 会为失败的 API 请求收费吗?

服务器错误(5xx)导致的失败请求不收费。但客户端错误(4xx,如参数无效)导致的失败,如果模型已处理了输入 token,则会收费。限流请求(429)不收费。

相关供应商

参考来源