跳到主内容
选型对比12 分钟阅读发布于:2026-08-10更新于:2026-08-10

Claude 模型与 API 价格:Fable、Opus、Sonnet 和 Haiku

对比当前 Claude 模型价格、提示缓存、1M 上下文、Batch、Fast mode、工具费用、数据驻留及 Sonnet 5 推广价格。

作者 Heizi· 创始人 & 编辑· 发布于: 2026-08-10实测验证

当前 Claude 模型家族

四种声部,覆盖不同能力层级

最高能力选择 Fable,复杂智能体工作选择 Opus,平衡场景选择 Sonnet,速度和成本优先选择 Haiku。

美元 / 百万 tokens · Claude API

Claude Fable 5

Anthropic 广泛发布模型中能力最强,面向长时间运行的智能体。

模型 ID
claude-fable-5
基础输入
$10
5 分钟缓存写入
$12.50
1 小时缓存写入
$20
缓存命中
$1
输出
$50
上下文
1M
最大输出
128K
可靠知识截止
Jan 2026
思考模式
自适应,始终开启
相对延迟
较慢

Claude Opus 5

适合复杂智能体编程和企业工作,支持自适应思考。

模型 ID
claude-opus-5
基础输入
$5
5 分钟缓存写入
$6.25
1 小时缓存写入
$10
缓存命中
$0.50
输出
$25
上下文
1M
最大输出
128K
可靠知识截止
May 2026
思考模式
自适应
相对延迟
中等

Claude Sonnet 5

速度与智能的最佳组合,目前采用推广价格。

模型 ID
claude-sonnet-5
基础输入
$2
5 分钟缓存写入
$2.50
1 小时缓存写入
$4
缓存命中
$0.20
输出
$10
上下文
1M
最大输出
128K
可靠知识截止
Jan 2026
思考模式
自适应
相对延迟

Claude Haiku 4.5

Anthropic 速度最快、智能接近前沿水平的模型。

模型 ID
claude-haiku-4-5-20251001
基础输入
$1
5 分钟缓存写入
$1.25
1 小时缓存写入
$2
缓存命中
$0.10
输出
$5
上下文
200K
最大输出
64K
可靠知识截止
Feb 2025
思考模式
扩展思考
相对延迟
最快
Sonnet 5 输入/输出推广价 $2/$10 有效至 2026 年 8 月 31 日;2026 年 9 月 1 日起执行标准价 $3/$15。
Anthropic 官方价格快照核验于 2026 年 8 月 10 日。

当前 Claude 模型家族

Anthropic 当前核心产品线覆盖四个工作负载档位:Claude Fable 5 是广泛发布模型中能力最强的版本,Opus 5 面向复杂智能体编程和企业工作,Sonnet 5 平衡速度与智能,Haiku 4.5 则优先考虑延迟与成本。

上方对比使用 2026 年 8 月 10 日核验的 Anthropic 官方模型概览和价格页。Claude Mythos 5 与 Fable 5 规格和价格相同,但仅通过 Project Glasswing 有限提供,因此没有作为自助使用的默认模型展示。

标准 Token 价格

Claude API 以美元/百万 tokens(MTok)报价,输入和输出分别计费,四个模型的输出 token 都明显贵于输入。

模型选择不应只看价格:最高广泛可用能力选择 Fable,复杂生产智能体选择 Opus,通用平衡选择 Sonnet,高调用量执行选择 Haiku。

  • Fable 5:输入 $10 · 输出 $50
  • Opus 5:输入 $5 · 输出 $25
  • Sonnet 5:截至 2026 年 8 月 31 日推广价输入 $2 · 输出 $10
  • Haiku 4.5:输入 $1 · 输出 $5

Sonnet 5 推广价将在 8 月 31 日结束

Sonnet 5 在 2026 年 8 月 31 日之前执行输入 $2/MTok、输出 $10/MTok 的限时推广价;从 2026 年 9 月 1 日起,标准价格变为输入 $3、输出 $15。

缓存价格也会同时变化:5 分钟写入从 $2.50 调整为 $3.75,1 小时写入从 $4 调整为 $6,缓存命中从 $0.20 调整为 $0.30。9 月及之后的预算现在就应使用标准价格。

提示缓存价格

Anthropic 将缓存创建与缓存读取分开计费。5 分钟缓存写入为基础输入价格的 1.25 倍,1 小时写入为 2 倍,缓存命中或刷新为基础输入价格的 0.1 倍。

当长系统指令、文档或示例在多个请求中重复时,缓存很有价值。应计算复用频率是否足以覆盖首次写入的溢价。

上下文窗口、Batch 与 Fast Mode

Fable 5、Opus 5 和 Sonnet 5 以标准 token 单价包含完整 1M 上下文窗口,同步输出上限为 128K;Haiku 4.5 支持 200K 输入和 64K 输出。

Batch API 的输入和输出价格均享受 50% 折扣。Fast mode 是 Opus 5 和 Opus 4.8 在第一方 Claude API 上的研究预览;Opus 5 Fast mode 输入 $10、输出 $50/MTok,且不能与 Batch 组合使用。

数据驻留与工具费用

Claude 4.6 及更高版本通过 inference_geo 选择仅限美国推理时,输入、输出、缓存写入和缓存读取统一应用 1.1 倍乘数;默认全球路由使用标准价格。

网络搜索每 1,000 次 $10,另计正常 token;Web fetch 没有单独工具费,但抓取内容会成为计费输入。代码执行每个组织每月包含 1,550 免费小时,在未通过符合条件的网络搜索或抓取免费使用时,超出部分按每容器小时 $0.05 收费。

Claude Managed Agents 与成本控制

Claude Managed Agents 按标准模型 token 价格计费,并额外按每个运行中的会话小时 $0.08 收取运行时间费用;idle、rescheduling 和 terminated 状态不计运行时费用。Batch、Fast mode、数据驻留和合作云平台价格修饰符不适用于 Managed Agents 会话。

控制成本时,可将简单任务路由给 Haiku,通用生产任务给 Sonnet,复杂智能体给 Opus,最高能力需求给 Fable;重复上下文使用提示缓存,非交互任务使用 Batch。

常见问题

哪个 Claude 模型最便宜?

Claude Haiku 4.5 是当前核心模型中价格最低的版本,输入 $1、输出 $5/MTok。

Sonnet 5 什么时候涨到标准价?

输入/输出 $2/$10 的推广价有效至 2026 年 8 月 31 日;2026 年 9 月 1 日起执行 $3/$15 标准价。

当前 Claude 模型都支持 1M 上下文吗?

Fable 5、Opus 5 和 Sonnet 5 支持 1M;Haiku 4.5 的上下文窗口为 200K。

提示缓存和 Batch 可以组合吗?

可以,Batch 和提示缓存折扣能够组合;Fast mode 不能与 Batch 组合。

相关供应商

参考来源