Claude 模型与 API 价格:Fable、Opus、Sonnet 和 Haiku
对比当前 Claude 模型价格、提示缓存、1M 上下文、Batch、Fast mode、工具费用、数据驻留及 Sonnet 5 推广价格。
当前 Claude 模型家族
四种声部,覆盖不同能力层级
最高能力选择 Fable,复杂智能体工作选择 Opus,平衡场景选择 Sonnet,速度和成本优先选择 Haiku。
美元 / 百万 tokens · Claude API
Claude Fable 5
Anthropic 广泛发布模型中能力最强,面向长时间运行的智能体。
- 模型 ID
claude-fable-5
- 基础输入
- $10
- 5 分钟缓存写入
- $12.50
- 1 小时缓存写入
- $20
- 缓存命中
- $1
- 输出
- $50
- 上下文
- 1M
- 最大输出
- 128K
- 可靠知识截止
- Jan 2026
- 思考模式
- 自适应,始终开启
- 相对延迟
- 较慢
Claude Opus 5
适合复杂智能体编程和企业工作,支持自适应思考。
- 模型 ID
claude-opus-5
- 基础输入
- $5
- 5 分钟缓存写入
- $6.25
- 1 小时缓存写入
- $10
- 缓存命中
- $0.50
- 输出
- $25
- 上下文
- 1M
- 最大输出
- 128K
- 可靠知识截止
- May 2026
- 思考模式
- 自适应
- 相对延迟
- 中等
Claude Sonnet 5
速度与智能的最佳组合,目前采用推广价格。
- 模型 ID
claude-sonnet-5
- 基础输入
- $2
- 5 分钟缓存写入
- $2.50
- 1 小时缓存写入
- $4
- 缓存命中
- $0.20
- 输出
- $10
- 上下文
- 1M
- 最大输出
- 128K
- 可靠知识截止
- Jan 2026
- 思考模式
- 自适应
- 相对延迟
- 快
Claude Haiku 4.5
Anthropic 速度最快、智能接近前沿水平的模型。
- 模型 ID
claude-haiku-4-5-20251001
- 基础输入
- $1
- 5 分钟缓存写入
- $1.25
- 1 小时缓存写入
- $2
- 缓存命中
- $0.10
- 输出
- $5
- 上下文
- 200K
- 最大输出
- 64K
- 可靠知识截止
- Feb 2025
- 思考模式
- 扩展思考
- 相对延迟
- 最快
当前 Claude 模型家族
Anthropic 当前核心产品线覆盖四个工作负载档位:Claude Fable 5 是广泛发布模型中能力最强的版本,Opus 5 面向复杂智能体编程和企业工作,Sonnet 5 平衡速度与智能,Haiku 4.5 则优先考虑延迟与成本。
上方对比使用 2026 年 8 月 10 日核验的 Anthropic 官方模型概览和价格页。Claude Mythos 5 与 Fable 5 规格和价格相同,但仅通过 Project Glasswing 有限提供,因此没有作为自助使用的默认模型展示。
标准 Token 价格
Claude API 以美元/百万 tokens(MTok)报价,输入和输出分别计费,四个模型的输出 token 都明显贵于输入。
模型选择不应只看价格:最高广泛可用能力选择 Fable,复杂生产智能体选择 Opus,通用平衡选择 Sonnet,高调用量执行选择 Haiku。
- Fable 5:输入 $10 · 输出 $50
- Opus 5:输入 $5 · 输出 $25
- Sonnet 5:截至 2026 年 8 月 31 日推广价输入 $2 · 输出 $10
- Haiku 4.5:输入 $1 · 输出 $5
Sonnet 5 推广价将在 8 月 31 日结束
Sonnet 5 在 2026 年 8 月 31 日之前执行输入 $2/MTok、输出 $10/MTok 的限时推广价;从 2026 年 9 月 1 日起,标准价格变为输入 $3、输出 $15。
缓存价格也会同时变化:5 分钟写入从 $2.50 调整为 $3.75,1 小时写入从 $4 调整为 $6,缓存命中从 $0.20 调整为 $0.30。9 月及之后的预算现在就应使用标准价格。
提示缓存价格
Anthropic 将缓存创建与缓存读取分开计费。5 分钟缓存写入为基础输入价格的 1.25 倍,1 小时写入为 2 倍,缓存命中或刷新为基础输入价格的 0.1 倍。
当长系统指令、文档或示例在多个请求中重复时,缓存很有价值。应计算复用频率是否足以覆盖首次写入的溢价。
上下文窗口、Batch 与 Fast Mode
Fable 5、Opus 5 和 Sonnet 5 以标准 token 单价包含完整 1M 上下文窗口,同步输出上限为 128K;Haiku 4.5 支持 200K 输入和 64K 输出。
Batch API 的输入和输出价格均享受 50% 折扣。Fast mode 是 Opus 5 和 Opus 4.8 在第一方 Claude API 上的研究预览;Opus 5 Fast mode 输入 $10、输出 $50/MTok,且不能与 Batch 组合使用。
数据驻留与工具费用
Claude 4.6 及更高版本通过 inference_geo 选择仅限美国推理时,输入、输出、缓存写入和缓存读取统一应用 1.1 倍乘数;默认全球路由使用标准价格。
网络搜索每 1,000 次 $10,另计正常 token;Web fetch 没有单独工具费,但抓取内容会成为计费输入。代码执行每个组织每月包含 1,550 免费小时,在未通过符合条件的网络搜索或抓取免费使用时,超出部分按每容器小时 $0.05 收费。
Claude Managed Agents 与成本控制
Claude Managed Agents 按标准模型 token 价格计费,并额外按每个运行中的会话小时 $0.08 收取运行时间费用;idle、rescheduling 和 terminated 状态不计运行时费用。Batch、Fast mode、数据驻留和合作云平台价格修饰符不适用于 Managed Agents 会话。
控制成本时,可将简单任务路由给 Haiku,通用生产任务给 Sonnet,复杂智能体给 Opus,最高能力需求给 Fable;重复上下文使用提示缓存,非交互任务使用 Batch。
常见问题
哪个 Claude 模型最便宜?
Claude Haiku 4.5 是当前核心模型中价格最低的版本,输入 $1、输出 $5/MTok。
Sonnet 5 什么时候涨到标准价?
输入/输出 $2/$10 的推广价有效至 2026 年 8 月 31 日;2026 年 9 月 1 日起执行 $3/$15 标准价。
当前 Claude 模型都支持 1M 上下文吗?
Fable 5、Opus 5 和 Sonnet 5 支持 1M;Haiku 4.5 的上下文窗口为 200K。
提示缓存和 Batch 可以组合吗?
可以,Batch 和提示缓存折扣能够组合;Fast mode 不能与 Batch 组合。
本系列相关
相关供应商
参考来源
- Anthropic Models & PricingAnthropic · 核验日期 2026-08-10
- Claude Models OverviewAnthropic · 核验日期 2026-08-10
- Anthropic 中文定价Anthropic · 核验日期 2026-08-10