跳到主内容
选型对比12 分钟阅读发布于:2026-08-10更新于:2026-09-03

Claude 模型与 API 价格:Fable 5.1、Opus、Sonnet 和 Haiku

对比当前 Claude 模型价格、Fable 5.1 缓存费率、100 万上下文、Batch、Fast mode、工具费用和数据驻留。

作者 Heizi· 创始人 & 编辑· 发布于: 2026-08-10· 更新于: 2026-09-03

当前 Claude 模型家族

四种声部,覆盖不同能力层级

最高能力选择 Fable,复杂智能体工作选择 Opus,平衡场景选择 Sonnet,速度和成本优先选择 Haiku。

美元 / 百万 tokens · Claude API

Claude Fable 5

Anthropic 广泛发布模型中能力最强,面向长时间运行的智能体。

模型 ID
claude-fable-5
基础输入
$10
5 分钟缓存写入
$12.50
1 小时缓存写入
$20
缓存命中
$1
输出
$50
上下文
1M
最大输出
128K
可靠知识截止
Jan 2026
思考模式
自适应,始终开启
相对延迟
较慢

Claude Opus 5

适合复杂智能体编程和企业工作,支持自适应思考。

模型 ID
claude-opus-5
基础输入
$5
5 分钟缓存写入
$6.25
1 小时缓存写入
$10
缓存命中
$0.50
输出
$25
上下文
1M
最大输出
128K
可靠知识截止
May 2026
思考模式
自适应
相对延迟
中等

Claude Sonnet 5

速度与智能的最佳组合,目前采用推广价格。

模型 ID
claude-sonnet-5
基础输入
$2
5 分钟缓存写入
$2.50
1 小时缓存写入
$4
缓存命中
$0.20
输出
$10
上下文
1M
最大输出
128K
可靠知识截止
Jan 2026
思考模式
自适应
相对延迟
快

Claude Haiku 4.5

Anthropic 速度最快、智能接近前沿水平的模型。

模型 ID
claude-haiku-4-5-20251001
基础输入
$1
5 分钟缓存写入
$1.25
1 小时缓存写入
$2
缓存命中
$0.10
输出
$5
上下文
200K
最大输出
64K
可靠知识截止
Feb 2025
思考模式
扩展思考
相对延迟
最快
Sonnet 5 输入/输出推广价 $2/$10 有效至 2026 年 8 月 31 日;2026 年 9 月 1 日起执行标准价 $3/$15。
Anthropic 官方价格快照核验于 2026 年 8 月 10 日。

当前 Claude 模型家族

Anthropic 当前核心产品线覆盖四个工作负载档位:Claude Fable 5.1 面向高难度长任务 Agent,Opus 5 面向复杂生产编程和推理,Sonnet 5 平衡速度与智能,Haiku 4.5 则优先考虑延迟与成本。

本页使用 2026 年 9 月 3 日核验的 Anthropic 官方模型概览和价格页。Anthropic 建议大多数任务先使用 Opus 5;只有当 Opus high effort 仍无法胜任时,再切换到 Fable 5.1。

标准 Token 价格

Claude API 以美元/百万 tokens(MTok)报价,输入和输出分别计费,四个模型的输出 token 都明显贵于输入。

模型选择不应只看价格:最高广泛可用能力选择 Fable,复杂生产智能体选择 Opus,通用平衡选择 Sonnet,高调用量执行选择 Haiku。

  • Fable 5.1:输入 $10 · 输出 $50
  • Opus 5:输入 $5 · 输出 $25
  • Sonnet 5:输入 $3 · 输出 $15
  • Haiku 4.5:输入 $1 · 输出 $5

Sonnet 5 已执行标准价格

Sonnet 5 已于 2026 年 9 月 1 日开始执行输入 $3/MTok、输出 $15/MTok 的标准价格,之前的 $2/$10 推广价于 8 月 31 日结束。

Sonnet 5 当前每百万 tokens 的缓存价格为:5 分钟写入 $3.75,1 小时写入 $6,缓存读取 $0.30。新预算应使用这些标准费率。

提示缓存价格

Anthropic 将缓存创建与缓存读取分开计费。Fable 5.1 的 5 分钟写入为 $12.50/MTok,1 小时写入为 $20,缓存读取为 $0.25;其他 Claude 模型采用各自公布的缓存费率。

当长系统指令、文档或示例在多个请求中重复时,缓存很有价值。应计算复用频率是否足以覆盖首次写入的溢价。

上下文窗口、Batch 与 Fast Mode

Fable 5.1、Opus 5 和 Sonnet 5 以标准 token 单价包含完整 100 万上下文窗口,同步输出上限为 12.8 万;Haiku 4.5 支持 20 万输入和 6.4 万输出。

Batch API 的输入和输出价格均享受 50% 折扣。Fast mode 是 Opus 5 和 Opus 4.8 在第一方 Claude API 上的研究预览;Opus 5 Fast mode 输入 $10、输出 $50/MTok,且不能与 Batch 组合使用。

数据驻留与工具费用

Claude 4.6 及更高版本通过 inference_geo 选择仅限美国推理时,输入、输出、缓存写入和缓存读取统一应用 1.1 倍乘数;默认全球路由使用标准价格。

网络搜索每 1,000 次 $10,另计正常 token;Web fetch 没有单独工具费,但抓取内容会成为计费输入。代码执行每个组织每月包含 1,550 免费小时,在未通过符合条件的网络搜索或抓取免费使用时,超出部分按每容器小时 $0.05 收费。

Claude Managed Agents 与成本控制

Claude Managed Agents 按标准模型 token 价格计费,并额外按每个运行中的会话小时 $0.08 收取运行时间费用;idle、rescheduling 和 terminated 状态不计运行时费用。Batch、Fast mode、数据驻留和合作云平台价格修饰符不适用于 Managed Agents 会话。

控制成本时,可将简单任务路由给 Haiku,通用生产任务给 Sonnet,复杂智能体给 Opus,最高能力需求给 Fable;重复上下文使用提示缓存,非交互任务使用 Batch。

常见问题

哪个 Claude 模型最便宜?

Claude Haiku 4.5 是当前核心模型中价格最低的版本,输入 $1、输出 $5/MTok。

Sonnet 5 当前价格是多少?

Sonnet 5 当前输入为 $3/MTok,输出为 $15/MTok;推广价已于 2026 年 8 月 31 日结束。

当前 Claude 模型都支持 1M 上下文吗?

Fable 5.1、Opus 5 和 Sonnet 5 支持 100 万;Haiku 4.5 的上下文窗口为 20 万。

提示缓存和 Batch 可以组合吗?

可以,Batch 和提示缓存折扣能够组合;Fast mode 不能与 Batch 组合。

相关供应商

参考来源