Claude API 的价格对比,核心不是「套餐多少钱」,而是「四个模型按什么单价扣费、缓存和 Batch 能省多少、直连和云平台哪个划算」。当前主线是 Fable 5($10/$50)、Opus 5($5/$25)、Sonnet 5(intro $2/$10)、Haiku 4.5($1/$5),旗舰输入价比入门贵 10 倍;Prompt 缓存命中读取只要输入价的 0.1x,Batch API 再打约 5 折。 下面把四款模型、缓存 Batch 和直连/第三方平台的账一次算清,价格为 2026-08-13 数据,实时单价以 Claude API 定价页 为准。
Claude API 怎么计费:按 token 扣费,和订阅是两套体系
Claude API 是 Anthropic Console 上的按量计费服务,没有包月套餐,输入和输出 token 分开计价,四个模型各有一档单价,另有缓存、Batch、Web Search 等附加计费项(来源)。 它和 Claude 的 Pro / Max 网页订阅是两套体系:订阅里的 Claude Code 走订阅额度池,自建后端和生产 Agent 必须在 Console 单独申请 API key、按 token 扣费。API key 申请入口在 console.anthropic.com,同一套模型还能通过 Amazon Bedrock、Vertex AI 和 Microsoft Foundry 调用。
| 计费项 | 规则 | 说明 |
|---|---|---|
| 推理 token 价 | 按模型分档 | 输入/输出分开计价 |
| Prompt 缓存 | 写入 1.25x 输入价 · 读取 0.1x 输入价 | 5 分钟窗口,另有 Extended 模式 |
| Batch API | 输入/输出约 50% 折扣 | 异步任务 24 小时内完成 |
| US-only inference | 输入/输出 1.1x | 数据留在美国境内 |
| Priority Tier | 按官方 Priority 倍率 | 更高吞吐 |
| Bedrock / Vertex | 区域端点可能 +10% | 第三方云调用 |
四款模型价格对比:从 $1 到 $10,价差 10 倍
Claude API 现在主线四款模型,从低到高是 Haiku 4.5($1/$5)、Sonnet 5(intro $2/$10)、Opus 5($5/$25)、Fable 5($10/$50),旗舰输入价是入门价的 10 倍。 四款都支持 Prompt 缓存,三款旗舰为 1M 上下文(Haiku 为 200K),选型取决于任务复杂度和预算(来源)。全量价格对比如下,单位是每百万 tokens:
| 模型 | model id | 输入 | 输出 | 缓存写入 | 缓存命中 | 上下文 | 最大输出 |
|---|---|---|---|---|---|---|---|
| Claude Haiku 4.5 | claude-haiku-4-5 | $1 | $5 | $1.25 | $0.10 | 200K | 64K |
| Claude Sonnet 5(intro) | claude-sonnet-5 | $2 | $10 | $2.50 | $0.20 | 1M | 128K |
| Claude Sonnet 5(标准) | claude-sonnet-5 | $3 | $15 | — | — | 1M | 128K |
| Claude Opus 5 | claude-opus-5 | $5 | $25 | $6.25 | $0.50 | 1M | 128K |
| Claude Fable 5 | claude-fable-5 | $10 | $50 | $12.50 | $1 | 1M | 128K |
Claude Haiku 4.5:$1/$5,高速低成本
Haiku 4.5 是四款里最便宜的:输入 $1/M、输出 $5/M,200K 上下文、64K 最大输出,延迟最低。 定位是快速问答、分类路由、格式整理、子 Agent 和高并发轻量请求的前置步骤,支持 Extended thinking(不支持 Adaptive thinking)。缓存写入 $1.25/M、命中读取 $0.10/M,Batch API 还能进一步减半,适合「Haiku 先跑一遍、复杂任务再升 Sonnet/Opus」的分层架构。
Claude Sonnet 5:intro $2/$10,8 月底前的高性能主力
Sonnet 5 到 2026-08-31 执行 introductory pricing:输入 $2/M、输出 $10/M,之后回到标准价 $3/$15。 1M 上下文、128K 输出,支持 adaptive thinking,官方定位高性能编码与 Agent,适合高频 API 调用、团队共享后端这些「要 1M 上下文但不必全程 Fable/Opus」的场景。intro 期间缓存写入 $2.50/M、命中读取 $0.20/M。
Claude Opus 5:$5/$25,企业级复杂工作
Opus 5 是 $5/M 输入、$25/M 输出,1M 上下文、128K 输出,官方定位 complex agentic coding and enterprise work。 适合复杂代码、企业流程和高自主性任务;当 Fable 5 成本过高但仍要旗舰能力时,Opus 5 是更低成本的选择。缓存写入 $6.25/M、命中读取 $0.50/M;Fast Mode 按标准价 2x 计费,速度约 2.5x。
Claude Fable 5:$10/$50,长程 Agent 旗舰
Fable 5 是当前 API 最高档:输入 $10/M、输出 $50/M,1M 上下文、128K 输出,Adaptive thinking always on。 官方定位是面向长程 Agent 的 next-generation intelligence,适合超长任务链路、复杂自主 Agent 和高价值知识工作。缓存写入 $12.50/M、命中读取 $1/M,成本敏感场景建议先用 Haiku/Sonnet 分层再决定是否上 Fable。
Prompt 缓存和 Batch API:两种最实际的省钱方式
Claude API 最值得用的省钱机制是 Prompt 缓存和 Batch API:缓存命中读取只要输入价的 0.1x(5 分钟窗口),Batch API 输入输出再打约 50% 折扣、24 小时内异步完成,两者叠加后重复上下文的成本能压到十分之一以下。 缓存适合系统提示词、工具定义这种每次都带的长上下文,Batch 适合不需要实时响应的离线任务(来源)。
- 重复上下文开 Prompt caching:固定 system prompt 加长文档,第一次按全价写入,5 分钟内命中读取按 0.1x 收费,Haiku 4.5 的命中读取低至 $0.10/M。
- 异步任务走 Batch API:输入输出约 50% 折扣、24 小时内异步完成,适合批量生成、离线打分这类可等待的任务。
- 数据驻留要求选 US-only inference:输入输出按 1.1x 计费,数据留在美国境内;Bedrock / Vertex 区域端点也可能有 10% 溢价。
- 吞吐不够上 Priority Tier:按官方 Priority 倍率计费换取更高吞吐,适合对并发和响应时间敏感的生产链路。
附加功能怎么收费:Web Search、Managed Agents、Code Execution
除了 token 价,Claude API 还有几项独立计费的附加功能:Web Search $10/千次搜索、Managed Agents $0.08/会话时、Code Execution $0.05/小时(每日 50 小时免费),Opus 5 Fast Mode 按标准价 2x。 用 Agent 工具链的时候,这些费用经常被忽略,建议在成本模型里单列(来源):
| 附加项 | 价格 | 说明 |
|---|---|---|
| Web Search | $10 / 千次搜索 | 按搜索次数计费 |
| Web Fetch | — | 抓取网页内容 |
| Managed Agents | $0.08 / 会话时 | 托管 Agent 运行时长 |
| Code Execution | $0.05 / 小时 | 每日 50 小时免费 |
| Opus 5 Fast Mode | 标准价 2x | 速度约 2.5x |
直连 Anthropic API vs Bedrock / Vertex:溢价和 10% 怎么算
同一套模型既可以从 Anthropic 第一方 API 直接调用,也可以走 Amazon Bedrock、Vertex AI、Microsoft Foundry,但第三方云的区域端点可能有 10% 溢价,直连没有这层加价。 直连的代价是自己在 Console 管 key、限速和账单;走 Bedrock / Vertex 的优势是复用你已有的云账号、IAM 权限和合规链路。两边 token 单价同源,选择本质上是「数据驻留 + 云生态 vs 少 10% 溢价 + 官方直连」的取舍(来源)。
和 OpenAI、DeepSeek 这些 API 比,Claude 贵不贵
Claude API 的定价处在一个微妙的位置:旗舰 Fable 5($10/$50)比 OpenAI API 的旗舰档贵,比 DeepSeek API 的旗舰贵一个数量级,性价比全靠缓存和 Batch 拉回来。 横向看主流 API 的每百万 tokens 单价(输入/输出),数据与本站 OpenRouter API 价格对比 文章同源:
| API | 入门档(输入/输出) | 旗舰档(输入/输出) |
|---|---|---|
| Claude API | Haiku 4.5 $1/$5 | Fable 5 $10/$50 |
| OpenAI API | Luna 约 $0.10/$0.60 | Sol 约 $5/$30 |
| Gemini API | Flash Lite 约 $0.30/$2.50 | 3.6 Flash 约 $1.5/$7.5 |
| DeepSeek API | Flash 约 $0.08/$0.18 | Pro 约 $0.435/$0.87 |
| Kimi API | K2.5 $0.57/$2.85 | K3 $3/$15 |
结论很清楚:Claude 的旗舰档质量全球第一梯队,价格也是第一梯队。 想要第一方 Claude 模型质量,就按模型分层 + 缓存 Batch 控成本;要多个模型一个 key 切换,看 OpenRouter API;价格敏感、中文任务为主,DeepSeek 和 Kimi API 的入门档便宜一个数量级。
怎么选模型和控制成本
Claude API 选型的核心是「按任务分层 + 用满缓存 Batch」:轻量调用走 Haiku、日常生产走 Sonnet、复杂工作走 Opus、长程 Agent 才上 Fable,同时把重复上下文缓存化、异步任务 Batch 化。 具体做法:
- 高频轻量请求用 Haiku 4.5:分类、路由、格式化、子 Agent 第一遍,$1/$5 起步,延迟最低。
- 日常生产 API 用 Sonnet 5:8 月底前锁 intro 价 $2/$10,之后回标准价 $3/$15,性价比窗口要抓住。
- 复杂编码和企业流程用 Opus 5:$5/$25,当 Fable 5 成本过高但仍要旗舰能力时的折中选择。
- 长程 Agent 和高价值知识工作用 Fable 5:$10/$50,1M 上下文 + Adaptive thinking,只在真需要时上。
- 固定长上下文开 Prompt caching:写入 1.25x、命中读取 0.1x,叠加 Batch API 后成本可再降一半。
- 异步批处理走 Batch API:输入输出约 5 折、24 小时内完成,别让实时请求背这部分成本。
注意事项
- Sonnet 5 的促销价有时限:$2/$10 到 2026-08-31 结束,之后回到 $3/$15,迁移排期要赶在促销期内。
- 旧版模型仍在定价表:Sonnet 4.6、Opus 4.7 等旧版可能仍出现,新集成优先 Fable 5 / Opus 5 / Sonnet 5 / Haiku 4.5。
- API 与订阅是两套计费:Pro / Max 订阅里的 Claude Code 走订阅额度,不消耗 API 余额;反过来说,API 用量也不会记入订阅额度。
- 附加费用容易漏算:Web Search $10/千次搜索、Managed Agents $0.08/会话时、Code Execution $0.05/小时(每日 50 小时免费)、Opus 5 Fast Mode 2x。
- 区域和云端点有溢价:US-only inference 按 1.1x,Bedrock / Vertex 区域端点可能 +10%,成本模型要按实际部署区域算。
- 价格实时变动:所有单价以 claude.com/pricing 官网实时价为准,本文数据截至 2026-08-13。