Claude API
Claude API Pricing:输入输出、Prompt Caching、Batch 与长上下文
从 Anthropic 官方定价与用量字段出发,统一核算 Claude 模型输入输出、缓存写入/读取、Message Batches 和长上下文修饰项。
核心主题:claude api pricing · 搜索意图:交易
Keyword evidence
Semrush US 关键词研究记录
文章主题词:claude api pricing。仅用于选词与意图;不把 US 指标写成中国需求,不推断趋势。 no_data 保持原样,不换算为 0;趋势未导出数值,因此不展示或推断趋势。
| 角色 | 查询词 | 数据库 / 日期 | Volume | KD | Intent | CPC |
|---|---|---|---|---|---|---|
| 选定记录 | claude api pricing | US · 2026-08-29 | 5,400 | 59 | 交易 | $11.62 |
| 相关记录 | anthropic api pricing | US · 2026-08-29 | 2,400 | 48 | 信息 | $8.37 |
先把 Claude 价格拆成可组合的桶
Claude API 的成本不只有输入和输出。工程账本还应记录普通输入、不同 TTL 的缓存创建、缓存读取、Message Batches 修饰、长上下文与可能的工具费用;每个桶绑定模型和费率生效日期。
统一公式可写为输入各桶 token×对应倍率或单价,再加输出与工具项。具体货币单价不写入业务代码,而从核验于 2026-08-29 的官方定价快照读取,避免模型更新后旧值继续结算。
证据边界:本节以 S1 支持“官方定价页列出模型输入输出、Prompt Caching、Message Batches、长上下文及工具费用规则。”。
Prompt Caching 要按写入、读取和 TTL 分账
截至 2026-08-29,Anthropic 官方定价说明 5 分钟缓存写入按基础输入价的 1.25 倍、1 小时写入按 2 倍、命中读取按 0.1 倍计费。对稳定前缀 B 和 N 次总调用,无缓存成本是 N×B×输入价;缓存成本是首次写入加后续读取。
Claude usage 将 input_tokens、cache_read_input_tokens 与 cache_creation_input_tokens 分开;混用 TTL 时还可看到 5 分钟和 1 小时写入的细分。真实缓存成本要逐桶乘价,不能用 total input 统一乘基础输入价。
证据边界:本节以 S2 支持“官方 token counting endpoint 接受与 Messages 相同的结构化输入并返回估计输入 token。”。
Message Batches 是独立处理层
Message Batches 将多条 Messages 请求装入一个异步作业,但每条请求独立处理。官方文档截至 2026-08-29 说明,单批最多受 100,000 条请求或 256 MB 两者中先达到的限制约束,并在完成或 24 小时到期后提供结果。
Anthropic 官方定价说明 Batch 对输入和输出 token 提供 50% 折扣,Prompt Caching 的写入与读取乘数还能与 Batch 修饰符叠加。计算时保留 input_tokens、cache_creation_input_tokens、cache_read_input_tokens 和 output_tokens 四个桶。
证据边界:本节以 S3 支持“官方指南解释 cache_control、缓存写入与读取 usage、TTL 及前缀失效条件。”。
用 token counting 预算,用最终 usage 对账
Claude token counting endpoint 接受与 Messages 相同的 system、messages、tools 等结构,可在排队前估计输入规模。估计适合做预算、模型路由和 Batch 分片,最终账单仍应使用实际响应或批次结果中的 usage。
对账表至少保留 model、input_tokens、cache_creation_input_tokens、cache_read_input_tokens、output_tokens、batch 标志和费率版本。重试必须关联原请求,避免把重复消耗误算成模型单价上涨。
证据边界:本节以 S4 支持“官方指南说明 Message Batches 的折扣、异步窗口、请求规模、custom_id 与逐项结果。”。
落地检查清单
工程落地时,为“claude api pricing”建立独立 article_run_id,并保存 selected_semrush_record、database、measured_on、source_snapshot_ids、content_hash、reviewer 与 gate_status。Semrush 字段只参与选词和意图决策,不进入价格公式,也不把 US 指标解释成中文或中国市场需求。
论点账本必须逐条可回放:S1 对应 C1:“Claude API 价格由基础输入输出、Prompt Caching、Batch、长上下文与工具费等可组合部分构成。”;S2 对应 C2:“token counting 只用于请求前估算,最终成本仍应依据实际 Messages usage 与缓存字段。”。编辑器在段落层写入 evidenceRefs,构建检查确认引用 ID 存在;来源页面发生结构变化时,只把对应论点退回复核,不让整篇文章静默继承旧快照。
动态复核字段包括:模型费率、长上下文阈值和工具费用、缓存 TTL/倍率与 Batch 折扣/限额。发布任务应读取当前页面、保留原始单位和地区、与上一快照做字段级 Diff,并记录核验日期 2026-08-29。缺失、受限或无法确认的值保持 null 或“待复核”,不使用 0、均值或相邻产品代填。
独立 SVG 采用“Claude 基础费率、缓存、Batch 与长上下文叠加关系”结构,输入维度为:base input、cache write、cache read、output、Batch、long context。图表只绘制有来源的数据,缺失项显示空缺;alt、caption、图内标题与正文使用同一术语,并在图注标明动态字段核验日期。
证据与来源链接
以下页面用于支持本文中的具体判断;价格、规则和产品状态可能变化,请按核验日期回到原始来源确认。
支持内容:官方定价页列出模型输入输出、Prompt Caching、Message Batches、长上下文及工具费用规则。
支持内容:官方 token counting endpoint 接受与 Messages 相同的结构化输入并返回估计输入 token。
支持内容:官方指南解释 cache_control、缓存写入与读取 usage、TTL 及前缀失效条件。
支持内容:官方指南说明 Message Batches 的折扣、异步窗口、请求规模、custom_id 与逐项结果。
相关文章
AI API 成本
AI API 价格对比:以 LLM API Pricing 证据统一 Token、缓存与工具费
不把厂商价目表机械拼在一起,而是统一 token 桶、缓存、Batch、工具费、错误重试和费率版本,再比较同一 AI 任务的可复核成本。
AI Token 成本
大模型 API Token 计费:从预估到 usage 对账的完整账本
把三家 AI API 的请求前估算与响应后 usage 映射为统一账本,避免用字符估算或单一每百万 token 价格替代真实任务成本。
AI API 缓存
大模型 API 缓存价格:命中、写入、TTL 与存储费怎么算
按同一成本式拆解 Prompt Caching 与 Context Caching:OpenAI 的缓存用量、Claude 的写入/读取倍率、Gemini 的显式存储与隐式命中。
常见问题
Claude Prompt Caching 和 Message Batches 的优惠能同时算吗?
官方定价文档说明相关修饰可组合,但应分别应用缓存写入/读取与 Batch 处理层规则,并以实际 usage 和最新官方页复核。
Claude token counting 的结果就是最终账单吗?
它是请求前估计,结构化输入与最终处理可能产生轻微差异;完成后应以实际 usage 对账。
Claude API Pricing:输入输出、Prompt Caching、Batch 与长上下文中的动态价格或规则怎样保持可复核?
每次更新都重新读取“模型费率、长上下文阈值和工具费用、缓存 TTL/倍率与 Batch 折扣/限额”,保存来源 URL、核验日期、原始单位、地区和快照哈希,并按 evidenceRefs 定位受影响段落。后续若字段消失或规则变化则进入更新复核,不用 0、旧数字或相邻产品自动补位。