Claude API pricing(2026):模型价格表与三类应用预算
Claude API pricing 怎么算?本文梳理各模型的输入、输出、缓存、批处理与工具费用,用工单分类、企业规章助手和托管 Agent 三类场景算清应用预算,并说明 Pro、Max 订阅何时更适合个人工作。价格采用原文核验的美元费率,同时解释代码执行免费额度的差异,帮助你按完整用量估算成本。

Claude API pricing 的最低档是 Claude Haiku 4.5:每百万输入 token $1,每百万输出 token $5,是 Anthropic 最新四款模型中最便宜的一款。任务边界明确时,可以先从它开始;质量不达标,再考虑 Claude Sonnet 5.5。Claude Opus 5.5 和 Claude Fable 5.1 则留给那些值得花更多钱解决的难题。个人工作使用 Pro 或 Max 订阅可能更省钱,但应用的 API 费用仍需单独支付。
本文价格于 2026 年 10 月 4 日,对照 Anthropic 实时价格页和 Claude Platform 计费文档核验。以下所有价格均为美元。文中的三份预算是在明确假设下计算的示例,并非生产环境实测,也不代表所有模型都能给出同等质量的回答。
Claude API pricing:各模型当前怎么收费?
最新四款模型中,Haiku 的价格最低;如果质量检查不接受它的结果,下一步再评估 Sonnet。 MTok 指一百万 token,也就是模型处理的文本片段。输入是你发送给模型的内容,输出是模型生成的内容。
下表包含公开价格页上的最新模型及全部旧版模型。缓存栏均按读取/五分钟写入的顺序列出。所有费率的单位均为每 MTok,核验时间为 2026 年 10 月。
来源:Claude 公开模型价目表。详细文档还列有其他模型及历史费率;仅仅因为旧模型仍有标价,并不足以成为新应用选择它的理由。

已有集成需要留意新旧模型的差别。在全新输入和输出 token 数完全相同的情况下,Opus 5.5 比 Opus 5 便宜 20%;Sonnet 5.5 则沿用 Sonnet 5 的价格。Fable 5.1 的输入、输出费率与 Fable 5 相同,但缓存读取从 $1 降至 $0.25。这些比较只针对费率:如果 Agent 开始消耗更多 token,账单并不一定随之下降。官方费率。
Claude token 价格怎么算?每类用量只计一次
账单取决于 token 属于哪一类:全新输入、缓存写入、缓存读取,还是生成的输出。 缓存会保存可复用的提示内容,避免每次调用都把同样的材料按全新输入处理。
Anthropic API 账单具体算哪些用量?
token 费用由以下四项相加得出:
- 全新输入 token 数除以一百万,再乘以输入费率。
- 缓存写入 token 数除以一百万,再乘以相应的写入费率。
- 缓存读取 token 数除以一百万,再乘以读取费率。
- 输出 token 数除以一百万,再乘以输出费率。
然后加上适用的工具及运行时间费用。**这些 token 类别必须分开计数:**缓存读取不能同时算作全新输入。预算要涵盖模型实际处理的对话历史、工具定义和工具结果,不能只计算用户刚发来的那一句话。Anthropic 文档说明了这些计费类别与工具开销。
输出也需要单独预算。Sonnet 5.5 的输出费率为 $10,是 $2 全新输入费率的五倍。如果产品只需要一个简短判断,让模型写成长文只会增加成本,并不会改善产品所需的结果。提示内容进入缓存,也不会让生成的回答享受折扣。
缓存有效期如何影响写入价格?
低价读取的前提,是先付费写入。五分钟缓存的写入费率是模型全新输入费率的 1.25 倍;一小时缓存则是两倍。一小时写入的每 MTok 费率分别为 Haiku $2、Sonnet $4、Opus $8、Fable $20。读取费率仍按上表计算。缓存价格。
以可复用的一个 MTok Sonnet 前缀为例:不使用缓存,调用两次需要 $4。写入五分钟缓存后再读取一次,费用为 $2.50 + $0.20 = $2.70,第一次复用就能抵消写入的额外成本。如果使用一小时缓存,写入一次、读取两次,共需 $4 + $0.40 = $4.40;同样内容全部按全新输入调用三次,则需要 $6。
缓存时长要与实际请求节奏匹配。繁忙服务中反复使用的固定规则提示,很适合缓存;指令经常改写,或调用间隔较长,就会增加写入次数。因此,不能假设每次请求都只支付便宜的读取费用。
先选能完成任务的最便宜模型
先为任务设定明确的质量门槛,再选择通过门槛的最低价模型。 比较的应是分类是否正确、回答是否被接受、任务是否完成。只有结果仍然可用,更低的 token 费率才有意义。
Claude Haiku API 价格:从边界明确的任务开始
Claude Haiku 4.5 是最新模型中价格最低的一款,每 MTok 输入 $1、输出 $5。可以先用它评估工单分流、少量字段提取,或将文本归入固定标签等任务。Anthropic 将其定位为速度最快的经济型模型。模型价格。
是否适合,取决于你的验收标准。一个便宜的分类器如果反复把任务分错队列,后续纠错成本可能超过 token 节省的费用。如果评估已经发现这种问题,就不该把 Haiku 设为默认模型。
Claude Sonnet API 价格:更高费用要换来更好的结果
Claude Sonnet 5.5 的输入/输出费率为 $2/$10,是 Haiku 全新 token 费率的两倍。对于编程、需要判断力的客户答复,或超出简单分类范围的 Agent 工作,它是合理的下一步评估对象。厂商将其定位为速度与智能的平衡点;这一定位可以作为评估的起始假设。官方定位与费率。
全新 token 数相同时,Sonnet 必须靠更好的结果来证明额外支出值得。评估应聚焦真正影响业务的错误,不要只因为回答写得更复杂就升级模型。
Claude Opus API 价格:把高价模型留给难题
Claude Opus 5.5 的输入/输出费率为 $4/$20,Claude Fable 5.1 则为 $10/$50。Anthropic 将 Opus 定位于长时间运行的编程与知识工作,将 Fable 定位于高难度推理和长期任务型 Agent。如果 Haiku 或 Sonnet 已经能把任务完成到可接受的程度,这两款模型都不适合作为省钱的默认选择。当前模型费率。
全新输入、输出 token 数完全相同时,Haiku、Sonnet、Opus 和 Fable 的 token 账单比例为 1:2:4:10。使用缓存后,这个比例可能变化。选择更贵的模型前,需要有证据说明:它减少的任务失败或人工纠错,足以抵消差价。

Claude API 费用怎么算?三类工作负载的预算示例
先算工作负载,再选模型。 以下示例固定 token 数,以便看清费率差异。估算生产环境成本时,应使用各模型实际产生的用量,并计入重试。所有合计均不含税费、应用基础设施,以及单独计费的代码执行费用。
1. 创业者的工单分类器:Haiku 每月 $150,批处理 $75
假设每月分类 100,000 次,每次使用 1,000 个全新输入 token 和 100 个输出 token。本例不使用缓存、搜索或 Agent 运行服务。
每月用量为 100 MTok 输入和 10 MTok 输出。Haiku 的计算如下:
100 × $1 + 10 × $5 = 每月 $150,即每 1,000 次判断 $1.50。
同样的 token 数,Sonnet 需要 $300,Opus 需要 $600,Fable 需要 $1,500。如果任务可以等待异步批处理,token 费用享受 50% 折扣,对应合计分别为 $75、$150、$300 和 $750。Haiku 批处理折算为每 1,000 次判断 $0.75。费率与批处理折扣。
如果创业者要整理夜间积压的工单,可以先评估 Haiku 加批处理。实时客户交互则可能因延迟要求而无法使用批处理。在这个例子里,升级 Sonnet 会使标准 token 账单翻倍,因此应在分类质量确实需要时再支付这笔费用。
2. CTO 的企业规章助手:缓存 Sonnet 每月 $134.60
假设每月回答 10,000 次。每次请求包含固定不变的 20,000 token 规章前缀、2,000 个全新输入 token和 500 个输出 token。
为了把缓存创建成本算进去,将这些调用分成 100 个独立的缓存有效期,每个有效期内处理 100 次请求。每组请求都在五分钟有效期内完成,因此每组支付一次前缀写入和 99 次读取。
总用量为缓存写入 2 MTok、缓存读取 198 MTok、全新输入 20 MTok,以及输出 5 MTok。按 Sonnet 费率计算:
- 全新输入:20 × $2 = $40。
- 缓存写入:2 × $2.50 = $5。
- 缓存读取:198 × $0.20 = $39.60。
- 输出:5 × $10 = $50。
合计每月 $134.60,即每 1,000 次回答 $13.46。不使用缓存时,220 MTok 全新输入加上同样的输出,需要 $490。在这些假设下,缓存可节省 $355.40。官方缓存与 token 费率。

同样的缓存工作负载,Haiku 需要 $67.30,Opus 需要 $229.60,Fable 需要 $524.50。Sonnet 和 Opus 的缓存读取费用都恰好为 $39.60,因为两者的读取费率同为 $0.20。Opus 剩余的差价来自全新输入、缓存写入和输出。
这会改变 CTO 的选择:在这份 Sonnet 预算上,Opus 只多 $95,并不会让整张账单翻倍。只有当它提供的合格回答足以证明差价值得时,才应升级。如果请求间隔更长,或规章内容发生变化,使用这份估算前要先提高缓存写入次数。
3. 运营人员的托管 Agent:Opus 每月 $460
假设每月 1,000 次会话,每次消耗 50,000 个全新输入 token、10,000 个输出 token、30 分钟运行时间,并进行两次网页搜索。输入假设已涵盖所有被处理的历史记录与工具内容,不使用缓存。
使用 Opus 5.5,每月费用如下:
- 输入:50 MTok × 每 MTok $4 = $200。
- 输出:10 MTok × 每 MTok $20 = $200。
- 活跃运行时间:500 会话小时 × $0.08 = $40。
- 搜索:2,000 次搜索 × 每 1,000 次 $10 = $20。
合计每月 $460,即每次会话 $0.46。 同样的假设,Haiku 需要 $160,Sonnet 需要 $260,Fable 需要 $1,060。这些是可以评估的替代方案,并不保证输出质量相同。Managed Agents 与工具费率。
若使用受支持的仅限美国推理,Opus 的 token 费用小计变为 $400 × 1.1,运行时间与搜索仍为 $60,总计 $500。改用 Opus 快速模式,则为 $860。快速模式与仅限美国推理叠加后为 $940,计算式是 $400 × 2 × 1.1 + $60。
批处理、仅限美国推理与快速模式怎么选?
能等的任务用批处理;应用确有需要时,再为地域或速度付费。 这些选项影响的计费部分各不相同。
批处理让输入和输出费用降低 50%。 Sonnet 的批处理输入/输出费率为 $1/$5,Opus 为 $2/$10。提示缓存可以与批处理折扣叠加。Managed Agents 会话不支持批处理,因此第三个场景的预算不能直接减半。批处理与会话价格。
受支持模型的仅限美国推理,按标准 token 费率的 1.1 倍收费。 文档说明,全新输入、输出、缓存写入和缓存读取均适用,并非只调整全新输入一栏。该选项适用于 Claude 4.6 及之后的版本,不应假设 Haiku 4.5 也支持。全球路由使用标准费率。数据驻留价格。
**Opus 5.5 快速模式的价格是标准费率的两倍:**每 MTok 输入 $8、输出 $40。它可以叠加缓存及受支持的仅限美国费率,但不能与批处理一起使用。只有当缩短等待时间能改善面向用户的结果,且改善足以抵消差价时,才值得选择。快速模式价格。
迁移模型时,还有两点会影响估算。Claude 4.6 及之后的版本,其完整的一百万 token 上下文窗口均按标准费率计费,不应把旧版长上下文附加费照搬到当前预算。文档还说明,Claude 4.7 及之后的版本使用的 tokenizer,对相同文本会产生约 30% 更多的 token,具体差异取决于内容。应统计实际请求用量,不要直接给上面的预算示例加上这个估计比例。上下文与 tokenizer 说明。
工具费用与代码执行免费额度
一次 Agent 会话可能同时触发多项计费。 如果应用还使用托管运行服务或搜索,仅估算 token 费用并不完整。
Claude Managed Agents 每个活跃会话小时收费 $0.08,token 另计。实际运行时间收费,空闲、重新调度和已终止的时间不计费。因此,会话保持打开和会话持续运行,是两种不同情况。运行时间计费。
网页搜索每 1,000 次收费 $10,处理请求及搜索内容的 token 另计。一次搜索无论返回多少条结果,都只计一次。网页抓取没有单独的工具费用,但抓取到的内容仍会消耗 token。大量使用搜索的研究型 Agent,预算既要统计搜索次数,也要计入由此带来的输入量。搜索与抓取价格。
公开代码执行价目表写明:每个组织每天有 50 小时免费额度,超出后按每个容器每小时 $0.05 收费。 这是 claude.com/pricing当前的表述。
前面的预算合计均未包含单独计费的代码执行。明确需付费的容器小时数后,乘以 $0.05 即可。文档还说明,即使没有调用工具,只要请求附带文件,也可能产生执行时间费用,因为文件会预先加载到容器中。
Claude API 价格与订阅怎么比较?
符合条件的个人工作,订阅可能更划算;面向客户的应用仍需单独做 API 预算。 Claude Pro 和 Claude Max 是使用 Claude 产品功能的订阅方案,其中包括编程 Agent Claude Code。它们不会让你的 API 集成自动获得订阅内的用量额度。
Claude Pro 价格:按月还是按年更划算?
Pro 按月支付为 $20,按年一次性支付为 $200。Max 每月 $100 起。 Pro 年付价格卡片显示折合每月 $17,而把实际年费除以十二,结果为 $16.67。Max 提供 Pro 用量的 5x 或 20x 两档选择,按月计费。当前订阅价格。
支付十次 $20 月费,就等于 $200 年费。付费使用超过十个月,Pro 年付更便宜;用满一年可节省 $40。短期项目按月付费,则可以避免为用不到的月份买单。公开的消费者退款条件,并不意味着年费可以当作灵活的月度余额使用。
用量是否够用仍是前提。个人方案的可用量取决于模型、对话长度和功能,同时受会话及每周限额约束。价格页没有承诺固定的任务次数。付费方案也可以使用按 API 费率计费的用量额度,因此比较时还要把额外按量付费的使用算进去。
Claude Code 用 API 还是订阅?回本点有前提
如果个人编程任务采用第三个场景的 50,000 个 Opus 输入 token 和 10,000 个输出 token,则仅 token 的 API 成本为每次任务 $0.40。这里不包含 Managed Agents 运行时间和搜索,因为它们是单独的 API 服务。
在这种 token 用量下,50 次任务等于 Pro 的 $20 月费;250 次任务等于 Max 入门档的 $100。这只是费用相等的算术点,并非订阅承诺的任务次数。超过这个点,只有当订阅支持所需模型和工作、且额度足够时,订阅才更省钱;低于这个点,偶尔使用按量计费可能更便宜。
Fable 要单独确认:Pro 的方案对比将 Fable 标注为使用用量额度。不能假设支付 $20 Pro 月费,就包含你的 API 工作流会消耗的全部 Fable token。订阅模型权限。
个人方案的选择可参考《Claude 免费吗?》,编程订阅的选择可参考《Claude Code 价格》。生产应用的账单,应与开发时使用的个人订阅分开计算。
免费使用、学生方案与退款
免费的 Claude 应用和首次 API 测试额度,是两种不同的优惠。 两者都不是长期免费的生产 API 方案。
Claude API key 免费吗?拿到密钥不等于免费调用
价目表列的是 token 和功能费用,没有单列密钥本身的价格。文档说明,新用户可获得少量免费 API 额度,但没有公布固定金额,也没有承诺定期发放免费 token。测试额度用完后,应按付费用量做预算。API 价格常见问题。
Claude Free 价格为 $0,可在应用内进行普通聊天、网页搜索、文件创建和代码执行。方案对比显示,Free 不包含 Claude Code、Opus 和 Fable。如果只是偶尔在应用内寻求帮助,用量在额度以内,也不需要付费功能,可能始终无需付费。但通过 API 服务客户的开发者,不属于这种情况。Free 方案对比。
学生优惠与退款规则
公开价格页介绍了面向整所院校的 Education 方案,覆盖学生、教师和员工,并包含专门的 API 额度。两处价格页面都没有公布固定的个人学生 API 折扣。估算生产成本时,不要自行扣除一个假设存在的学生优惠券。
消费者订阅付款通常不予退款,条款或当地法律另有规定的情况除外。价格 FAQ 说明,欧洲经济区及英国客户可在 14 天撤回期内通过应用提交请求;App Store 退款则由 Apple 处理。公开退款规则。
这些消费者规则并不构成 API 额度的退款承诺。两份价目表也没有说明 API 预付额度的有效期。大额充值前,应确认适用的购买条款。
常见问题
Claude Code 订阅与 API 相比,要花多少钱?
Pro 每月 $20,或每年一次性支付 $200;Max 每月 $100 起。API 按量计费。按示例中 Opus 每次任务 $0.40 的 token 成本,50 次任务等于 $20。但只有当订阅支持个人工作所需的模型、且额度够用时,订阅才更划算。订阅价格。
GPT API 的价格是多少?
Anthropic 的价目表不能用来确定 GPT API 的价格。不同供应商的报价应分别核对,再以相同的输入、输出、缓存和工具工作量进行比较。Claude 的费率并不是 GPT 的报价。
Claude Opus 的 API 价格是多少?
Claude Opus 5.5 每百万输入 token $4,每百万输出 token $20;缓存读取 $0.20,五分钟写入 $5。旧版 Opus 5 的输入/输出费率为 $5/$25,因此 5.5 的全新 token 费率低 20%。Sonnet 5.5 则沿用 Sonnet 5 的 $2/$10 费率。官方模型费率。
Claude API key 是免费的吗?
价目表没有单列密钥费用,但调用会产生需付费的用量。首次测试额度是有限的额度,并非永久免费的 API 方案。API 价格。
怎样免费获得 Claude Opus API key?
文档提到少量首次 API 测试额度,但没有承诺具体金额,也没有承诺持续免费的 Opus API 使用权限。$0 的 Claude 应用方案不包含 Opus。测试额度说明、Free 方案模型权限。
Claude API 如何计费?
文档说明,按实际用量以美元计费。根据所选模型的费率,分别计算全新输入、输出、缓存写入和缓存读取,再加上适用的搜索、运行时间或代码执行费用。计费详情。
使用 Claude API 必须付费吗?
需要。首次测试额度之外的用量要付费。免费的 Claude 应用并不提供定期发放的生产 API 额度。API 试用与计费常见问题。
Claude 订阅可以当 API 用吗?
Pro 或 Max 订阅不能替代应用单独按量计费的 API 使用。价格页明确区分了订阅内包含的 Claude Code 用量,以及按量购买 API 额度的方式。订阅与 API 价格。
Claude API 与 Claude Pro 订阅主要有什么区别?
API 为集成和 Agent 提供按量计费的模型访问。Pro 则在方案额度内提供个人 Claude 和 Claude Code 使用权限,价格为每月 $20 或每年 $200。先看工作在哪种环境中运行,再比较符合条件的个人使用成本。官方价格。
学生使用 Claude AI 有什么价格优惠?
学生可使用 $0 的 Free 应用。Anthropic 价格页介绍了面向整所院校的 Education 方案,并包含 API 额度,但没有公布固定的个人学生 API 折扣。学生与 Education 方案价格。
Claude 支持退款吗?
消费者方案的价格 FAQ 表示,付款通常不予退款,条款或当地法律规定的例外情况除外。其中说明了欧洲经济区/英国客户可在 14 天撤回期内通过应用提交请求。这项消费者说明,并不构成 API 额度的退款承诺。退款规则。
本周就把应用预算算清楚
从一个有代表性的任务和明确的验收规则开始。 真正有用的指标,是获得一个合格结果的成本,其中包括失败尝试;单次回答再出色,其价格也不足以代表实际成本。
统计完整请求的用量
统计应用实际发送的输入,包括历史记录与工具内容,再加上输出。缓存读取和写入分开记录;使用搜索或托管运行服务时,也要统计搜索次数和活跃运行时间。
给最便宜的合格模型算成本
任务边界明确时先评估 Haiku,达不到质量门槛再试 Sonnet。难题只有在效果提升足以抵消额外支出时,才升级到 Opus 或 Fable。
让计费选项匹配实际工作负载
缓存不变的上下文,把能等的任务交给批处理,并明确列出地域或速度附加费。对于单独计费的代码执行,应先厘清免费额度的差异,再估算超额费用。
通过企业主 AI 工具地图,为每项工作匹配合适的工具与预算。
- 最近更新
- 2026年10月4日
- 分类
- AI







