用量与计费

Anthropic 速率限制等级(Rate Limit Tiers):怎么分档、怎么升档、每档改变什么(2026)

Kenji Watanabe

Anthropic 速率限制等级(Rate Limit Tiers)是决定组织能用多少 Claude API 的使用档位。按官方文档,现行阶梯是 Start、Build、Scale、Custom,新账号可能先在 Evaluation 档;每档规定月度消费上限和分模型的请求、token 限额。

这篇只讲「等级」本身:阶梯怎么分、什么让组织升档、每档具体改变什么、在哪看自己的档位、不够用时怎么办。至于三条限流轴怎么计量、响应头怎么读、重试怎么写,我们在 Anthropic API 速率限制的计量方式与排查 里已经讲过,这里不重复。

Anthropic 使用等级阶梯一览

官方 Rate limits 页面把限制分成两类,两类都挂在你的等级上:

  • 消费限额(Spend limits):组织每个月在 API 上最多能花多少钱。
  • 速率限额(Rate limits):组织在一段时间内最多能发多少请求、用多少 token。

两类限额都按组织计算,不是按单个 API Key。撰写本文时,官方页面列出的等级如下:

等级

官方页面的描述

Evaluation

新组织、或使用记录较少的组织可能从这里起步,限额低于公开的标准限额

Start

第一个标准档,有公开的消费上限和分模型限额

Build

消费上限和分模型限额更高

Scale

公开数字里最高的一档

Custom

没有月度消费上限,限额与客户团队单独约定

搜「Tier 1」「Tier 2」的读者注意。 不少搜索词和第三方教程用的是数字编号的等级名。当前官方页面并不使用数字编号,所以在别处看到的「Tier 几」对应数字,可能已经过时,规划容量前请先对照官方页面核实。

什么会让组织升档

官方页面在这一点上写得很简短,建议逐字读,不要自行脑补:

  • 组织会被自动分配到某个等级,依据是使用历史和账户状况
  • 随着持续使用 API,组织可以逐步升到更高等级
  • Evaluation 档的限额会随着使用记录积累自动提高。官方说明这类起步限额是防欺诈、防滥用机制的一部分。

撰写本文时,Rate limits 页面没有公布触发升档的充值金额、购买额度门槛或等待天数。如果你在别处看到这类门槛,它们并非出自当前官方页面,依赖之前务必核实。官方写明的升档路径只有两条:靠使用历史和账户状况自动升,或者主动申请(见下文)。

落到实操上:新注册的组织不要默认第一天就能拿到 Start 档表格里的完整数字。准备上线压测时,请以 Console 里你自己组织实际显示的限额为准,而不是直接套下面的表。

官方写明的一个例外。 通过 Claude Platform on AWS 使用的组织,会被放在 Start 档,而且不会自动在等级之间移动。这类组织的账单走 AWS Marketplace,提额需要联系 Anthropic 客户代表或 Anthropic 支持,Console 里的提额入口对它们不可用。

每个 Anthropic 速率限制等级具体改变什么

以下表格反映的是撰写本文时(2026 年 9 月)Anthropic 官方 Rate limits 页面上的数字。限额会调整,按生产负载做规划前,请到官方页面确认最新值。

月度消费上限。 Start、Build、Scale 三档各有一个自然月内的 API 消费上限:

等级

月度消费上限

Start

500 USD

Build

1,000 USD

Scale

200,000 USD

Custom

无上限,与客户团队约定

Messages API 分模型限额。 计量单位是每分钟请求数(RPM)、每分钟输入 token(ITPM)、每分钟输出 token(OTPM),并且每个模型单独计算。当前不少模型的数字完全一样,这里合并成一行:

等级

模型

RPM

ITPM

OTPM

Start

Opus 5、Sonnet 5、Haiku 4.5、Opus 4.x、Sonnet 4.x

1,000

2,000,000

400,000

Start

Fable 5.x

1,000

500,000

100,000

Build

Opus 5、Sonnet 5、Haiku 4.5、Opus 4.x、Sonnet 4.x

5,000

5,000,000

1,000,000

Build

Fable 5.x

2,000

1,500,000

300,000

Scale

Opus 5、Sonnet 5、Haiku 4.5、Opus 4.x、Sonnet 4.x

10,000

10,000,000

2,000,000

Scale

Fable 5.x

4,000

4,000,000

800,000

需要超过 Scale 档的额度时,官方页面的指引是联系销售走 Custom。读这张表时,官方脚注里有几条很关键:

  • Opus 4.x 是一个合并额度,Opus 4.8、4.7、4.6、4.5 共用;Opus 5 单独一份额度,不在这个合并池里。
  • Sonnet 4.x 同样是合并额度,Sonnet 4.6 和 4.5 共用;Sonnet 5 单独一份。
  • Fable 5.x 是 Fable 5.1 与 Fable 5 的合并额度;Mythos 5.1 与 Mythos 5 按同样条件另有一个合并额度。
  • 因为按模型分开计算,不同模型可以同时各自跑到自己的上限。

Message Batches API 限额。 批处理有自己的一套分档限额,所有模型共用:

等级

RPM

处理队列中的批请求数上限

单个批次的请求数上限

Start

1,000

200,000

100,000

Build

2,000

300,000

100,000

Scale

4,000

500,000

100,000

不在等级表里的限额。 官方页面还单独列了几类限额:Claude Managed Agents 相关接口有自己的按组织限额,页面上只给了一组数字;Files API 有独立的按组织限额,具体值写在 Files 页面;fast mode 也有独立于标准 Opus 限额的专用额度。除非对应页面明确说明,不要默认它们会随等级一起变化。

在 Console 哪里看自己的等级和限额

和等级有关的信息都在 Claude Console 里,分布在三个页面:

  1. Rate limits 页面(Settings > Limits):显示组织当前等级和各项限额,「Request rate limit increase」提额入口也在这里。
  2. Billing 页面(Settings > Billing):显示当前等级的月度消费上限,也可以在这里设置一个更低的自定义消费限额。页面上其他数字的含义,可以参考我们对 Anthropic API 账单页各项数字的逐一解读
  3. Usage 页面:除了 token 和请求图表,还有输入 token、输出 token 两张速率限额图,把每小时内的每分钟峰值用量和当前限额画在一起,输入图还带缓存命中率。想知道当前等级到底还剩多少余量,看这里最快。

如果想自动化,官方还提供了 Rate Limits API,可以用程序读取组织和工作区的已配置限额,适合在上线前做一次「配置限额 vs 计划负载」的核对。

等级不够用时怎么办

先确认撞上的是哪一道上限。等级会带来两种不同的天花板,报错表现也不一样。

撞上等级的月度消费上限。 组织达到所在等级的月度消费上限后,API 调用会暂停到下个月 1 日 00:00 UTC,除非在此之前获批了更高额度。此时请求返回 HTTP 429,错误类型是 rate_limit_error,但不带 retry-after 响应头。在 Messages API 上,响应体里有一个可以把它和普通限流区分开的错误码,下面是按官方示例精简后的结构:

{
  "type": "error",
  "error": {
    "type": "rate_limit_error",
    "details": { "error_code": "enforced_spend_limit_reached" }
  }
}

这种情况下重试没有用,包括 SDK 的自动重试,在恢复访问之前都会继续失败。官方页面说明,升到更高等级即可恢复访问。

撞上自己设置的消费限额。 如果你在等级上限之下另设了消费限额,达到后返回的是 HTTP 400、错误类型 invalid_request_error。这不是等级问题,调高或取消自己设的限额即可。

撞上每分钟速率限额。retry-after 的 429 属于速率限额,处理方法见上文提到的计量与排查文章。从等级角度只需要判断一件事:你稳定状态下的峰值,是否真的超过了当前等级的数字,Usage 页面的图表可以回答这个问题。

确认确实是等级不够,按成本从低到高依次尝试:

  1. 先把当前等级用足。 按官方页面,对大多数当前模型,只有未命中缓存的输入 token 计入 ITPM,缓存命中越多,同样的限额能处理的输入越多。怎么设置可以看 Claude API 提示缓存的断点与 TTL 用法。不急的任务可以走 Message Batches API,它有自己的独立限额。另外限额按模型计算,把次要任务放到不在主力模型合并池里的模型上,不会占用同一份额度。
  2. 流量逐步爬坡。 官方页面提到,用量陡增可能触发加速度限制(acceleration limits),同样返回 429,建议逐步放量、保持用量平稳。新功能上线时尤其要提前规划。
  3. 申请提额。 在 Console 的 Rate limits 页面点「Request rate limit increase」,速率限额和月度消费上限都可以在这里申请提高;紧急情况也可以联系 Anthropic 支持。
  4. 升到 Custom。 需要超过 Scale 档时,官方页面的指引是通过同一个 Rate limits 页面联系销售。

至于申请时写什么,官方给 Claude Platform on AWS 用户的说明里要求提供:需要提额的模型、每个模型的输入和输出 token 每分钟峰值、输入中大致有多少比例是缓存或重复上下文。这份清单对任何提额申请都适用,数字从 Usage 页面就能拿到。

等级与工作区限额、限流机制的关系

等级决定的是整个组织的天花板,其他限制都在它下面:

  • 工作区限额:可以按工作区分别设置消费限额和各类速率限额,但只能比组织限额更低。没设置的工作区沿用组织限额;默认工作区不能单独设限;即使各工作区限额加起来超过组织限额,组织级限额依然生效。
  • 执行方式:官方采用令牌桶算法,额度是持续回补的,不是每分钟整点清零;每分钟的数字也可能按更短的时间间隔执行。升档带来的是更高的限额,页面描述的执行方式本身不变。
  • 限额是上限,不是保证:官方页面明确写着,所有限额代表的是允许的最大用量,而不是保证能拿到的最低用量。

如果你是通过 ROIBest AI 这类网关而不是直连 Anthropic 来调用 Claude,需要注意网关有自己的一套额度模型,建议拿它的限额和你上面梳理出的等级需求做对比。

常见问题

Anthropic 的 Tier 1 到 Tier 4 在官方页面哪里?

撰写本文时,官方 Rate limits 页面不使用数字编号,列出的是 Evaluation、Start、Build、Scale、Custom。其他来源里的数字编号等级及其限额,请对照官方页面核实。

怎么升到更高的 Anthropic 使用等级?

Anthropic 会根据使用历史和账户状况自动调整等级。想更快提高,可以在 Console 的 Rate limits 页面申请提额;需要超过 Scale 档时联系销售。

自己设置消费限额会改变等级吗?

不会。自设的消费限额不能超过当前等级的上限,达到后返回 HTTP 400,调高或取消这个限额即可恢复。

Anthropic 的等级限额是按 API Key 计算的吗?

不是,限额按组织计算。你可以给单个工作区设置更低的限额,但组织级限额始终生效。