Anthropic 速率限制等级(Rate Limit Tiers):怎么分档、怎么升档、每档改变什么(2026)
Anthropic 速率限制等级(Rate Limit Tiers)是决定组织能用多少 Claude API 的使用档位。按官方文档,现行阶梯是 Start、Build、Scale、Custom,新账号可能先在 Evaluation 档;每档规定月度消费上限和分模型的请求、token 限额。
这篇只讲「等级」本身:阶梯怎么分、什么让组织升档、每档具体改变什么、在哪看自己的档位、不够用时怎么办。至于三条限流轴怎么计量、响应头怎么读、重试怎么写,我们在 Anthropic API 速率限制的计量方式与排查 里已经讲过,这里不重复。
Anthropic 使用等级阶梯一览
官方 Rate limits 页面把限制分成两类,两类都挂在你的等级上:
- 消费限额(Spend limits):组织每个月在 API 上最多能花多少钱。
- 速率限额(Rate limits):组织在一段时间内最多能发多少请求、用多少 token。
两类限额都按组织计算,不是按单个 API Key。撰写本文时,官方页面列出的等级如下:
|
等级 |
官方页面的描述 |
|---|---|
|
Evaluation |
新组织、或使用记录较少的组织可能从这里起步,限额低于公开的标准限额 |
|
Start |
第一个标准档,有公开的消费上限和分模型限额 |
|
Build |
消费上限和分模型限额更高 |
|
Scale |
公开数字里最高的一档 |
|
Custom |
没有月度消费上限,限额与客户团队单独约定 |
搜「Tier 1」「Tier 2」的读者注意。 不少搜索词和第三方教程用的是数字编号的等级名。当前官方页面并不使用数字编号,所以在别处看到的「Tier 几」对应数字,可能已经过时,规划容量前请先对照官方页面核实。
什么会让组织升档
官方页面在这一点上写得很简短,建议逐字读,不要自行脑补:
- 组织会被自动分配到某个等级,依据是使用历史和账户状况。
- 随着持续使用 API,组织可以逐步升到更高等级。
- Evaluation 档的限额会随着使用记录积累自动提高。官方说明这类起步限额是防欺诈、防滥用机制的一部分。
撰写本文时,Rate limits 页面没有公布触发升档的充值金额、购买额度门槛或等待天数。如果你在别处看到这类门槛,它们并非出自当前官方页面,依赖之前务必核实。官方写明的升档路径只有两条:靠使用历史和账户状况自动升,或者主动申请(见下文)。
落到实操上:新注册的组织不要默认第一天就能拿到 Start 档表格里的完整数字。准备上线压测时,请以 Console 里你自己组织实际显示的限额为准,而不是直接套下面的表。
官方写明的一个例外。 通过 Claude Platform on AWS 使用的组织,会被放在 Start 档,而且不会自动在等级之间移动。这类组织的账单走 AWS Marketplace,提额需要联系 Anthropic 客户代表或 Anthropic 支持,Console 里的提额入口对它们不可用。
每个 Anthropic 速率限制等级具体改变什么
以下表格反映的是撰写本文时(2026 年 9 月)Anthropic 官方 Rate limits 页面上的数字。限额会调整,按生产负载做规划前,请到官方页面确认最新值。
月度消费上限。 Start、Build、Scale 三档各有一个自然月内的 API 消费上限:
|
等级 |
月度消费上限 |
|---|---|
|
Start |
500 USD |
|
Build |
1,000 USD |
|
Scale |
200,000 USD |
|
Custom |
无上限,与客户团队约定 |
Messages API 分模型限额。 计量单位是每分钟请求数(RPM)、每分钟输入 token(ITPM)、每分钟输出 token(OTPM),并且每个模型单独计算。当前不少模型的数字完全一样,这里合并成一行:
|
等级 |
模型 |
RPM |
ITPM |
OTPM |
|---|---|---|---|---|
|
Start |
Opus 5、Sonnet 5、Haiku 4.5、Opus 4.x、Sonnet 4.x |
1,000 |
2,000,000 |
400,000 |
|
Start |
Fable 5.x |
1,000 |
500,000 |
100,000 |
|
Build |
Opus 5、Sonnet 5、Haiku 4.5、Opus 4.x、Sonnet 4.x |
5,000 |
5,000,000 |
1,000,000 |
|
Build |
Fable 5.x |
2,000 |
1,500,000 |
300,000 |
|
Scale |
Opus 5、Sonnet 5、Haiku 4.5、Opus 4.x、Sonnet 4.x |
10,000 |
10,000,000 |
2,000,000 |
|
Scale |
Fable 5.x |
4,000 |
4,000,000 |
800,000 |
需要超过 Scale 档的额度时,官方页面的指引是联系销售走 Custom。读这张表时,官方脚注里有几条很关键:
- Opus 4.x 是一个合并额度,Opus 4.8、4.7、4.6、4.5 共用;Opus 5 单独一份额度,不在这个合并池里。
- Sonnet 4.x 同样是合并额度,Sonnet 4.6 和 4.5 共用;Sonnet 5 单独一份。
- Fable 5.x 是 Fable 5.1 与 Fable 5 的合并额度;Mythos 5.1 与 Mythos 5 按同样条件另有一个合并额度。
- 因为按模型分开计算,不同模型可以同时各自跑到自己的上限。
Message Batches API 限额。 批处理有自己的一套分档限额,所有模型共用:
|
等级 |
RPM |
处理队列中的批请求数上限 |
单个批次的请求数上限 |
|---|---|---|---|
|
Start |
1,000 |
200,000 |
100,000 |
|
Build |
2,000 |
300,000 |
100,000 |
|
Scale |
4,000 |
500,000 |
100,000 |
不在等级表里的限额。 官方页面还单独列了几类限额:Claude Managed Agents 相关接口有自己的按组织限额,页面上只给了一组数字;Files API 有独立的按组织限额,具体值写在 Files 页面;fast mode 也有独立于标准 Opus 限额的专用额度。除非对应页面明确说明,不要默认它们会随等级一起变化。
在 Console 哪里看自己的等级和限额
和等级有关的信息都在 Claude Console 里,分布在三个页面:
- Rate limits 页面(Settings > Limits):显示组织当前等级和各项限额,「Request rate limit increase」提额入口也在这里。
- Billing 页面(Settings > Billing):显示当前等级的月度消费上限,也可以在这里设置一个更低的自定义消费限额。页面上其他数字的含义,可以参考我们对 Anthropic API 账单页各项数字的逐一解读。
- Usage 页面:除了 token 和请求图表,还有输入 token、输出 token 两张速率限额图,把每小时内的每分钟峰值用量和当前限额画在一起,输入图还带缓存命中率。想知道当前等级到底还剩多少余量,看这里最快。
如果想自动化,官方还提供了 Rate Limits API,可以用程序读取组织和工作区的已配置限额,适合在上线前做一次「配置限额 vs 计划负载」的核对。
等级不够用时怎么办
先确认撞上的是哪一道上限。等级会带来两种不同的天花板,报错表现也不一样。
撞上等级的月度消费上限。 组织达到所在等级的月度消费上限后,API 调用会暂停到下个月 1 日 00:00 UTC,除非在此之前获批了更高额度。此时请求返回 HTTP 429,错误类型是 rate_limit_error,但不带 retry-after 响应头。在 Messages API 上,响应体里有一个可以把它和普通限流区分开的错误码,下面是按官方示例精简后的结构:
{
"type": "error",
"error": {
"type": "rate_limit_error",
"details": { "error_code": "enforced_spend_limit_reached" }
}
}这种情况下重试没有用,包括 SDK 的自动重试,在恢复访问之前都会继续失败。官方页面说明,升到更高等级即可恢复访问。
撞上自己设置的消费限额。 如果你在等级上限之下另设了消费限额,达到后返回的是 HTTP 400、错误类型 invalid_request_error。这不是等级问题,调高或取消自己设的限额即可。
撞上每分钟速率限额。 带 retry-after 的 429 属于速率限额,处理方法见上文提到的计量与排查文章。从等级角度只需要判断一件事:你稳定状态下的峰值,是否真的超过了当前等级的数字,Usage 页面的图表可以回答这个问题。
确认确实是等级不够,按成本从低到高依次尝试:
- 先把当前等级用足。 按官方页面,对大多数当前模型,只有未命中缓存的输入 token 计入 ITPM,缓存命中越多,同样的限额能处理的输入越多。怎么设置可以看 Claude API 提示缓存的断点与 TTL 用法。不急的任务可以走 Message Batches API,它有自己的独立限额。另外限额按模型计算,把次要任务放到不在主力模型合并池里的模型上,不会占用同一份额度。
- 流量逐步爬坡。 官方页面提到,用量陡增可能触发加速度限制(acceleration limits),同样返回 429,建议逐步放量、保持用量平稳。新功能上线时尤其要提前规划。
- 申请提额。 在 Console 的 Rate limits 页面点「Request rate limit increase」,速率限额和月度消费上限都可以在这里申请提高;紧急情况也可以联系 Anthropic 支持。
- 升到 Custom。 需要超过 Scale 档时,官方页面的指引是通过同一个 Rate limits 页面联系销售。
至于申请时写什么,官方给 Claude Platform on AWS 用户的说明里要求提供:需要提额的模型、每个模型的输入和输出 token 每分钟峰值、输入中大致有多少比例是缓存或重复上下文。这份清单对任何提额申请都适用,数字从 Usage 页面就能拿到。
等级与工作区限额、限流机制的关系
等级决定的是整个组织的天花板,其他限制都在它下面:
- 工作区限额:可以按工作区分别设置消费限额和各类速率限额,但只能比组织限额更低。没设置的工作区沿用组织限额;默认工作区不能单独设限;即使各工作区限额加起来超过组织限额,组织级限额依然生效。
- 执行方式:官方采用令牌桶算法,额度是持续回补的,不是每分钟整点清零;每分钟的数字也可能按更短的时间间隔执行。升档带来的是更高的限额,页面描述的执行方式本身不变。
- 限额是上限,不是保证:官方页面明确写着,所有限额代表的是允许的最大用量,而不是保证能拿到的最低用量。
如果你是通过 ROIBest AI 这类网关而不是直连 Anthropic 来调用 Claude,需要注意网关有自己的一套额度模型,建议拿它的限额和你上面梳理出的等级需求做对比。
常见问题
Anthropic 的 Tier 1 到 Tier 4 在官方页面哪里?
撰写本文时,官方 Rate limits 页面不使用数字编号,列出的是 Evaluation、Start、Build、Scale、Custom。其他来源里的数字编号等级及其限额,请对照官方页面核实。
怎么升到更高的 Anthropic 使用等级?
Anthropic 会根据使用历史和账户状况自动调整等级。想更快提高,可以在 Console 的 Rate limits 页面申请提额;需要超过 Scale 档时联系销售。
自己设置消费限额会改变等级吗?
不会。自设的消费限额不能超过当前等级的上限,达到后返回 HTTP 400,调高或取消这个限额即可恢复。
Anthropic 的等级限额是按 API Key 计算的吗?
不是,限额按组织计算。你可以给单个工作区设置更低的限额,但组织级限额始终生效。