跳至内容

详解 Claude Code 使用限制:工作原理与避免触顶的方法

了解 Claude Code 的使用限制实际如何运作、是什么在默默消耗您的配额,以及在升级方案前您可以采取哪些切实步骤来延长可用容量。
更新 2026年7月21日  · 12分钟

用 AI 探索

在 ChatGPT 中打开在 Claude 中打开在 Perplexity 中打开

您正埋头进行一次重构,Claude Code 也在稳步推进,结果却突然不再响应。没有崩溃、没有报错,只是提示您已达到使用上限。大多数用户以为这是因为提示发多了。实际上,提示词只是整体的一小部分。我自己也遇通过这个问题,并花了一段时间才完全弄明白。

Claude Code 的限制体系由滚动会话窗口、每周上限、特定模型额度,以及随每次请求发送的大量背景上下文共同决定。规则文件、MCP 工具定义、内存文件和对话历史等内容,可能在您几乎还没怎么打字前,就已消耗掉您可用额度中的很大一部分。

本指南将解释 Claude Code 的使用限制如何运作、如何查看您的当前用量,以及那些常常让开发者比预期更早触顶的隐藏开销来源。

如果您是 Claude Code 新手,建议先查看我们的Claude Code 教程,或参加 Claude Code 101 课程。

什么是 Claude Code 的使用限制?

Claude Code 的使用受两个相互重叠的系统约束:

  • 5 小时滚动会话窗口
  • 一个或多个每周使用上限

触发其中任意一个,都会导致限速。

5 小时滚动窗口

最显著的 Claude Code 限速机制是 5 小时滚动窗口。您的窗口从您发送第一个提示开始。接下来五小时内的所有操作都从同一用量池中扣减。该用量池在 Claude Code 与 Claude 聊天之间共享,也就是说一方的活动会影响另一方。

例如:

  • 首次提示:上午 9:00
  • 窗口结束:下午 2:00

如果您在 10:30 前用尽可用额度,访问将暂停,直到 2:00 窗口重置。

一个常见误解是开启新对话会重置用量。并不会。/clear 命令只会开启新的对话上下文,并不会恢复用量额度或重置 5 小时计时器。

每周限制

除了计时的会话限制外,Claude Code 还会强制执行每周限制。即使您当前会话仍有余量,一旦触达每周上限,也会暂时阻止进一步使用,直到每周重置发生。

可以这样理解:5 小时上限限制的是您使用的时间节奏,而每周上限限制的是您使用的总量。

这意味着,即使您当前 5 小时会话中仍有容量,仍可能因为已用尽每周额度而被阻止。对于大多数 Pro 用户,这一区别相对直观。而 Max 方案会引入额外的复杂性。

Max 用户的 Sonnet 每周限制

Anthropic 目前对 Max 方案实行以下限制:

  • 涵盖所有模型的每周限制
  • 专门针对 Sonnet 使用的单独每周限制

这一区分很重要,因为即使您已用尽更广泛模型分配,仍可能还有 Sonnet 的可用容量,反之亦然。

例如,假设您这周大部分时间都在用 Sonnet 做实现类工作。您可能会先耗尽 Sonnet 特定的每周配额,而整体每周额度仍有剩余。此时,您可能需要切换到其他模型、等待 Sonnet 重置,或根据剩余额度升级方案。

反过来也可能发生。如果您在整周大量使用 Opus,可能会先触达整体每周上限,即使 Sonnet 特定配额尚未完全消耗完。由于整体上限是总括性上限,一旦触达,无论 Sonnet 还剩多少容量,都将无法继续使用。

要使 Sonnet 请求成功,必须同时满足以下条件:

  • 整体每周上限仍有空间。
  • Sonnet 每周上限仍有空间。

另一方面,Opus 请求只会消耗整体每周池,因为没有单独的 Opus 特定配额。这就是为什么 Claude.ai 的“用量”页面很重要。它会分别显示每个每周限制及其重置时间,便于您在长时间编码会话前更清楚地了解自己接近哪一个上限。

Claude Code 使用限制架构

按方案划分的 Claude Code 用量

比较方案的一大挑战在于,Anthropic 不再公布简单的“提示次数”。

取而代之的是用相对容量倍数来描述各方案。这些倍数反映相对于 Pro 方案基线您所获得的使用容量。要得到精确数值并不容易;有些用户会按百分比追踪自己的用量,以大致了解每消耗多少容量百分比用了多少 token。

方案

月费

相对容量

每周限制

与 Claude Chat 共享

Pro

$20

基线

Max 5x

$100

Pro 容量的 5 倍

Max 20x

$200

Pro 容量的 20 倍

Team

不定

更高的共享配额

Enterprise

定制

按组织定制

2026 年 5 月用量限制变更

Anthropic 于 2026 年 5 月扩充了 Claude Code 容量,将订阅使用上限翻倍,并取消了此前在高峰时段对 Pro 和 Max 订阅者的降配。由于实际使用取决于模型选择、上下文大小和工具使用情况,Anthropic 现在以相对容量倍数来表达方案差异,而非公布固定的提示次数。

自那以后,Anthropic 偶尔会通过临时促销调整每周上限。例如,在推出 Claude Fable 5 期间,符合条件的订阅者其每周 Claude Code 上限提高了 50%。由于这些促销提升是临时性的,读者在规划长时间工作负载前,应始终在 Claude 的“用量”面板中核实最新上限。

Agent SDK 额度(2026 年 6 月)

将交互式编码会话与自动化代理工作负载分离的计划在 2026 年 6 月带来了一些困惑。

在 6 月 15 日之前,所有 Claude Code 活动都来自同一订阅池。无论您是在终端中交互聊天、运行 GitHub Action,还是在 CI 流水线中调用 claude -p,一切都竞争同一个 5 小时和每周上限。

Anthropic 原计划在 2026 年 6 月 15 日开始分离这些工作负载,但在发布当天暂停了该变更。这意味着交互式用量与编程式用量(Agent SDK、claude -p、GitHub Actions)仍与以往一样,来自同一订阅池。

截至 2026 年 7 月,尚无独立的 Agent SDK 实时额度,也没有可申领的自选额度。

到底是什么在消耗您的配额?

许多开发者关注提示次数和 token 调优。真正的罪魁祸首往往是上下文。每次交互所包含的信息都远多于您输入的问题。

CLAUDE.md 与规则文件

Claude Code 会自动从以下位置加载指令:

  • CLAUDE.md

  • 父目录中的 CLAUDE.md 文件

  • 导入的 @ 引用

  • .claude/rules/*.md 文件

所有这些上下文和附加指令都会被反复包含在请求中。这意味着臃肿的规则文件会在整个会话过程中无声地增加 token 消耗。Anthropic 建议将单个 CLAUDE.md 文件控制在大约 200 行以内。

对于较大的项目,考虑将指令拆分为带路径 frontmatter 的作用域化规则,仅在相关时加载。若想深入了解,我们的CLAUDE.md 最佳写作指南介绍了高效的组织策略。

MCP 工具定义

Model Context Protocol(MCP)服务器是另一处隐藏开销。每个已连接的 MCP 服务器都会将工具模式注入到 Claude 的上下文,即使您从未使用这些工具。

设想:

  • 5 个 MCP 服务器
  • 每个服务器 10 个工具

这就是每次请求都要包含的 50 份工具定义。断开未使用的 MCP 服务器,是减少 Claude Code token 消耗的最简单方法之一。

一个重要注意事项:避免在活动会话期间添加或移除 MCP 服务器。这样会使提示缓存前缀失效,并可能增加用量成本。

自动内存

自 Claude Code v2.1.59 起,自动内存默认启用。内存是 Claude 在不同会话中保存的全局知识,为其提供更多上下文,范围可能从从数据库提取数据的方法到实现过的技术细节不等。

启动时,Claude 会从 MEMORY.md 加载内容,上限为:

  • 前 200 行
  • 前 25 KB

对某些工作流程很有用,对另一些则只是额外上下文。

您可以通过几种方式禁用自动内存。若需要一个覆盖所有其他设置的永久“总开关”(适用于 CI 流水线和自动化环境),可在 shell 中设置环境变量:

export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1

或者,将以下内容添加到您的 settings.json。在 ~/.claude/settings.json 中添加可在所有项目中禁用;在 .claude/settings.json 中添加可仅对单个项目禁用:

{ "autoMemoryEnabled": false }

如果您并不主动使用内存文件,禁用该功能可以缩小基线上下文大小。

对话历史与搜索

对话历史会持续增长。每次工具结果、文件读取、grep 输出、终端命令和代码搜索,都会成为会话上下文的一部分。

以我的经验,代码库探索往往是最大的贡献者。Claude 可能会读取数十个文件只为找到某个函数。这些文件会继续保留在上下文中,为后续轮次持续增加 token 开销。

对于自动化工作流程,claude -p --bare 可以通过剥离不必要的会话上下文来减少大量固定开销。这能节省许多本会被 Claude 文件搜索耗尽的每月 Agent SDK 额度。

如何查看您的 Claude Code 用量

查看用量的最佳时机是在长时间编码会话开始之前。这样,您可以在真正开始编码前了解自己距离上限还有多近。

使用 /usage

在 Claude Code 中输入 /usage 会显示:

  • 会话消耗
  • 每周消耗
  • 剩余额度

这能帮助您概览交互式会话中还剩多少配额,从而提前规划。在即将触顶前启动庞大复杂的任务可能并不明智,但像文件清理这类简单任务或许就是用掉剩余额度的好选择。

使用 /status

您也可以运行 /status,它会提供以下信息:

  • 当前方案
  • 账户信息
  • 当前使用状态

了解您的方案和活动状态有助于您认识潜在限制。使用量是基线的 5 倍还是 20 倍,差别很大。

查看 Claude 面板

最完整的视图位于 SettingsUsage,位于 Claude.ai

Claude.ai 上的 Claude 用量面板

该面板整合了:

  • Claude 聊天用量
  • Claude Code 用量
  • 每周重置计划
  • 特定模型限制

由于可能同时存在多个限制,该面板应被视为权威信息来源。一个实用的习惯是:在开始大型重构、长时间调试或自主编码任务前检查用量。

如何最大化利用您的 Claude Code 限额

我们来谈谈如何在不升级方案的情况下延长使用上限。有时,仅靠减少开销,就能大幅提高有效容量。

精简您的 CLAUDE.md

将每个文件控制在 200 行以内,以尽量减少发送的上下文量,并降低对智能体的干扰。可以重点清理:

  • 过时的项目说明
  • 历史性备注
  • 应放在单次提示中的规则

如果某些指令只对特定目录生效,请在 frontmatter 中使用 paths 定义作用域规则,这样并非所有规则都会被持续使用,只在特定路径下启用。您也可以使用项目级的 CLAUDE.md 文件,而不是全局文件。

审计您的 MCP 服务器

只保留您正在使用的 MCP 服务器。每个已连接的服务器都会为每次交互增加模式开销。把 MCP 配置当成浏览器标签页处理:暂时不用就关掉。

一个不错的做法是在项目级安装 MCP 服务器——当您知道只有某些项目才需要特定 MCP 时,而不是在用户级安装。这样,Claude 不会在每个项目或每个会话都尝试加载它们,只在特定用例需要时加载。

尽早使用 /compact

/compact 命令会总结对话历史,降低后续的 token 成本。通过减少每轮处理的上下文增长,我们就能降低额度消耗。

虽然它无法恢复已消耗的额度,但在会话变得过大之前使用 /compact 会很有帮助。

将模型与任务匹配

并非所有任务都需要 Opus 或 Fable。有时,使用更小的模型或更巧妙的模型搭配即可更好地管理额度。将高阶模型保留给高价值工作,往往能显著增加您的可用容量。

以下是一些模型优化策略:

  • 用 Opus 处理架构决策、复杂推理和不明确需求
  • Sonnet 适合编辑、搜索和实现类工作
  • Haiku 用于轻量任务和快速阅读

但请避免在会话中频繁更换模型。提示缓存是针对模型的,每次切换都会迫使新模型从头以完整 token 成本重新处理整个对话历史,而不是从缓存中低成本读取。即便您切换到“更便宜”的模型,这也可能比不切换更快地耗尽额度。

触顶时的应对:改用 API

如果订阅额度成为瓶颈,Claude API 是一种替代方案。API 使用不受 5 小时会话窗口或每周订阅上限的限制,而是按 token 消耗计费。

这种计费模式通常适用于:

  • CI 流水线
  • 长时间运行的自主代理
  • 大规模自动化
  • 预算可预测的生产工作流

需要留意的一点是:不要在 Claude Code 的 shell 中遗留 ANTHROPIC_API_KEY 环境变量。如果该密钥存在于您的环境中,Claude Code 可能会通过 API 身份验证,而非您的订阅账户。

这会导致意外的 API 费用,因为您不再使用订阅限额,而是按 token 支付。每当成本看起来异常时,检查身份验证设置应是排查问题的首要步骤之一。

有关当前模型定价,请始终参考 Anthropic 的官方定价文档,因为费率经常变更,且因模型而异。

总结

一旦您明白限制并非简单按提示次数计数,Claude Code 的使用上限就更容易管理。

该系统结合了:

  • 5 小时滚动窗口
  • 每周上限
  • 特定模型额度
  • 上下文开销

令许多开发者意外的是,提示词往往只占总 token 使用量的一小部分。大型 CLAUDE.md 文件、MCP 工具定义、自动内存、代码库搜索以及不断增长的对话历史,常常比问题本身更消耗容量。

在实践中,大多数异常快速触顶的用户,问题在于配置,而非容量。在升级方案之前,不如先通过清理上下文来减少开销,而不是购买更大配额。

若想继续优化您的工作流,建议阅读我们的Claude Code 最佳实践指南,以及Claude Code Hooks 教程,它们都介绍了在长时间开发会话中提升 Claude Code 效率与稳健性的技巧。

Claude Code 使用限制常见问答

什么是 Claude Code 的使用限制?

Claude Code 的使用限制包括 5 小时滚动会话窗口和一个或多个每周使用上限。Claude Code 与 Claude 聊天共享同一订阅用量池。

如何查看 Claude Code 用量?

您可以在 Claude Code 中使用 /usage 查看用量,使用 /status 查看账户详情,或在 Claude.ai 的“SettingsUsage”面板查看。

哪些内容最消耗 Claude Code 的 tokens?

常见的隐藏消耗包括大型 CLAUDE.md 文件、MCP 工具模式、自动内存、对话历史、工具输出以及代码库搜索结果。

如何降低 Claude Code 的 token 消耗?

最佳实践包括保持 CLAUDE.md 文件简洁,禁用未使用的 MCP 服务器,主动使用 /compact移除不必要的内存文件,将模型与任务复杂度匹配,以及避免过度的全仓库搜索。

Agent SDK 额度系统是否已上线?

没有。Anthropic 原计划自 2026 年 6 月 15 日起将编程式用量与交互式 Claude 用量分离,但在发布当天暂停了该变更,并表示“目前暂无变化”。Claude Agent SDK、claude -p、Claude Code GitHub Actions,以及第三方 Agent SDK 应用目前仍与交互式 Claude Code 共用同一订阅用量限制。

主题

在 DataCamp 学习 Claude Code!

Courses

Software Development with Claude Code

4小时
5.1K
Claude Code brings AI assistance to your terminal. Learn the workflows that turn it into a reliable tool for real software development.
查看详情Right Arrow
开始课程
查看更多Right Arrow