Curso
Você está no meio de um refactor, o Claude Code está avançando bem e, de repente, ele para de responder. Sem travar. Sem erro. Só aparece uma mensagem dizendo que você atingiu um limite de uso. A maioria das pessoas acha que isso acontece porque enviou prompts demais. Na prática, o prompt é só uma parte pequena da história. Eu mesmo já passei por isso e demorei para entender de verdade.
O sistema de limites do Claude Code combina janelas de sessão rolantes, tetos semanais, permissões específicas por modelo e um contexto de fundo pesado em tokens que vai junto em cada requisição. Itens como arquivos de regras, definições de ferramentas MCP, arquivos de memória e o histórico da conversa podem consumir uma parte grande da sua capacidade disponível antes mesmo de você digitar muita coisa.
Neste guia, vou explicar como funcionam os limites de uso do Claude Code, como conferir seu consumo atual e as fontes ocultas de sobrecarga que fazem muitos desenvolvedores baterem no limite antes do esperado.
Se você está começando com o Claude Code, recomendo ver primeiro nosso tutorial do Claude Code ou fazer o curso Claude Code 101.
Introdução aos Modelos Claude
O que são os limites de uso do Claude Code?
O uso do Claude Code é regido por dois sistemas sobrepostos:
- Uma janela de sessão rolante de 5 horas
- Um ou mais tetos semanais de uso
Atingir qualquer um deles leva ao rate limiting.
A janela rolante de 5 horas
O limite mais visível do Claude Code é a janela rolante de 5 horas. Sua janela começa quando você envia o primeiro prompt. Tudo o que você fizer nas próximas cinco horas consome do mesmo pool de uso. Esse pool é compartilhado entre o Claude Code e o chat do Claude, então a atividade em um impacta o outro.
Por exemplo:
- Primeiro prompt: 9h00
- Janela termina: 14h00
Se você esgotar seu uso disponível às 10h30, o acesso pausa até a janela se resetar às 14h00.
Um engano comum é achar que iniciar uma nova conversa reseta o uso. Não reseta. O comando /clear só começa um novo contexto de conversa. Ele não restaura a franquia de uso nem reinicia o cronômetro de 5 horas.
Limites semanais
Além das limitações por tempo de sessão, o Claude Code também aplica limites semanais. Mesmo que ainda haja espaço na sua sessão atual, atingir um teto semanal pode impedir o uso até ocorrer o reset semanal.
Pense assim: o limite de 5 horas restringe o momento em que você usa, e o limite semanal limita o volume total de uso.
Isso significa que dá para ter capacidade restante na sessão de 5 horas e, ainda assim, ficar bloqueado porque a sua franquia semanal acabou. Para a maioria dos usuários Pro, essa distinção é simples. Já os planos Max trazem uma camada extra de complexidade.
Limite semanal de Sonnet para usuários Max
A Anthropic atualmente aplica o seguinte para planos Max:
- Um limite semanal cobrindo todos os modelos
- Um limite semanal separado especificamente para uso do Sonnet
Essa distinção importa porque você pode ainda ter capacidade de Sonnet mesmo depois de esgotar a alocação geral de modelos, ou o contrário.
Por exemplo, imagine que você passa a maior parte da semana usando Sonnet para implementação. Você pode esgotar a alocação semanal específica do Sonnet e ainda ter capacidade restante na franquia semanal geral. Nesse ponto, talvez seja preciso trocar de modelo, esperar o reset do Sonnet ou fazer upgrade do plano, dependendo do que restar.
O inverso também pode acontecer. Se você usou bastante o Opus ao longo da semana, pode atingir o limite semanal geral mesmo sem ter consumido toda a alocação específica do Sonnet. Como o limite geral é o guarda-chuva, atingi-lo impede o uso independentemente de quanta capacidade de Sonnet ainda exista.
Para que requisições com Sonnet tenham sucesso, ambas as condições precisam ser verdadeiras:
- Você ainda tem espaço no limite semanal geral.
- Você ainda tem espaço no limite semanal do Sonnet.
Requisições com Opus, por sua vez, consomem apenas o pool semanal geral, pois não há uma franquia separada específica de Opus. Por isso a página de Usage no Claude.ai é tão importante. Ela mostra cada limite semanal de forma independente, com o horário de reset, facilitando entender qual limite você está prestes a alcançar antes de uma longa sessão de codificação.

Uso do Claude Code por plano
Um desafio ao comparar planos é que a Anthropic não publica mais "contagem de prompts" simples.
Em vez disso, os planos são descritos por multiplicadores relativos de capacidade. Eles refletem a capacidade de uso que você recebe em relação ao baseline do plano Pro. Não é simples obter números exatos; alguns usuários monitoram o uso como porcentagem para ter uma boa noção de quantos tokens usaram por ponto percentual de capacidade.
|
Plano |
Preço mensal |
Capacidade relativa |
Limites semanais |
Compartilhado com o chat do Claude |
|
Pro |
$20 |
Baseline |
Sim |
Sim |
|
Max 5x |
$100 |
5× a capacidade do Pro |
Sim |
Sim |
|
Max 20x |
$200 |
20× a capacidade do Pro |
Sim |
Sim |
|
Team |
Varia |
Alocação compartilhada maior |
Sim |
Sim |
|
Enterprise |
Sob medida |
Específica da organização |
Sim |
Sim |
Mudanças nos limites de uso em maio de 2026
A Anthropic ampliou a capacidade do Claude Code em maio de 2026, dobrando os limites de uso da assinatura e removendo as reduções em horário de pico que antes afetavam assinantes Pro e Max. Em vez de publicar contagens fixas de prompts, a Anthropic agora apresenta as diferenças entre planos como multiplicadores relativos de capacidade, pois o uso real depende do modelo escolhido, do tamanho de contexto e do uso de ferramentas.
Desde então, a Anthropic ocasionalmente ajustou limites semanais por meio de promoções temporárias. Por exemplo, durante o lançamento do Claude Fable 5, os limites semanais do Claude Code foram aumentados em 50% para assinantes elegíveis. Como esses aumentos promocionais são temporários, sempre verifique os limites mais recentes no painel Claude Usage antes de planejar workloads de longa duração.
Créditos do Agent SDK (junho de 2026)
O plano de separar sessões interativas de codificação de workloads automatizados de agentes gerou alguma confusão em junho de 2026.
Antes de 15 de junho, toda a atividade do Claude Code consumia do mesmo pool da assinatura. Não importava se você estava conversando interativamente no terminal, rodando um GitHub Action ou chamando claude -p dentro de um pipeline de CI: tudo competia pelos mesmos limites de 5 horas e semanais.
A Anthropic planejava começar a separar esses workloads em 15 de junho de 2026, mas pausou a mudança no próprio dia do lançamento. Isso significa que o uso interativo e o programático (Agent SDK, claude -p, GitHub Actions) continuam consumindo do mesmo pool da assinatura, como antes.
Em julho de 2026, não há crédito separado ativo para o Agent SDK e não há crédito opcional para resgate.
O que realmente drena sua cota?
Muitos desenvolvedores focam em prompts e ajuste de tokens. O verdadeiro vilão costuma ser o contexto. Cada interação carrega muito mais informação do que a pergunta que você digitou.
CLAUDE.md e arquivos de regras
O Claude Code carrega instruções automaticamente de:
-
CLAUDE.md -
Arquivos
CLAUDE.mddo diretório pai -
Referências importadas com
@ -
Arquivos
.claude/rules/*.md
Todo esse contexto e instruções extras são incluídos repetidamente nas requisições. Isso significa que um arquivo de regras inchado aumenta silenciosamente o consumo de tokens durante toda a sessão. A Anthropic recomenda manter arquivos CLAUDE.md individuais com cerca de 200 linhas no máximo.
Em projetos maiores, considere dividir instruções em regras com escopo, usando frontmatter de paths para que só sejam carregadas quando relevantes. Se quiser se aprofundar, nosso guia para escrever o melhor CLAUDE.md traz estratégias eficazes de organização.
Definições de ferramentas MCP
Servidores do Model Context Protocol (MCP) são outra fonte oculta de sobrecarga. Cada servidor MCP conectado injeta schemas de ferramentas no contexto do Claude, mesmo que você nunca use essas ferramentas.
Imagine:
- 5 servidores MCP
- 10 ferramentas por servidor
São 50 definições de ferramenta incluídas em cada requisição. Desconectar servidores MCP que você não usa é uma das formas mais fáceis de reduzir o consumo de tokens do Claude Code.
Um alerta importante: evite adicionar ou remover servidores MCP durante uma sessão ativa. Isso invalida prefixos do cache de prompts e pode aumentar os custos de uso.
Memória automática
Desde o Claude Code v2.1.59, a memória automática vem ativada por padrão. A memória é conhecimento global que o Claude salva entre sessões, dando mais contexto. Isso pode ir de métodos para buscar dados em um banco até detalhes técnicos já implementados.
Na inicialização, o Claude carrega conteúdo do MEMORY.md, até:
- As primeiras 200 linhas
- Os primeiros 25 KB
Para alguns fluxos, isso é útil. Para outros, é só contexto extra.
Você pode desativar a memória automática de algumas formas. Para um kill switch permanente que substitui todas as outras configurações (útil em pipelines de CI e ambientes automatizados), defina a variável de ambiente no seu shell:
export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1
Como alternativa, adicione o seguinte ao seu settings.json. Use ~/.claude/settings.json para desativar em todos os projetos, ou .claude/settings.json para um único projeto:
{ "autoMemoryEnabled": false }
Se você não usa ativamente arquivos de memória, desativar esse recurso pode reduzir o tamanho do contexto base.
Histórico da conversa e buscas
O histórico da conversa cresce continuamente. Todo resultado de ferramenta, leitura de arquivo, saída de grep, comando de terminal e busca no código vira parte do contexto da sessão.
Na minha experiência, a exploração do repositório costuma ser o maior vilão. O Claude pode ler dezenas de arquivos para achar uma única função. Esses arquivos permanecem no contexto e continuam gerando sobrecarga de tokens nos próximos turnos.
Para fluxos automatizados, o claude -p --bare pode reduzir boa parte dessa sobrecarga fixa ao remover contexto de sessão desnecessário. Isso pode economizar muitos créditos mensais do Agent SDK que, de outro modo, seriam queimados com o Claude vasculhando arquivos.
Como verificar seu uso no Claude Code
O melhor momento para conferir seu uso é antes de uma longa sessão de codificação. Assim você já sabe o quão perto está de bater nos limites antes de começar a trabalhar.
Usando /usage
Dentro do Claude Code, digitar /usage mostra:
- Consumo da sessão
- Consumo semanal
- Alocação restante
É uma ótima forma de ver quanto de cota ainda resta na sua sessão interativa para planejar melhor. Tentar começar uma tarefa complexa bem na hora de bater no limite talvez não seja uma boa; já tarefas simples, como limpeza de arquivos, podem ser um bom uso da cota restante.
Usando /status
Você também pode rodar /status, que traz as seguintes informações:
- Plano atual
- Informações da conta
- Estado ativo de uso
Saber seu plano e o estado ativo ajuda a entender limitações potenciais. Faz diferença se seu uso é 5x ou 20x o baseline.
Conferindo o painel do Claude
A visão mais completa fica em Settings → Usage no Claude.ai.

Esse painel combina:
- Uso do chat do Claude
- Uso do Claude Code
- Cronogramas de reset semanal
- Limites específicos por modelo
Como vários limites podem existir ao mesmo tempo, trate esse painel como a fonte da verdade. Um bom hábito prático é checar o uso antes de iniciar refactors grandes, longas sessões de debug ou tarefas autônomas de codificação.
Como aproveitar ao máximo seus limites do Claude Code
Vamos falar de como estender seus limites de uso sem fazer upgrade de plano. Muitas vezes, dá para ganhar eficiência só reduzindo a sobrecarga.
Enxugue seu CLAUDE.md
Busque ficar abaixo de 200 linhas por arquivo para minimizar o contexto enviado e evitar confundir o agente. Procure por:
- Instruções de projeto desatualizadas
- Anotações históricas
- Regras que fazem mais sentido em prompts individuais
Se instruções só importam para diretórios específicos, use regras com escopo e frontmatter paths, para que nem todas as regras sejam usadas o tempo todo, apenas nos caminhos relevantes. Você também pode ter arquivos CLAUDE.md por projeto, em vez de um global.
Audite seus servidores MCP
Mantenha apenas os servidores MCP que você realmente está usando. Cada servidor conectado adiciona sobrecarga de schema a toda interação. Trate sua configuração MCP como abas do navegador: se não está usando agora, feche.
Uma boa forma de gerenciar MCPs é instalá-los no nível do projeto quando você sabe que precisa de certos MCPs apenas para projetos específicos, em vez de no nível do usuário. Assim, o Claude não tenta carregá-los em todo projeto ou sessão, só quando necessário para aquele caso de uso.
Use /compact cedo
O comando /compact resume o histórico da conversa e reduz os custos de tokens nas próximas interações. Ao frear o crescimento de contexto processado a cada turno, reduzimos o consumo de cota.
Embora ele não recupere a cota já consumida, pode ajudar se você usar o /compact antes da sessão ficar grande demais.
Combine o modelo com a tarefa
Nem toda tarefa precisa de Opus ou Fable. Às vezes, modelos menores ou um uso mais estratégico ajudam a administrar a cota. Você frequentemente aumenta bastante sua capacidade disponível reservando os modelos premium para trabalhos de alto valor.
Algumas estratégias de otimização de modelo:
- Use Opus para decisões de arquitetura, raciocínio complexo e requisitos ambíguos
- Sonnet para edição, busca e trabalho de implementação
- Haiku para tarefas leves e leituras rápidas
Mas evite trocar de modelo repetidamente na mesma sessão. Caches de prompt são específicos do modelo, então cada troca força o novo modelo a reprocessar todo o histórico da conversa do zero com custo cheio de tokens, em vez de ler do cache. Isso pode queimar sua cota mais rápido do que ficar no mesmo modelo, mesmo quando você troca para um modelo teoricamente "mais barato".
Quando bater no limite: fallback para API
Se os limites da assinatura virarem gargalo, a API do Claude é uma alternativa. O uso via API não te limita a janelas de 5 horas nem a tetos semanais da assinatura. Em vez disso, você paga pelo consumo de tokens.
Esse modelo costuma fazer sentido para:
- Pipelines de CI
- Agentes autônomos de longa duração
- Automação em larga escala
- Workflows de produção com orçamento previsível
Fique atento a deixar a variável ANTHROPIC_API_KEY configurada no shell do Claude Code. Se essa chave estiver presente no ambiente, o Claude Code pode se autenticar via API em vez da sua conta de assinatura.
Isso pode gerar cobranças inesperadas na API, já que você deixa de usar os limites da assinatura e passa a pagar por tokens. Sempre que os custos parecerem estranhos, conferir as configurações de autenticação deve ser um dos primeiros passos de troubleshooting.
Para preços atuais dos modelos, consulte sempre a documentação oficial de preços da Anthropic, pois as tarifas mudam com frequência e variam por modelo.
Considerações finais
Os limites de uso do Claude Code ficam mais fáceis de gerenciar quando você entende que não se trata apenas de contar prompts.
O sistema combina:
- Uma janela rolante de 5 horas
- Tetos semanais
- Permissões específicas por modelo
- Sobrecarga de contexto
A maior surpresa para muitos desenvolvedores é que os prompts costumam representar minoria no uso total de tokens. Arquivos CLAUDE.md grandes, definições de ferramentas MCP, memória automática, buscas no repositório e o histórico crescente da conversa frequentemente consomem mais capacidade do que as próprias perguntas.
Na prática, quem bate no limite rápido demais normalmente tem um problema de configuração, não de capacidade. Antes de fazer upgrade, reduza a sobrecarga limpando o contexto, em vez de comprar uma cota maior.
Para continuar aprimorando seu fluxo, recomendo nosso guia de boas práticas do Claude Code e o tutorial de Claude Code Hooks, que trazem técnicas para tornar o Claude Code mais eficiente e resiliente em longas sessões de desenvolvimento.
Perguntas frequentes sobre limites de uso do Claude Code
Quais são os limites de uso do Claude Code?
Os limites de uso do Claude Code consistem em uma janela de sessão rolante de 5 horas e um ou mais tetos semanais de uso. Tanto o Claude Code quanto o chat do Claude consomem do mesmo pool de uso da assinatura.
Como verifico o uso do Claude Code?
Você pode conferir o uso com /usage dentro do Claude Code, /status para detalhes da conta, ou no painel Usage do Claude.ai em Settings → Usage.
O que mais consome tokens do Claude Code?
Contribuidores ocultos comuns incluem arquivos CLAUDE.md grandes, schemas de ferramentas MCP, memória automática, histórico da conversa, saídas de ferramentas e resultados de busca no repositório.
Como posso reduzir o consumo de tokens do Claude Code?
Boas práticas incluem manter arquivos CLAUDE.md concisos, desativar servidores MCP não utilizados, usar o /compact proativamente, remover arquivos de memória desnecessários, combinar o modelo com a complexidade da tarefa e evitar buscas excessivas em todo o repositório.
O sistema de créditos do Agent SDK já foi lançado?
Não. A Anthropic planejou separar o uso programático do uso interativo do Claude a partir de 15 de junho de 2026, mas pausou a mudança no próprio dia do lançamento, afirmando que "nada muda por enquanto". Atualmente, o Claude Agent SDK, o claude -p, as GitHub Actions do Claude Code e aplicativos de terceiros do Agent SDK continuam consumindo dos mesmos limites de uso da assinatura do Claude Code interativo.
Sou um cientista de dados com experiência em análise espacial, machine learning e pipelines de dados. Trabalhei com GCP, Hadoop, Hive, Snowflake, Airflow e outros processos de engenharia/ciência de dados.




