Pular para o conteúdo principal

Limites de uso do Claude Code explicados: como funcionam e como evitar estourá-los

Entenda como os limites de uso do Claude Code funcionam, o que consome sua cota silenciosamente e como aumentar sua capacidade disponível antes de fazer upgrade do plano.
Atualizado 21 de jul. de 2026  · 12 min lido

Explorar com IA

Abrir no ChatGPTAbrir no ClaudeAbrir no Perplexity

Você está no meio de um refactor, o Claude Code está avançando bem e, de repente, ele para de responder. Sem travar. Sem erro. Só aparece uma mensagem dizendo que você atingiu um limite de uso. A maioria das pessoas acha que isso acontece porque enviou prompts demais. Na prática, o prompt é só uma parte pequena da história. Eu mesmo já passei por isso e demorei para entender de verdade.

O sistema de limites do Claude Code combina janelas de sessão rolantes, tetos semanais, permissões específicas por modelo e um contexto de fundo pesado em tokens que vai junto em cada requisição. Itens como arquivos de regras, definições de ferramentas MCP, arquivos de memória e o histórico da conversa podem consumir uma parte grande da sua capacidade disponível antes mesmo de você digitar muita coisa.

Neste guia, vou explicar como funcionam os limites de uso do Claude Code, como conferir seu consumo atual e as fontes ocultas de sobrecarga que fazem muitos desenvolvedores baterem no limite antes do esperado.

Se você está começando com o Claude Code, recomendo ver primeiro nosso tutorial do Claude Code ou fazer o curso Claude Code 101.

Introdução aos Modelos Claude

Aprenda a trabalhar com o Claude usando a API da Anthropic para resolver tarefas do mundo real e criar aplicativos com inteligência artificial.
Explore O Curso

O que são os limites de uso do Claude Code?

O uso do Claude Code é regido por dois sistemas sobrepostos:

  • Uma janela de sessão rolante de 5 horas
  • Um ou mais tetos semanais de uso

Atingir qualquer um deles leva ao rate limiting.

A janela rolante de 5 horas

O limite mais visível do Claude Code é a janela rolante de 5 horas. Sua janela começa quando você envia o primeiro prompt. Tudo o que você fizer nas próximas cinco horas consome do mesmo pool de uso. Esse pool é compartilhado entre o Claude Code e o chat do Claude, então a atividade em um impacta o outro.

Por exemplo:

  • Primeiro prompt: 9h00
  • Janela termina: 14h00

Se você esgotar seu uso disponível às 10h30, o acesso pausa até a janela se resetar às 14h00.

Um engano comum é achar que iniciar uma nova conversa reseta o uso. Não reseta. O comando /clear só começa um novo contexto de conversa. Ele não restaura a franquia de uso nem reinicia o cronômetro de 5 horas.

Limites semanais

Além das limitações por tempo de sessão, o Claude Code também aplica limites semanais. Mesmo que ainda haja espaço na sua sessão atual, atingir um teto semanal pode impedir o uso até ocorrer o reset semanal. 

Pense assim: o limite de 5 horas restringe o momento em que você usa, e o limite semanal limita o volume total de uso.

Isso significa que dá para ter capacidade restante na sessão de 5 horas e, ainda assim, ficar bloqueado porque a sua franquia semanal acabou. Para a maioria dos usuários Pro, essa distinção é simples. Já os planos Max trazem uma camada extra de complexidade.

Limite semanal de Sonnet para usuários Max

A Anthropic atualmente aplica o seguinte para planos Max:

  • Um limite semanal cobrindo todos os modelos
  • Um limite semanal separado especificamente para uso do Sonnet

Essa distinção importa porque você pode ainda ter capacidade de Sonnet mesmo depois de esgotar a alocação geral de modelos, ou o contrário. 

Por exemplo, imagine que você passa a maior parte da semana usando Sonnet para implementação. Você pode esgotar a alocação semanal específica do Sonnet e ainda ter capacidade restante na franquia semanal geral. Nesse ponto, talvez seja preciso trocar de modelo, esperar o reset do Sonnet ou fazer upgrade do plano, dependendo do que restar.

O inverso também pode acontecer. Se você usou bastante o Opus ao longo da semana, pode atingir o limite semanal geral mesmo sem ter consumido toda a alocação específica do Sonnet. Como o limite geral é o guarda-chuva, atingi-lo impede o uso independentemente de quanta capacidade de Sonnet ainda exista.

Para que requisições com Sonnet tenham sucesso, ambas as condições precisam ser verdadeiras:

  • Você ainda tem espaço no limite semanal geral.
  • Você ainda tem espaço no limite semanal do Sonnet.

Requisições com Opus, por sua vez, consomem apenas o pool semanal geral, pois não há uma franquia separada específica de Opus. Por isso a página de Usage no Claude.ai é tão importante. Ela mostra cada limite semanal de forma independente, com o horário de reset, facilitando entender qual limite você está prestes a alcançar antes de uma longa sessão de codificação. 

Arquitetura de limites de uso do Claude Code

Uso do Claude Code por plano

Um desafio ao comparar planos é que a Anthropic não publica mais "contagem de prompts" simples.

Em vez disso, os planos são descritos por multiplicadores relativos de capacidade. Eles refletem a capacidade de uso que você recebe em relação ao baseline do plano Pro. Não é simples obter números exatos; alguns usuários monitoram o uso como porcentagem para ter uma boa noção de quantos tokens usaram por ponto percentual de capacidade. 

Plano

Preço mensal

Capacidade relativa

Limites semanais

Compartilhado com o chat do Claude

Pro

$20

Baseline

Sim

Sim

Max 5x

$100

5× a capacidade do Pro

Sim

Sim

Max 20x

$200

20× a capacidade do Pro

Sim

Sim

Team

Varia

Alocação compartilhada maior

Sim

Sim

Enterprise

Sob medida

Específica da organização

Sim

Sim

Mudanças nos limites de uso em maio de 2026

A Anthropic ampliou a capacidade do Claude Code em maio de 2026, dobrando os limites de uso da assinatura e removendo as reduções em horário de pico que antes afetavam assinantes Pro e Max. Em vez de publicar contagens fixas de prompts, a Anthropic agora apresenta as diferenças entre planos como multiplicadores relativos de capacidade, pois o uso real depende do modelo escolhido, do tamanho de contexto e do uso de ferramentas.

Desde então, a Anthropic ocasionalmente ajustou limites semanais por meio de promoções temporárias. Por exemplo, durante o lançamento do Claude Fable 5, os limites semanais do Claude Code foram aumentados em 50% para assinantes elegíveis. Como esses aumentos promocionais são temporários, sempre verifique os limites mais recentes no painel Claude Usage antes de planejar workloads de longa duração.

Créditos do Agent SDK (junho de 2026)

O plano de separar sessões interativas de codificação de workloads automatizados de agentes gerou alguma confusão em junho de 2026.

Antes de 15 de junho, toda a atividade do Claude Code consumia do mesmo pool da assinatura. Não importava se você estava conversando interativamente no terminal, rodando um GitHub Action ou chamando claude -p dentro de um pipeline de CI: tudo competia pelos mesmos limites de 5 horas e semanais.

A Anthropic planejava começar a separar esses workloads em 15 de junho de 2026, mas pausou a mudança no próprio dia do lançamento. Isso significa que o uso interativo e o programático (Agent SDK, claude -p, GitHub Actions) continuam consumindo do mesmo pool da assinatura, como antes.

Em julho de 2026, não há crédito separado ativo para o Agent SDK e não há crédito opcional para resgate.

O que realmente drena sua cota?

Muitos desenvolvedores focam em prompts e ajuste de tokens. O verdadeiro vilão costuma ser o contexto. Cada interação carrega muito mais informação do que a pergunta que você digitou.

CLAUDE.md e arquivos de regras

O Claude Code carrega instruções automaticamente de:

  • CLAUDE.md

  • Arquivos CLAUDE.md do diretório pai

  • Referências importadas com @

  • Arquivos .claude/rules/*.md

Todo esse contexto e instruções extras são incluídos repetidamente nas requisições. Isso significa que um arquivo de regras inchado aumenta silenciosamente o consumo de tokens durante toda a sessão. A Anthropic recomenda manter arquivos CLAUDE.md individuais com cerca de 200 linhas no máximo.

Em projetos maiores, considere dividir instruções em regras com escopo, usando frontmatter de paths para que só sejam carregadas quando relevantes. Se quiser se aprofundar, nosso guia para escrever o melhor CLAUDE.md traz estratégias eficazes de organização.

Definições de ferramentas MCP

Servidores do Model Context Protocol (MCP) são outra fonte oculta de sobrecarga. Cada servidor MCP conectado injeta schemas de ferramentas no contexto do Claude, mesmo que você nunca use essas ferramentas.

Imagine:

  • 5 servidores MCP
  • 10 ferramentas por servidor

São 50 definições de ferramenta incluídas em cada requisição. Desconectar servidores MCP que você não usa é uma das formas mais fáceis de reduzir o consumo de tokens do Claude Code.

Um alerta importante: evite adicionar ou remover servidores MCP durante uma sessão ativa. Isso invalida prefixos do cache de prompts e pode aumentar os custos de uso.

Memória automática

Desde o Claude Code v2.1.59, a memória automática vem ativada por padrão. A memória é conhecimento global que o Claude salva entre sessões, dando mais contexto. Isso pode ir de métodos para buscar dados em um banco até detalhes técnicos já implementados.

Na inicialização, o Claude carrega conteúdo do MEMORY.md, até:

  • As primeiras 200 linhas
  • Os primeiros 25 KB

Para alguns fluxos, isso é útil. Para outros, é só contexto extra.

Você pode desativar a memória automática de algumas formas. Para um kill switch permanente que substitui todas as outras configurações (útil em pipelines de CI e ambientes automatizados), defina a variável de ambiente no seu shell:

export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1

Como alternativa, adicione o seguinte ao seu settings.json. Use ~/.claude/settings.json para desativar em todos os projetos, ou .claude/settings.json para um único projeto:

{ "autoMemoryEnabled": false }

Se você não usa ativamente arquivos de memória, desativar esse recurso pode reduzir o tamanho do contexto base.

Histórico da conversa e buscas

O histórico da conversa cresce continuamente. Todo resultado de ferramenta, leitura de arquivo, saída de grep, comando de terminal e busca no código vira parte do contexto da sessão.

Na minha experiência, a exploração do repositório costuma ser o maior vilão. O Claude pode ler dezenas de arquivos para achar uma única função. Esses arquivos permanecem no contexto e continuam gerando sobrecarga de tokens nos próximos turnos.

Para fluxos automatizados, o claude -p --bare pode reduzir boa parte dessa sobrecarga fixa ao remover contexto de sessão desnecessário. Isso pode economizar muitos créditos mensais do Agent SDK que, de outro modo, seriam queimados com o Claude vasculhando arquivos.

Como verificar seu uso no Claude Code

O melhor momento para conferir seu uso é antes de uma longa sessão de codificação. Assim você já sabe o quão perto está de bater nos limites antes de começar a trabalhar.

Usando /usage

Dentro do Claude Code, digitar /usage mostra:

  • Consumo da sessão
  • Consumo semanal
  • Alocação restante

É uma ótima forma de ver quanto de cota ainda resta na sua sessão interativa para planejar melhor. Tentar começar uma tarefa complexa bem na hora de bater no limite talvez não seja uma boa; já tarefas simples, como limpeza de arquivos, podem ser um bom uso da cota restante.

Usando /status

Você também pode rodar /status, que traz as seguintes informações:

  • Plano atual
  • Informações da conta
  • Estado ativo de uso

Saber seu plano e o estado ativo ajuda a entender limitações potenciais. Faz diferença se seu uso é 5x ou 20x o baseline.

Conferindo o painel do Claude

A visão mais completa fica em SettingsUsage no Claude.ai.

Painel de uso do Claude no claude.ai

Esse painel combina:

  • Uso do chat do Claude
  • Uso do Claude Code
  • Cronogramas de reset semanal
  • Limites específicos por modelo

Como vários limites podem existir ao mesmo tempo, trate esse painel como a fonte da verdade. Um bom hábito prático é checar o uso antes de iniciar refactors grandes, longas sessões de debug ou tarefas autônomas de codificação.

Como aproveitar ao máximo seus limites do Claude Code

Vamos falar de como estender seus limites de uso sem fazer upgrade de plano. Muitas vezes, dá para ganhar eficiência só reduzindo a sobrecarga.

Enxugue seu CLAUDE.md

Busque ficar abaixo de 200 linhas por arquivo para minimizar o contexto enviado e evitar confundir o agente. Procure por:

  • Instruções de projeto desatualizadas
  • Anotações históricas
  • Regras que fazem mais sentido em prompts individuais

Se instruções só importam para diretórios específicos, use regras com escopo e frontmatter paths, para que nem todas as regras sejam usadas o tempo todo, apenas nos caminhos relevantes. Você também pode ter arquivos CLAUDE.md por projeto, em vez de um global.

Audite seus servidores MCP

Mantenha apenas os servidores MCP que você realmente está usando. Cada servidor conectado adiciona sobrecarga de schema a toda interação. Trate sua configuração MCP como abas do navegador: se não está usando agora, feche. 

Uma boa forma de gerenciar MCPs é instalá-los no nível do projeto quando você sabe que precisa de certos MCPs apenas para projetos específicos, em vez de no nível do usuário. Assim, o Claude não tenta carregá-los em todo projeto ou sessão, só quando necessário para aquele caso de uso.

Use /compact cedo

O comando /compact resume o histórico da conversa e reduz os custos de tokens nas próximas interações. Ao frear o crescimento de contexto processado a cada turno, reduzimos o consumo de cota. 

Embora ele não recupere a cota já consumida, pode ajudar se você usar o /compact antes da sessão ficar grande demais. 

Combine o modelo com a tarefa

Nem toda tarefa precisa de Opus ou Fable. Às vezes, modelos menores ou um uso mais estratégico ajudam a administrar a cota. Você frequentemente aumenta bastante sua capacidade disponível reservando os modelos premium para trabalhos de alto valor. 

Algumas estratégias de otimização de modelo:

  • Use Opus para decisões de arquitetura, raciocínio complexo e requisitos ambíguos
  • Sonnet para edição, busca e trabalho de implementação
  • Haiku para tarefas leves e leituras rápidas

Mas evite trocar de modelo repetidamente na mesma sessão. Caches de prompt são específicos do modelo, então cada troca força o novo modelo a reprocessar todo o histórico da conversa do zero com custo cheio de tokens, em vez de ler do cache. Isso pode queimar sua cota mais rápido do que ficar no mesmo modelo, mesmo quando você troca para um modelo teoricamente "mais barato".

Quando bater no limite: fallback para API

Se os limites da assinatura virarem gargalo, a API do Claude é uma alternativa. O uso via API não te limita a janelas de 5 horas nem a tetos semanais da assinatura. Em vez disso, você paga pelo consumo de tokens.

Esse modelo costuma fazer sentido para:

  • Pipelines de CI
  • Agentes autônomos de longa duração
  • Automação em larga escala
  • Workflows de produção com orçamento previsível

Fique atento a deixar a variável ANTHROPIC_API_KEY configurada no shell do Claude Code. Se essa chave estiver presente no ambiente, o Claude Code pode se autenticar via API em vez da sua conta de assinatura.

Isso pode gerar cobranças inesperadas na API, já que você deixa de usar os limites da assinatura e passa a pagar por tokens. Sempre que os custos parecerem estranhos, conferir as configurações de autenticação deve ser um dos primeiros passos de troubleshooting.

Para preços atuais dos modelos, consulte sempre a documentação oficial de preços da Anthropic, pois as tarifas mudam com frequência e variam por modelo.

Considerações finais

Os limites de uso do Claude Code ficam mais fáceis de gerenciar quando você entende que não se trata apenas de contar prompts.

O sistema combina:

  • Uma janela rolante de 5 horas
  • Tetos semanais
  • Permissões específicas por modelo
  • Sobrecarga de contexto

A maior surpresa para muitos desenvolvedores é que os prompts costumam representar minoria no uso total de tokens. Arquivos CLAUDE.md grandes, definições de ferramentas MCP, memória automática, buscas no repositório e o histórico crescente da conversa frequentemente consomem mais capacidade do que as próprias perguntas.

Na prática, quem bate no limite rápido demais normalmente tem um problema de configuração, não de capacidade. Antes de fazer upgrade, reduza a sobrecarga limpando o contexto, em vez de comprar uma cota maior.

Para continuar aprimorando seu fluxo, recomendo nosso guia de boas práticas do Claude Code e o tutorial de Claude Code Hooks, que trazem técnicas para tornar o Claude Code mais eficiente e resiliente em longas sessões de desenvolvimento.

Perguntas frequentes sobre limites de uso do Claude Code

Quais são os limites de uso do Claude Code?

Os limites de uso do Claude Code consistem em uma janela de sessão rolante de 5 horas e um ou mais tetos semanais de uso. Tanto o Claude Code quanto o chat do Claude consomem do mesmo pool de uso da assinatura.

Como verifico o uso do Claude Code?

Você pode conferir o uso com /usage dentro do Claude Code, /status para detalhes da conta, ou no painel Usage do Claude.ai em SettingsUsage.

O que mais consome tokens do Claude Code?

Contribuidores ocultos comuns incluem arquivos CLAUDE.md grandes, schemas de ferramentas MCP, memória automática, histórico da conversa, saídas de ferramentas e resultados de busca no repositório.

Como posso reduzir o consumo de tokens do Claude Code?

Boas práticas incluem manter arquivos CLAUDE.md concisos, desativar servidores MCP não utilizados, usar o /compact proativamente, remover arquivos de memória desnecessários, combinar o modelo com a complexidade da tarefa e evitar buscas excessivas em todo o repositório.

O sistema de créditos do Agent SDK já foi lançado?

Não. A Anthropic planejou separar o uso programático do uso interativo do Claude a partir de 15 de junho de 2026, mas pausou a mudança no próprio dia do lançamento, afirmando que "nada muda por enquanto". Atualmente, o Claude Agent SDK, o claude -p, as GitHub Actions do Claude Code e aplicativos de terceiros do Agent SDK continuam consumindo dos mesmos limites de uso da assinatura do Claude Code interativo.


Tim Lu's photo
Author
Tim Lu
LinkedIn

Sou um cientista de dados com experiência em análise espacial, machine learning e pipelines de dados. Trabalhei com GCP, Hadoop, Hive, Snowflake, Airflow e outros processos de engenharia/ciência de dados.

Tópicos

Aprenda a usar o Claude Code com a DataCamp!

Curso

Software Development with Claude Code

4 h
5.1K
Claude Code brings AI assistance to your terminal. Learn the workflows that turn it into a reliable tool for real software development.
Ver detalhesRight Arrow
Iniciar Curso
Ver maisRight Arrow
Relacionado
An avian AI exits its cage

blog

12 Alternativas de código aberto ao GPT-4

GPT-4 alternativas de código aberto que podem oferecer desempenho semelhante e exigem menos recursos computacionais para serem executadas. Esses projetos vêm com instruções, fontes de código, pesos de modelos, conjuntos de dados e interface de usuário do chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

Tutorial

Primeiros passos com o Claude 3 e a API do Claude 3

Saiba mais sobre os modelos Claude 3, benchmarks de desempenho detalhados e como acessá-los. Além disso, descubra a nova API Python do Claude 3 para geração de texto, acesso a recursos de visão e streaming.
Abid Ali Awan's photo

Abid Ali Awan

Tutorial

Tutorial da API de assistentes da OpenAI

Uma visão geral abrangente da API Assistants com nosso artigo, que oferece uma análise aprofundada de seus recursos, usos no setor, orientação de configuração e práticas recomendadas para maximizar seu potencial em vários aplicativos de negócios.
Zoumana Keita 's photo

Zoumana Keita

Tutorial

DCLM-7B da Apple: Configuração, exemplo de uso, ajuste fino

Comece a usar o modelo de linguagem grande DCLM-7B da Apple e saiba como configurá-lo, usá-lo e ajustá-lo para tarefas específicas.
Dimitri Didmanidze's photo

Dimitri Didmanidze

Tutorial

Como fazer o ajuste fino do GPT 3.5: Liberando todo o potencial da IA

Explore o GPT-3.5 Turbo e descubra o potencial transformador do ajuste fino. Saiba como personalizar esse modelo de linguagem avançado para aplicativos de nicho, aprimorar seu desempenho e entender os custos associados, a segurança e as considerações de privacidade.
Moez Ali's photo

Moez Ali

Tutorial

Como usar a API de conversão de texto em fala da OpenAI

A API TTS da OpenAI é um ponto de extremidade que permite que os usuários interajam com seu modelo de IA TTS que converte texto em linguagem falada com som natural.
Kurtis Pykes 's photo

Kurtis Pykes

Ver MaisVer Mais