Vai al contenuto principale

Limiti di utilizzo di Claude Code spiegati: come funzionano e come evitarli

Scopri come funzionano davvero i limiti di utilizzo di Claude Code, cosa consuma silenziosamente la tua quota e quali passi pratici puoi fare per estendere la capacità disponibile prima di aggiornare il piano.
Aggiornato 21 lug 2026  · 12 min leggi

Esplora con l'AI

Apri in ChatGPTApri in ClaudeApri in Perplexity

Sei immerso in un refactoring, Claude Code sta facendo progressi e poi all'improvviso smette di rispondere. Nessun crash. Nessun errore. Solo un messaggio che ti dice che hai raggiunto un limite di utilizzo. La maggior parte degli utenti pensa che succeda perché ha inviato troppi prompt. In realtà, i prompt sono solo una piccola parte dell'equazione. Mi è capitato più volte e ho impiegato un po' a capirlo fino in fondo.

Il sistema dei limiti di Claude Code si basa su una combinazione di finestre di sessione a scorrimento, limiti settimanali, allowance specifiche per modello e un contesto in background ricco di token che viene inviato con ogni richiesta. File di regole, definizioni degli strumenti MCP, file di memoria e cronologia della conversazione possono consumare una grossa parte della tua capacità disponibile prima ancora che tu abbia scritto molto.

In questa guida ti spiego come funzionano i limiti di utilizzo di Claude Code, come controllare il tuo utilizzo attuale e le fonti nascoste di overhead che spesso portano gli sviluppatori a raggiungere i limiti prima del previsto.

Se sei alle prime armi con Claude Code, ti consiglio di dare un'occhiata prima al nostro tutorial su Claude Code o di seguire il corso Claude Code 101.

Cosa sono i limiti di utilizzo di Claude Code?

L'utilizzo di Claude Code è regolato da due sistemi sovrapposti:

  • Una finestra di sessione a scorrimento di 5 ore
  • Uno o più limiti settimanali di utilizzo

Raggiungere uno qualsiasi di questi porta al rate limiting.

La finestra mobile di 5 ore

Il limite più visibile di Claude Code è la finestra mobile di 5 ore. La tua finestra parte quando invii il primo prompt. Tutto ciò che fai nelle cinque ore successive attinge dallo stesso pool di utilizzo. Questo pool è condiviso tra Claude Code e la chat di Claude, quindi l'attività in uno influisce sull'altro.

Per esempio:

  • Primo prompt: 9:00
  • Fine finestra: 14:00

Se esaurisci l'utilizzo disponibile entro le 10:30, l'accesso si mette in pausa fino al reset della finestra alle 14:00.

Un errore comune è pensare che avviare una nuova conversazione azzeri l'utilizzo. Non è così. Il comando /clear avvia solo un nuovo contesto di conversazione. Non ripristina l'allowance di utilizzo né reimposta il timer di 5 ore.

Limiti settimanali

Oltre ai limiti a tempo di sessione, Claude Code applica anche limiti settimanali. Anche se ti resta margine nella sessione corrente, raggiungere un tetto settimanale può impedire temporaneamente ulteriori utilizzi finché non avviene il reset settimanale. 

Pensala così: il limite di 5 ore vincola il quando del tuo utilizzo, e il limite settimanale vincola il quanto del tuo utilizzo.

Questo significa che potresti avere ancora capacità nella tua sessione di 5 ore ma essere comunque bloccato perché hai esaurito l'allowance settimanale. Per la maggior parte degli utenti Pro, questa distinzione è abbastanza lineare. I piani Max, però, introducono un ulteriore livello di complessità.

Limite settimanale Sonnet per gli utenti Max

Attualmente Anthropic applica ai piani Max il seguente limite:

  • Un limite settimanale che copre tutti i modelli
  • Un limite settimanale separato specifico per l'uso di Sonnet

Questa distinzione conta perché potresti avere ancora capacità Sonnet disponibile anche dopo aver esaurito l'allocazione più ampia per i modelli, o viceversa. 

Per esempio, immagina di passare gran parte della settimana usando Sonnet per il lavoro di implementazione. Potresti esaurire l'allocazione settimanale specifica per Sonnet pur avendo ancora capacità residua nella tua allowance settimanale complessiva. A quel punto, potresti dover passare a un altro modello, aspettare il reset di Sonnet o aggiornare il piano, a seconda dei limiti rimanenti.

Può accadere anche il contrario. Se hai usato molto Opus durante la settimana, potresti raggiungere il limite settimanale complessivo anche se l'allocazione specifica per Sonnet non è stata ancora consumata del tutto. Poiché il limite complessivo è quello ombrello, raggiungerlo impedisce ulteriori utilizzi indipendentemente da quanta capacità Sonnet rimanga.

Perché le richieste Sonnet vadano a buon fine, devono essere vere entrambe le condizioni:

  • Hai ancora margine nel limite settimanale complessivo.
  • Hai ancora margine nel limite settimanale di Sonnet.

Le richieste Opus, invece, consumano solo il pool settimanale complessivo perché non esiste un'allowance separata specifica per Opus. Ecco perché la pagina Usage in Claude.ai è così importante. Mostra ciascun limite settimanale in modo indipendente insieme all'orario di reset, rendendo molto più semplice capire quale limite stai avvicinando prima di una lunga sessione di coding. 

Architettura dei limiti di utilizzo di Claude Code

Utilizzo di Claude Code per piano

Una difficoltà nel confrontare i piani è che Anthropic non pubblica più semplici "conteggi di prompt".

Al contrario, i piani sono descritti tramite moltiplicatori di capacità relativa. Questi moltiplicatori riflettono la capacità di utilizzo che ricevi rispetto alla base del piano Pro. Non è semplice ottenere numeri esatti; alcuni utenti tengono traccia dell'utilizzo in percentuale per farsi un'idea di quanti token hanno usato per percentuale di capacità. 

Piano

Prezzo mensile

Capacità relativa

Limiti settimanali

Condiviso con Claude Chat

Pro

$20

Baseline

Max 5x

$100

Capacità Pro ×5

Max 20x

$200

Capacità Pro ×20

Team

Variabile

Allocazione condivisa maggiore

Enterprise

Personalizzato

Specifico per l'organizzazione

Modifiche ai limiti di utilizzo di maggio 2026

A maggio 2026 Anthropic ha ampliato la capacità di Claude Code raddoppiando i limiti di utilizzo degli abbonamenti e rimuovendo le riduzioni nelle ore di punta che in precedenza interessavano gli abbonati Pro e Max. Invece di pubblicare conteggi fissi di prompt, ora Anthropic esprime le differenze tra piani come moltiplicatori di capacità relativa, perché l'utilizzo effettivo dipende dalla scelta del modello, dalla dimensione del contesto e dall'uso degli strumenti.

Da allora, Anthropic ha occasionalmente adeguato i limiti settimanali con promozioni temporanee. Per esempio, durante il rollout di Claude Fable 5, i limiti settimanali di Claude Code sono stati aumentati del 50% per gli abbonati idonei. Poiché questi aumenti promozionali sono temporanei, prima di pianificare carichi di lavoro di lunga durata ti conviene sempre verificare i limiti più recenti nella dashboard Usage di Claude.

Crediti Agent SDK (giugno 2026)

Il piano di separare le sessioni di coding interattive dai carichi di lavoro degli agenti automatizzati ha generato un po' di confusione a giugno 2026.

Prima del 15 giugno, tutta l'attività di Claude Code attingeva dallo stesso pool dell'abbonamento. Che stessi chattando in modo interattivo nel terminale, eseguendo una GitHub Action o invocando claude -p in una pipeline CI, tutto concorreva agli stessi limiti di 5 ore e settimanali.

Anthropic aveva previsto di iniziare a separare questi carichi di lavoro il 15 giugno 2026, ma ha messo in pausa la modifica proprio il giorno del lancio. Questo significa che l'utilizzo interattivo e quello programmatico (Agent SDK, claude -p, GitHub Actions) continuano ad attingere dallo stesso pool dell'abbonamento, come prima.

A luglio 2026, non esiste alcun credito Agent SDK separato attivo, né un credito opzionale da richiedere.

Cosa sta davvero svuotando la tua quota?

Molti sviluppatori si concentrano sui prompt e sulla regolazione dei token. Spesso però il vero colpevole è il contesto. Ogni interazione contiene molte più informazioni della domanda che hai digitato.

CLAUDE.md e file di regole

Claude Code carica automaticamente le istruzioni da:

  • CLAUDE.md

  • File CLAUDE.md della directory padre

  • Riferimenti importati @

  • File .claude/rules/*.md

Tutto questo contesto e le istruzioni aggiuntive vengono inclusi ripetutamente nelle richieste. Questo significa che un file di regole gonfio aumenta silenziosamente il consumo di token per tutta la sessione. Anthropic consiglia di mantenere i singoli file CLAUDE.md sotto circa 200 righe.

Per progetti più grandi, valuta di suddividere le istruzioni in regole con ambito che usano il frontmatter dei path, così da caricarle solo quando rilevanti. Se vuoi approfondire, la nostra guida alla scrittura del miglior file CLAUDE.md illustra strategie efficaci di organizzazione.

Definizioni degli strumenti MCP

I server Model Context Protocol (MCP) sono un'altra fonte nascosta di overhead. Ogni server MCP connesso inietta gli schemi degli strumenti nel contesto di Claude, anche se non usi mai quegli strumenti.

Immagina:

  • 5 server MCP
  • 10 strumenti per server

Sono 50 definizioni di strumenti incluse in ogni richiesta. Disconnettere i server MCP inutilizzati è uno dei modi più semplici per ridurre il consumo di token di Claude Code.

Una nota importante: evita di aggiungere o rimuovere server MCP durante una sessione attiva. Farlo invalida i prefissi della prompt cache e può aumentare i costi di utilizzo.

Memoria automatica

Dalla versione 2.1.59 di Claude Code, la memoria automatica è abilitata per impostazione predefinita. La memoria è conoscenza globale che Claude ha salvato durante diverse sessioni, e gli fornisce più contesto. Può spaziare da metodi per estrarre dati da un database ai dettagli tecnici implementati.

All'avvio, Claude carica contenuti da MEMORY.md, fino a:

  • Prime 200 righe
  • Primi 25 KB

Per alcuni flussi di lavoro è utile. Per altri, è solo contesto extra.

Puoi disabilitare la memoria automatica in un paio di modi. Per un interruttore permanente che prevale su tutte le altre impostazioni (utile in pipeline CI e ambienti automatizzati), imposta la variabile d'ambiente nella tua shell:

export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1

In alternativa, aggiungi quanto segue al tuo settings.json. Usa ~/.claude/settings.json per disabilitarla in tutti i progetti, oppure .claude/settings.json per un singolo progetto:

{ "autoMemoryEnabled": false }

Se non usi attivamente i file di memoria, disabilitare questa funzione può ridurre la dimensione del contesto di base.

Cronologia della conversazione e ricerca

La cronologia della conversazione cresce continuamente. Ogni risultato di uno strumento, lettura di file, output di grep, comando del terminale e ricerca nel codice diventa parte del contesto della sessione.

Per esperienza, l'esplorazione del repository è spesso il contributore maggiore. Claude può leggere decine di file solo per trovare una singola funzione. Quei file restano disponibili nel contesto e continuano a contribuire all'overhead di token per i turni successivi.

Per i flussi di lavoro automatizzati, claude -p --bare può ridurre molto di questo overhead fisso eliminando il contesto di sessione non necessario. Questo può risparmiare molti dei crediti mensili dell'Agent SDK che altrimenti verrebbero consumati mentre Claude cerca tra i file.

Come controllare l'utilizzo di Claude Code

Il momento migliore per controllare il tuo utilizzo è prima di una lunga sessione di coding. Così puoi sapere quanto sei vicino a raggiungere i limiti prima di iniziare davvero a scrivere codice.

Usare /usage

Dentro Claude Code digitare /usage mostra:

  • Consumo della sessione
  • Consumo settimanale
  • Allocazione rimanente

È un ottimo modo per avere una panoramica di quanta quota ti resta nella sessione interattiva, così puoi pianificare. Provare a iniziare un'attività grande e complessa a ridosso del limite potrebbe non essere l'idea migliore, ma attività semplici come il cleanup dei file possono essere un buon uso della quota rimanente.

Usare /status

Puoi anche eseguire /status, che fornisce le seguenti informazioni:

  • Piano attuale
  • Informazioni sull'account
  • Stato di utilizzo attivo

Conoscere il tuo piano e lo stato attivo ti aiuta a capire eventuali limitazioni. Conta se il tuo utilizzo è 5× o 20× la baseline.

Controllare la dashboard di Claude

La vista più completa si trova in SettingsUsage all'in Claude.ai.

Dashboard dell'utilizzo su claude.ai

Questa dashboard combina:

  • Utilizzo della chat di Claude
  • Utilizzo di Claude Code
  • Programmi di reset settimanale
  • Limiti specifici del modello

Poiché possono esistere più limiti contemporaneamente, questa dashboard va considerata la fonte di verità. Un'abitudine pratica è controllare l'utilizzo prima di iniziare lavori di refactoring importanti, lunghe sessioni di debugging o attività di coding autonome.

Come sfruttare al meglio i limiti di Claude Code

Vediamo come estendere i limiti di utilizzo senza aggiornare il piano. A volte si può ottenere molta più capacità efficiente semplicemente riducendo l'overhead.

Snellisci il tuo CLAUDE.md

Punta a meno di 200 righe per file per minimizzare la quantità di contesto che invii e la confusione che puoi causare all'agente.  Cerca:

  • Istruzioni di progetto obsolete
  • Note storiche
  • Regole che appartengono a prompt individuali

Se le istruzioni contano solo per directory specifiche, usa regole con ambito con il frontmatter paths, in modo che non tutte le regole vengano usate costantemente ma solo entro determinati percorsi. Puoi anche avere file CLAUDE.md a livello di progetto invece che globali.

Fai l'audit dei tuoi server MCP

Mantieni solo i server MCP che usi attivamente. Ogni server connesso aggiunge overhead di schema a ogni interazione. Tratta la configurazione MCP come le schede del browser. Se non lo stai usando adesso, chiudilo. 

Un buon modo per gestire i server MCP è installarli a livello di progetto quando sai che ti servono solo certi MCP per certi progetti, invece che a livello utente. In questo modo, Claude non prova a caricarli su ogni progetto o in ogni sessione, ma solo quando ti servono per un caso d'uso specifico.

Usa /compact presto

Il comando /compact riassume la cronologia della conversazione e riduce i costi di token futuri. Riducendo la crescita del contesto elaborata a ogni turno, riduciamo l'uso della quota. 

Anche se non ripristina la quota già consumata, può essere utile se usi /compact prima che la sessione diventi eccessivamente grande. 

Abbina il modello al task

Non tutti i task richiedono Opus o Fable. A volte modelli più piccoli o un uso accorto dei modelli aiutano a gestire la quota. Spesso puoi aumentare sensibilmente la capacità disponibile riservando i modelli premium al lavoro a più alto valore. 

Ecco alcune strategie di ottimizzazione dei modelli:

  • Usa Opus per decisioni di architettura, ragionamenti complessi e requisiti ambigui
  • Sonnet per editing, ricerca e lavoro di implementazione
  • Haiku per task leggeri e letture rapide

Ma evita di cambiare modello ripetutamente all'interno di una sessione. Le prompt cache sono specifiche del modello, quindi ogni cambio costringe il nuovo modello a rielaborare da zero l'intera cronologia della conversazione a costo pieno di token, invece di leggerla a basso costo dalla cache. Questo può bruciare la quota più velocemente che restare sul posto, anche quando passi a un modello "più economico".

Quando sbatti contro il muro: fallback API

Se i limiti della quota in abbonamento diventano un collo di bottiglia, l'API di Claude è un'alternativa. L'uso dell'API non ti limita a finestre di sessione di cinque ore o tetti settimanali dell'abbonamento. Paghi invece in base al consumo di token.

Questo modello ha spesso senso per:

  • Pipeline CI
  • Agenti autonomi di lunga durata
  • Automazione su larga scala
  • Workflow di produzione con budget prevedibili

Attenzione a lasciare configurata la variabile d'ambiente ANTHROPIC_API_KEY nella shell di Claude Code. Se quella chiave è presente nel tuo ambiente, Claude Code potrebbe autenticarsi tramite API invece che tramite l'account in abbonamento.

Questo può generare addebiti API inattesi, poiché non stai più usando i limiti del tuo abbonamento ma stai pagando i costi per token. Quando i costi sembrano insoliti, controllare le impostazioni di autenticazione dovrebbe essere uno dei primi passi di troubleshooting.

Per i prezzi attuali dei modelli, fai sempre riferimento alla documentazione ufficiale dei prezzi di Anthropic, perché le tariffe cambiano spesso e variano in base al modello.

Considerazioni finali

I limiti di utilizzo di Claude Code sono più facili da gestire una volta capito che non si limitano a contare i prompt.

Il sistema combina:

  • Una finestra mobile di 5 ore
  • Limiti settimanali
  • Allowance specifiche per modello
  • Overhead di contesto

La sorpresa più grande per molti sviluppatori è che i prompt rappresentano spesso una minoranza del consumo totale di token. File CLAUDE.md grandi, definizioni degli strumenti MCP, memoria automatica, ricerche nel repository e cronologie di conversazione crescenti consumano frequentemente più capacità delle domande in sé.

In pratica, chi raggiunge i limiti insolitamente in fretta ha più spesso un problema di configurazione che di capacità. Prima di aggiornare il piano, riduci l'overhead ripulendo il contesto invece di acquistare una quota maggiore.

Per continuare a migliorare il tuo workflow, ti consiglio la nostra guida alle best practice di Claude Code e il tutorial su Claude Code Hooks, che coprono tecniche per rendere Claude Code più efficiente e resiliente durante lunghe sessioni di sviluppo.

FAQ sui limiti di utilizzo di Claude Code

Quali sono i limiti di utilizzo di Claude Code?

I limiti di utilizzo di Claude Code consistono in una finestra di sessione mobile di 5 ore e uno o più limiti settimanali di utilizzo. Sia Claude Code che la chat di Claude attingono dallo stesso pool di utilizzo dell'abbonamento.

Come posso controllare l'utilizzo di Claude Code?

Puoi controllare l'utilizzo con /usage dentro Claude Code, /status per i dettagli dell'account o la dashboard Usage in Claude.ai sotto SettingsUsage.

Cosa consuma più token in Claude Code?

I contributori nascosti più comuni includono file CLAUDE.md di grandi dimensioni, schemi degli strumenti MCP, memoria automatica, cronologia della conversazione, output degli strumenti e risultati delle ricerche nel repository.

Come posso ridurre il consumo di token di Claude Code?

Le best practice includono mantenere concisi i file CLAUDE.md, disabilitare i server MCP inutilizzati, usare /compact in modo proattivo, rimuovere i file di memoria non necessari, abbinare il modello alla complessità del task ed evitare ricerche a livello di repository eccessive.

Il sistema di crediti dell'Agent SDK è stato lanciato?

No. Anthropic aveva pianificato di separare l'utilizzo programmatico da quello interattivo di Claude a partire dal 15 giugno 2026, ma ha messo in pausa questa modifica il giorno stesso del lancio, dichiarando che "per ora non cambia nulla". Attualmente Claude Agent SDK, claude -p, le GitHub Action di Claude Code e le applicazioni di terze parti basate su Agent SDK continuano ad attingere dagli stessi limiti di utilizzo dell'abbonamento dell'uso interattivo di Claude Code.


Tim Lu's photo
Author
Tim Lu
LinkedIn

Sono una data scientist con esperienza in analisi spaziale, machine learning e pipeline dei dati. Ho lavorato con GCP, Hadoop, Hive, Snowflake, Airflow e altri processi di data science/engineering.

Argomenti

Impara a usare Claude Code con DataCamp!

Corso

Software Development with Claude Code

4 h
5.1K
Claude Code brings AI assistance to your terminal. Learn the workflows that turn it into a reliable tool for real software development.
Vedi dettagliRight Arrow
Inizia Il Corso
Mostra altroRight Arrow
Correlato

blog

Tokenizzazione nel NLP: come funziona, sfide e casi d'uso

Guida al preprocessing NLP nel machine learning. Copriamo spaCy, i transformer di Hugging Face e come funziona la tokenizzazione in casi d'uso reali.
Abid Ali Awan's photo

Abid Ali Awan

10 min

blog

I 15 migliori server MCP remoti che ogni AI builder dovrebbe conoscere nel 2026

Scopri i 15 migliori server MCP remoti che stanno trasformando lo sviluppo AI nel 2026. Scopri come migliorano automazione, ragionamento, sicurezza e velocità dei workflow.
Abid Ali Awan's photo

Abid Ali Awan

15 min

blog

Che cos'è Snowflake? Guida per principianti alla piattaforma dati cloud

Esplora le basi di Snowflake, la piattaforma dati cloud. Scopri la sua architettura, le sue funzionalità e come integrarla nelle tue pipeline di dati.
Tim Lu's photo

Tim Lu

12 min

Mostra AltroMostra Altro