Cours
Vous êtes plongé dans un refactoring, Claude Code avance bien, puis tout s’arrête net. Pas de crash. Pas d’erreur. Juste un message vous indiquant que vous avez atteint une limite d’utilisation. La plupart des utilisateurs pensent que c’est parce qu’ils ont envoyé trop d’invites. En réalité, les invites ne sont qu’une petite partie de l’équation. J’ai déjà rencontré ce problème, et j’ai mis du temps à bien le comprendre.
Le système de limites de Claude Code repose sur une combinaison de fenêtres glissantes de session, de plafonds hebdomadaires, d’allocations propres à chaque modèle et d’un contexte en arrière-plan très gourmand en tokens envoyé à chaque requête. Les fichiers de règles, définitions d’outils MCP, fichiers de mémoire et l’historique de conversation peuvent consommer une grande partie de votre capacité disponible avant même que vous n’ayez beaucoup tapé.
Dans ce guide, j’explique comment fonctionnent les limites d’utilisation de Claude Code, comment consulter votre consommation actuelle et quelles sont les sources cachées de surcoût qui amènent souvent les développeurs à atteindre leurs limites plus vite que prévu.
Si vous découvrez Claude Code, je vous recommande de lire d’abord notre tutoriel Claude Code ou de suivre le cours Claude Code 101.
Présentation des modèles Claude
Que sont les limites d’utilisation de Claude Code ?
L’utilisation de Claude Code est régie par deux mécanismes qui se recouvrent :
- Une fenêtre glissante de session de 5 heures
- Un ou plusieurs plafonds hebdomadaires
Atteindre l’un ou l’autre déclenche une limitation de débit.
La fenêtre glissante de 5 heures
La limite la plus visible est la fenêtre glissante de 5 heures. Votre fenêtre démarre lorsque vous envoyez votre première invite. Tout ce que vous faites durant les cinq heures suivantes puise dans la même réserve d’utilisation. Cette réserve est partagée entre Claude Code et Claude chat, donc l’activité de l’un impacte l’autre.
Par exemple :
- Première invite : 9 h 00
- Fin de fenêtre : 14 h 00
Si vous épuisez votre capacité disponible à 10 h 30, l’accès est suspendu jusqu’au réinitialisation de la fenêtre à 14 h 00.
Une idée reçue fréquente est que démarrer une nouvelle conversation réinitialise l’usage. Ce n’est pas le cas. La commande /clear ne fait que repartir sur un nouveau contexte de conversation. Elle ne restaure pas l’allocation d’usage ni ne remet à zéro le minuteur de 5 heures.
Limites hebdomadaires
En plus des limites temporelles de session, Claude Code applique aussi des limites hebdomadaires. Même s’il vous reste de la marge dans votre session en cours, atteindre un plafond hebdomadaire peut temporairement bloquer l’usage jusqu’à la réinitialisation hebdomadaire.
Voyez-le ainsi : la limite de 5 heures contraint le rythme, et la limite hebdomadaire borne votre volume total d’utilisation.
Vous pouvez donc avoir de la capacité restante dans votre session de 5 heures, mais être bloqué car votre enveloppe hebdomadaire est épuisée. Pour la plupart des utilisateurs Pro, la distinction est simple. Les offres Max ajoutent toutefois une couche supplémentaire de complexité.
Limite hebdomadaire Sonnet pour les utilisateurs Max
Anthropic applique actuellement les limites suivantes aux offres Max :
- Une limite hebdomadaire couvrant tous les modèles
- Une limite hebdomadaire distincte spécifiquement pour l’usage de Sonnet
Cette distinction est importante, car il est possible d’avoir encore de la capacité Sonnet après avoir épuisé l’allocation globale, ou l’inverse.
Par exemple, si vous passez l’essentiel de votre semaine à utiliser Sonnet pour la mise en œuvre, vous pouvez épuiser l’allocation hebdomadaire dédiée à Sonnet tout en conservant de la marge sur votre enveloppe hebdomadaire globale. À ce stade, il peut être nécessaire de basculer vers un autre modèle, d’attendre la réinitialisation Sonnet ou de passer à une offre supérieure, selon vos limites restantes.
La situation inverse peut aussi se produire. Si vous avez beaucoup utilisé Opus dans la semaine, vous pouvez atteindre votre limite hebdomadaire globale alors que votre enveloppe dédiée à Sonnet n’est pas entièrement consommée. Comme la limite globale fait foi, l’atteindre bloque tout usage, quelle que soit la capacité Sonnet restante.
Pour que les requêtes Sonnet aboutissent, deux conditions doivent être réunies :
- Il vous reste de la marge sur votre limite hebdomadaire globale.
- Il vous reste de la marge sur votre limite hebdomadaire Sonnet.
Les requêtes Opus, en revanche, ne consomment que l’enveloppe hebdomadaire globale, car il n’existe pas d’allocation spécifique à Opus. C’est pourquoi la page Usage dans Claude.ai est si importante. Elle affiche chaque limite hebdomadaire indépendamment avec son heure de réinitialisation, ce qui facilite la compréhension de la limite que vous approchez avant une longue séance de code.

Limites d’utilisation de Claude Code selon l’offre
Il est difficile de comparer les offres, car Anthropic ne publie plus de « comptes d’invites » simples.
Désormais, les offres sont décrites à l’aide de multiplicateurs de capacité relatifs. Ces multiplicateurs reflètent la capacité que vous recevez par rapport à la base Pro. Obtenir des chiffres exacts n’est pas aisé : certains utilisateurs suivent leur usage en pourcentage pour estimer le nombre de tokens consommés par point de capacité.
|
Offre |
Prix mensuel |
Capacité relative |
Limites hebdomadaires |
Partagée avec Claude Chat |
|
Pro |
$20 |
Référence |
Oui |
Oui |
|
Max 5x |
$100 |
Capacité ×5 par rapport à Pro |
Oui |
Oui |
|
Max 20x |
$200 |
Capacité ×20 par rapport à Pro |
Oui |
Oui |
|
Team |
Variable |
Allocation partagée plus élevée |
Oui |
Oui |
|
Enterprise |
Sur mesure |
Spécifique à l’organisation |
Oui |
Oui |
Évolutions des limites en mai 2026
En mai 2026, Anthropic a doublé la capacité de Claude Code en augmentant les limites d’abonnement et en supprimant les réductions d’heures de pointe qui affectaient auparavant les abonnés Pro et Max. Plutôt que de publier des comptes d’invites fixes, Anthropic exprime désormais les différences d’offres via des multiplicateurs de capacité relatifs, car l’usage réel dépend du choix de modèle, de la taille du contexte et de l’utilisation d’outils.
Depuis, Anthropic a parfois ajusté les limites hebdomadaires via des promotions temporaires. Par exemple, lors du déploiement de Claude Fable 5, les limites hebdomadaires de Claude Code ont été augmentées de 50 % pour les abonnés éligibles. Ces augmentations étant temporaires, vérifiez toujours les limites les plus récentes dans le tableau de bord Usage de Claude avant de planifier des charges longues.
Crédits Agent SDK (juin 2026)
Le projet de séparer les sessions de codage interactives des charges d’agents automatisés a suscité de la confusion en juin 2026.
Avant le 15 juin, toute l’activité Claude Code était prélevée sur la même enveloppe d’abonnement. Que vous discutiez interactivement dans le terminal, exécutiez une GitHub Action ou invoquiez claude -p dans un pipeline CI, tout se partageait les mêmes limites de 5 heures et hebdomadaires.
Anthropic avait prévu de séparer ces charges à partir du 15 juin 2026, mais a suspendu le changement le jour même du lancement. Cela signifie que l’usage interactif et l’usage programmatique (Agent SDK, claude -p, GitHub Actions) puisent toujours dans la même enveloppe d’abonnement qu’auparavant.
À juillet 2026, il n’y a pas de crédit Agent SDK distinct en production, et aucun crédit optionnel à réclamer.
Qu’est-ce qui épuise réellement votre quota ?
Beaucoup de développeurs se concentrent sur les invites et le réglage des tokens. Le véritable coupable est souvent le contexte. Chaque interaction contient bien plus d’informations que la question que vous avez tapée.
CLAUDE.md et fichiers de règles
Claude Code charge automatiquement des instructions depuis :
-
CLAUDE.md -
Les fichiers
CLAUDE.mddes répertoires parents -
Les références importées
@ -
Les fichiers
.claude/rules/*.md
Tout ce contexte et ces instructions supplémentaires sont renvoyés à répétition avec les requêtes. Un fichier de règles trop volumineux augmente silencieusement la consommation de tokens tout au long de la session. Anthropic recommande de limiter un fichier CLAUDE.md à environ 200 lignes.
Pour les projets de grande taille, pensez à scinder les instructions en règles ciblées avec des métadonnées de chemin (frontmatter paths) afin qu’elles ne se chargent que lorsqu’elles sont pertinentes. Pour aller plus loin, notre guide pour rédiger un excellent fichier CLAUDE.md couvre des stratégies d’organisation efficaces.
Définitions d’outils MCP
Les serveurs Model Context Protocol (MCP) sont une autre source cachée de surcoût. Chaque serveur MCP connecté injecte des schémas d’outils dans le contexte de Claude, même si vous ne les utilisez jamais.
Imaginez :
- 5 serveurs MCP
- 10 outils par serveur
Cela fait 50 définitions d’outils incluses à chaque requête. Déconnecter les serveurs MCP inutilisés est l’un des moyens les plus simples de réduire la consommation de tokens de Claude Code.
Important : évitez d’ajouter ou de retirer des serveurs MCP pendant une session active. Cela invalide les préfixes de cache d’invite et peut accroître les coûts d’utilisation.
Mémoire automatique
Depuis Claude Code v2.1.59, la mémoire automatique est activée par défaut. La mémoire correspond à des connaissances globales que Claude a conservées au fil de différentes sessions, ce qui lui donne davantage de contexte. Cela peut aller de méthodes pour extraire des données d’une base à des détails techniques implémentés.
Au démarrage, Claude charge le contenu de MEMORY.md, jusqu’à :
- 200 lignes
- 25 Ko
Selon les flux de travail, c’est utile. Dans d’autres cas, c’est juste du contexte en plus.
Vous pouvez désactiver la mémoire automatique de deux façons. Pour un coupe-circuit permanent qui outrepasse tous les autres réglages (utile en CI et environnements automatisés), définissez la variable d’environnement dans votre shell :
export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1
Vous pouvez aussi ajouter ce qui suit à votre settings.json. Utilisez ~/.claude/settings.json pour le désactiver sur tous les projets, ou .claude/settings.json pour un projet unique :
{ "autoMemoryEnabled": false }
Si vous n’utilisez pas activement les fichiers de mémoire, désactiver cette fonctionnalité peut réduire la taille de contexte minimale.
Historique de conversation et recherche
L’historique de conversation grossit en continu. Chaque résultat d’outil, lecture de fichier, sortie de grep, commande de terminal et recherche de code s’ajoute au contexte de session.
D’après mon expérience, l’exploration de dépôt est souvent le plus gros contributeur. Claude peut lire des dizaines de fichiers pour trouver une seule fonction. Ces fichiers restent en contexte et continuent de générer du surcoût en tokens aux tours suivants.
Pour les flux automatisés, claude -p --bare peut réduire une grande partie de ce surcoût fixe en supprimant le contexte de session superflu. Cela peut économiser beaucoup de crédits Agent SDK mensuels qui seraient autrement consommés par les recherches de fichiers de Claude.
Comment vérifier votre utilisation de Claude Code
Le meilleur moment pour vérifier votre consommation est avant une longue session de codage. Ainsi, vous savez à quel point vous êtes proche des limites avant de vous lancer.
Utiliser /usage
Dans Claude Code, taper /usage affiche :
- La consommation de session
- La consommation hebdomadaire
- L’allocation restante
Idéal pour avoir une vue d’ensemble de votre quota restant en session interactive et planifier en conséquence. Lancer une tâche complexe juste avant d’atteindre votre limite n’est pas optimal, tandis que des actions simples comme du nettoyage de fichiers peuvent rentabiliser la fin de quota.
Utiliser /status
Vous pouvez aussi lancer /status, qui fournit :
- L’offre actuelle
- Les informations de compte
- L’état d’utilisation actif
Connaître votre offre et votre état actif aide à anticiper les éventuelles limites. Cela change tout d’être à ×5 ou ×20 par rapport à la référence.
Consulter le tableau de bord Claude
La vue la plus complète se trouve dans Settings → Usage au sein de Claude.ai.

Ce tableau de bord combine :
- L’usage de Claude chat
- L’usage de Claude Code
- Les calendriers de réinitialisation hebdomadaire
- Les limites propres aux modèles
Comme plusieurs limites peuvent coexister, considérez ce tableau de bord comme la source de vérité. Une bonne habitude consiste à le vérifier avant de démarrer un gros refactoring, une longue session de débogage ou des tâches de codage autonomes.
Comment tirer le meilleur parti de vos limites Claude Code
Voyons comment étendre nos limites d’utilisation sans changer d’offre. Souvent, on peut gagner beaucoup en efficacité simplement en réduisant le surcoût.
Allégez votre CLAUDE.md
Visez moins de 200 lignes par fichier pour limiter le contexte envoyé et éviter de perturber l’agent. À traquer :
- Instructions de projet obsolètes
- Notes historiques
- Règles qui devraient vivre dans des invites ponctuelles
Si des instructions ne concernent que certains répertoires, utilisez des règles ciblées avec un frontmatter paths, afin que toutes vos règles ne soient pas utilisées en permanence. Vous pouvez aussi préférer des fichiers CLAUDE.md au niveau du projet plutôt qu’un global.
Auditez vos serveurs MCP
Conservez uniquement les serveurs MCP que vous utilisez réellement. Chaque serveur connecté ajoute du schéma à chaque interaction. Traitez votre configuration MCP comme des onglets de navigateur : si vous ne vous en servez pas, fermez-le.
Une bonne pratique consiste à installer les MCP au niveau du projet lorsque vous savez que certains MCP ne sont nécessaires que pour certains projets, plutôt qu’au niveau utilisateur. Ainsi, Claude ne tente pas de les charger à chaque projet ou session, seulement quand le cas d’usage l’exige.
Utilisez /compact tôt
La commande /compact résume l’historique de conversation et réduit les coûts en tokens à venir. En limitant la croissance du contexte à traiter à chaque tour, on réduit la consommation de quota.
Même si cela ne restitue pas le quota déjà consommé, c’est utile si vous l’exécutez avant que la session ne devienne trop volumineuse.
Adaptez le modèle à la tâche
Toutes les tâches n’exigent pas Opus ou Fable. Parfois, des modèles plus légers ou une utilisation plus fine des modèles aident à maîtriser le quota. Vous pouvez souvent augmenter sensiblement votre capacité disponible en réservant les modèles premium aux travaux à forte valeur.
Quelques stratégies d’optimisation :
- Opus pour les décisions d’architecture, le raisonnement complexe et les besoins ambigus
- Sonnet pour l’édition, la recherche et la mise en œuvre
- Haiku pour les tâches légères et les lectures rapides
Évitez cependant de changer de modèle à répétition au sein d’une session. Les caches d’invite sont spécifiques au modèle : chaque bascule force le nouveau modèle à retraiter tout l’historique à plein coût en tokens, au lieu de le lire à moindre coût depuis le cache. Vous pouvez ainsi brûler votre quota plus vite qu’en restant sur place, même en passant à un modèle « moins cher ».
Quand vous butez sur la limite : bascule API
Si les limites d’abonnement deviennent un goulot d’étranglement, l’API Claude constitue une alternative. L’usage API n’est pas borné par des fenêtres de 5 heures ni des plafonds hebdomadaires : vous payez à la consommation de tokens.
Ce modèle convient souvent à :
- Des pipelines CI
- Des agents autonomes de longue durée
- De l’automatisation à grande échelle
- Des workflows de production avec budgets prévisibles
Attention à ne pas laisser la variable d’environnement ANTHROPIC_API_KEY configurée dans votre shell Claude Code. Si cette clé est présente, Claude Code peut s’authentifier via l’API plutôt que via votre abonnement.
Cela peut entraîner des frais API inattendus, puisque vous n’utilisez plus vos limites d’abonnement mais payez à la consommation. Si vos coûts semblent anormaux, vérifiez en priorité vos paramètres d’authentification.
Pour les tarifs à jour des modèles, reportez-vous à la documentation officielle d’Anthropic, car les prix évoluent fréquemment et varient selon le modèle.
Pour conclure
Les limites d’utilisation de Claude Code sont plus faciles à gérer une fois que l’on comprend qu’elles ne se résument pas à compter les invites.
Le système combine :
- Une fenêtre glissante de 5 heures
- Des plafonds hebdomadaires
- Des allocations propres aux modèles
- Un surcoût lié au contexte
La grande surprise pour beaucoup est que les invites représentent souvent une minorité de l’usage total en tokens. Les gros fichiers CLAUDE.md, les définitions d’outils MCP, la mémoire automatique, les recherches dans le dépôt et l’historique grandissant de la conversation consomment fréquemment plus de capacité que les questions elles-mêmes.
En pratique, la plupart des personnes qui atteignent les limites anormalement vite ont un problème de configuration, pas de capacité. Avant de changer d’offre, réduisez le surcoût en nettoyant le contexte plutôt qu’en achetant plus de quota.
Pour continuer à optimiser votre flux de travail, consultez notre guide des meilleures pratiques Claude Code et notre tutoriel Claude Code Hooks, qui couvrent des techniques pour rendre Claude Code plus efficace et plus robuste lors de longues sessions de développement.
FAQ sur les limites d’utilisation de Claude Code
Quelles sont les limites d’utilisation de Claude Code ?
Les limites d’utilisation de Claude Code combinent une fenêtre de session glissante de 5 heures et un ou plusieurs plafonds hebdomadaires. Claude Code et Claude chat puisent dans la même enveloppe d’abonnement.
Comment vérifier l’utilisation de Claude Code ?
Vous pouvez vérifier votre consommation avec /usage dans Claude Code, /status pour les détails du compte, ou via le tableau de bord Usage dans Claude.ai sous Settings → Usage.
Qu’est-ce qui consomme le plus de tokens dans Claude Code ?
Les contributeurs cachés courants incluent de gros fichiers CLAUDE.md, des schémas d’outils MCP, la mémoire automatique, l’historique de conversation, les sorties d’outils et les résultats de recherche dans le dépôt.
Comment réduire la consommation de tokens dans Claude Code ?
Les bonnes pratiques incluent des fichiers CLAUDE.md concis, la désactivation des serveurs MCP inutilisés, l’utilisation proactive de /compact, la suppression des fichiers de mémoire superflus, l’adéquation du modèle à la complexité de la tâche et l’évitement des recherches sur l’ensemble du dépôt quand elles ne sont pas nécessaires.
Le système de crédits Agent SDK a-t-il été lancé ?
Non. Anthropic prévoyait de séparer l’usage programmatique de l’usage interactif de Claude à partir du 15 juin 2026, mais a suspendu ce changement le jour du lancement en précisant que « rien ne change pour l’instant ». Claude Agent SDK, claude -p, les GitHub Actions Claude Code et les applications tierces Agent SDK continuent actuellement de puiser dans les mêmes limites d’abonnement que l’usage interactif de Claude Code.
Je suis un data scientist avec de l'expérience dans l'analyse spatiale, l'apprentissage automatique et les pipelines de données. J'ai travaillé avec GCP, Hadoop, Hive, Snowflake, Airflow et d'autres processus d'ingénierie et de science des données.

