Ir al contenido principal

Límites de uso de Claude Code: cómo funcionan y cómo evitar alcanzarlos

Descubre cómo funcionan realmente los límites de uso de Claude Code, qué agota tu cuota en silencio y qué pasos prácticos puedes dar para ampliar tu capacidad antes de mejorar el plan.
Actualizado 21 jul 2026  · 12 min leer

Explorar con IA

Abrir en ChatGPTAbrir en ClaudeAbrir en Perplexity

Estás metido de lleno en un refactor, Claude Code va avanzando, y de repente deja de responder. No hay cuelgue. No hay errores. Solo un aviso de que has alcanzado un límite de uso. Mucha gente piensa que pasa por enviar demasiados prompts. En realidad, los prompts son solo una parte pequeña de la ecuación. A mí me ha ocurrido y me llevó un tiempo entenderlo bien.

El sistema de límites de Claude Code combina ventanas de sesión deslizantes, topes semanales, asignaciones específicas por modelo y un contexto de fondo muy pesado en tokens que se envía con cada solicitud. Archivos de reglas, definiciones de herramientas MCP, archivos de memoria e historial de conversación pueden consumir gran parte de tu capacidad disponible antes incluso de que hayas tecleado mucho.

En esta guía te explico cómo funcionan los límites de uso de Claude Code, cómo consultar tu consumo actual y las fuentes ocultas de sobrecarga que hacen que muchos desarrolladores lleguen a los límites antes de lo esperado.

Si eres nuevo en Claude Code, te recomiendo echar un vistazo antes a nuestro tutorial de Claude Code o hacer el curso Claude Code 101.

Introducción a los modelos Claude

Aprende a trabajar con Claude utilizando la API de Anthropic para resolver tareas del mundo real y crear aplicaciones basadas en inteligencia artificial.
Explora El Curso

¿Qué son los límites de uso de Claude Code?

El uso de Claude Code está regido por dos sistemas que se solapan:

  • Una ventana de sesión deslizante de 5 horas
  • Uno o varios topes semanales de uso

Si alcanzas cualquiera de estos, te encontrarás con límites de tasa.

La ventana deslizante de 5 horas

El límite más visible de Claude Code es la ventana deslizante de 5 horas. Tu ventana empieza cuando envías tu primer prompt. Todo lo que hagas durante las siguientes cinco horas tira del mismo cupo. Este cupo se comparte entre Claude Code y el chat de Claude, así que la actividad en uno afecta al otro.

Por ejemplo:

  • Primer prompt: 9:00
  • La ventana termina: 14:00

Si agotas tu uso disponible a las 10:30, el acceso se pausa hasta que la ventana se reinicie a las 14:00.

Un error común es pensar que empezar una conversación nueva restablece el uso. No lo hace. El comando /clear solo inicia un contexto de conversación limpio. No recupera la asignación de uso ni reinicia el temporizador de 5 horas.

Límites semanales

Además de los límites por tiempo de sesión, Claude Code también impone límites semanales. Aunque aún te quede margen en tu sesión actual, alcanzar un tope semanal puede impedir temporalmente seguir usando el servicio hasta que llegue el reinicio semanal.

Piénsalo así: el tope de 5 horas limita el momento en que puedes usarlo, y el límite semanal pone techo a tu volumen total de uso.

Esto significa que puedes tener capacidad restante en tu sesión de 5 horas y aun así quedarte bloqueado porque has agotado tu asignación semanal. Para la mayoría de usuarios Pro, esta distinción es sencilla. Los planes Max, sin embargo, añaden una capa extra de complejidad.

Límite semanal de Sonnet para usuarios Max

Actualmente Anthropic aplica lo siguiente en los planes Max:

  • Un límite semanal que cubre todos los modelos
  • Un límite semanal aparte específicamente para el uso de Sonnet

Esta distinción importa porque podrías seguir teniendo capacidad de Sonnet incluso tras agotar tu asignación semanal general, o al revés.

Por ejemplo, imagina que pasas gran parte de la semana usando Sonnet para trabajo de implementación. Podrías agotar tu asignación semanal específica de Sonnet y aun así tener margen en tu tope semanal general. En ese punto, puede que tengas que cambiar de modelo, esperar al reinicio de Sonnet o mejorar tu plan, según los límites que te queden.

También puede pasar lo contrario. Si has utilizado mucho Opus durante la semana, podrías alcanzar tu límite semanal general aunque tu asignación específica de Sonnet no se haya consumido del todo. Como el límite general es el paraguas, alcanzarlo impide seguir usando el servicio independientemente de la capacidad que quede para Sonnet.

Para que las solicitudes a Sonnet tengan éxito, deben cumplirse ambas condiciones:

  • Que sigas teniendo margen en tu límite semanal general.
  • Que sigas teniendo margen en tu límite semanal de Sonnet.

Las solicitudes a Opus, en cambio, solo consumen del cupo semanal general porque no hay una asignación específica para Opus. Por eso la página de Usage en Claude.ai es tan importante. Muestra cada límite semanal por separado junto con su hora de reinicio, lo que facilita mucho entender qué límite estás a punto de alcanzar antes de una sesión larga de código.

Arquitectura de límites de uso de Claude Code

Uso de Claude Code según el plan

Un reto al comparar planes es que Anthropic ya no publica simples "recuentos de prompts".

En su lugar, los planes se describen con multiplicadores de capacidad relativos. Estos multiplicadores reflejan la capacidad que recibes en comparación con la base del plan Pro. No es sencillo obtener cifras exactas; algunas personas hacen un seguimiento de su uso como porcentaje para aproximar cuántos tokens consumen por porcentaje de capacidad.

Plan

Precio mensual

Capacidad relativa

Límites semanales

Compartido con Claude Chat

Pro

$20

De referencia

Max 5x

$100

5× capacidad Pro

Max 20x

$200

20× capacidad Pro

Team

Variable

Asignación compartida superior

Enterprise

A medida

Específica de la organización

Cambios en los límites de uso en mayo de 2026

En mayo de 2026, Anthropic amplió la capacidad de Claude Code al duplicar los límites de uso por suscripción y eliminar las reducciones en horas punta que afectaban a suscriptores Pro y Max. En lugar de publicar recuentos fijos de prompts, ahora expresa las diferencias entre planes como multiplicadores relativos de capacidad porque el uso real depende del modelo elegido, el tamaño del contexto y el uso de herramientas.

Desde entonces, Anthropic ha ajustado ocasionalmente los límites semanales mediante promociones temporales. Por ejemplo, durante el despliegue de Claude Fable 5, se aumentaron en un 50% los límites semanales de Claude Code para suscriptores elegibles. Como estos incrementos promocionales son temporales, conviene comprobar siempre los límites más recientes en el panel de Usage de Claude antes de planificar cargas de trabajo de larga duración.

Créditos de Agent SDK (junio de 2026)

El plan para separar las sesiones interactivas de código de las cargas de trabajo de agentes automatizados generó cierta confusión en junio de 2026.

Antes del 15 de junio, toda la actividad de Claude Code consumía del mismo cupo de suscripción. Tanto si chateabas en el terminal, ejecutabas una GitHub Action o llamabas a claude -p en un pipeline de CI, todo competía por los mismos límites de cinco horas y semanales.

Anthropic tenía previsto empezar a dividir estas cargas el 15 de junio de 2026, pero pausó el cambio el mismo día del lanzamiento. Esto significa que el uso interactivo y el programático (Agent SDK, claude -p, GitHub Actions) siguen consumiendo del mismo cupo de suscripción que antes.

A julio de 2026, no existe un crédito de Agent SDK separado en producción, ni hay un crédito opcional que activar.

¿Qué está drenando realmente tu cuota?

Muchos desarrolladores se centran en los prompts y el ajuste fino de tokens. El verdadero culpable suele ser el contexto. Cada interacción contiene bastante más información que la pregunta que escribes.

CLAUDE.md y archivos de reglas

Claude Code carga instrucciones automáticamente desde:

  • CLAUDE.md

  • Archivos CLAUDE.md del directorio padre

  • Referencias importadas con @

  • Archivos .claude/rules/*.md

Todo este contexto e instrucciones adicionales se incluyen repetidamente en las solicitudes. Esto significa que un archivo de reglas inflado aumenta silenciosamente el consumo de tokens durante toda la sesión. Anthropic recomienda mantener cada archivo CLAUDE.md por debajo de unas 200 líneas.

Para proyectos grandes, plantéate dividir las instrucciones en reglas acotadas con frontmatter de rutas para que solo se carguen cuando proceda. Si quieres profundizar, nuestra guía para escribir el mejor archivo CLAUDE.md cubre estrategias de organización eficaces.

Definiciones de herramientas MCP

Los servidores del Model Context Protocol (MCP) son otra fuente oculta de sobrecarga. Cada servidor MCP conectado inyecta esquemas de herramientas en el contexto de Claude, aunque no llegues a usarlas.

Imagina:

  • 5 servidores MCP
  • 10 herramientas por servidor

Son 50 definiciones de herramientas incluidas en cada solicitud. Desconectar los servidores MCP que no uses es una de las formas más sencillas de reducir el consumo de tokens de Claude Code.

Un matiz importante: evita añadir o quitar servidores MCP durante una sesión activa. Hacerlo invalida los prefijos de la caché de prompts y puede aumentar el coste de uso.

Memoria automática

Desde Claude Code v2.1.59, la memoria automática está activada por defecto. La memoria es conocimiento global que Claude guarda entre sesiones, dándole más contexto. Puede ir desde métodos para extraer datos de una base de datos hasta detalles técnicos ya implementados.

Al iniciar, Claude carga contenido de MEMORY.md hasta:

  • Las primeras 200 líneas
  • Los primeros 25 KB

Para algunos flujos de trabajo es útil. Para otros, es contexto de más.

Puedes desactivar la memoria automática de un par de maneras. Para un interruptor permanente que anule cualquier otra configuración (útil en pipelines de CI y entornos automatizados), define la variable de entorno en tu shell:

export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1

También puedes añadir lo siguiente a tu settings.json. Usa ~/.claude/settings.json para desactivarlo en todos los proyectos, o .claude/settings.json para un único proyecto:

{ "autoMemoryEnabled": false }

Si no usas activamente archivos de memoria, desactivar esta función puede reducir el tamaño de contexto base.

Historial de conversación y búsquedas

El historial de conversación crece de forma continua. Cada resultado de herramienta, lectura de archivos, salida de grep, comando de terminal y búsqueda de código pasa a formar parte del contexto de la sesión.

En mi experiencia, la exploración del repositorio suele ser lo que más contribuye. Claude puede leer decenas de archivos solo para encontrar una función. Esos archivos se mantienen en contexto y siguen sumando sobrecarga de tokens en turnos futuros.

Para flujos automatizados, claude -p --bare puede reducir gran parte de esta sobrecarga fija al eliminar el contexto de sesión innecesario. Esto puede ahorrar muchos créditos mensuales de Agent SDK que, de otro modo, se quemarían buscando archivos con Claude.

Cómo consultar tu uso de Claude Code

El mejor momento para revisar tu uso es antes de una sesión larga de código. Así sabrás lo cerca que estás de los límites antes de ponerte a programar.

Usando /usage

Dentro de Claude Code, al escribir /usage verás:

  • Consumo de la sesión
  • Consumo semanal
  • Asignación restante

Es una forma estupenda de tener una vista general de la cuota que te queda en tu sesión interactiva y poder planificar. Empezar una tarea compleja justo antes de tocar el límite quizá no sea lo más inteligente, pero tareas sencillas como limpiar archivos pueden ser un buen uso de la cuota que quede.

Usando /status

También puedes ejecutar /status, que te da la siguiente información:

  • Plan actual
  • Información de la cuenta
  • Estado de uso activo

Conocer tu plan y estado activo te ayuda a anticipar limitaciones. Importa si tu uso es 5× o 20× respecto a la base.

Revisando el panel de Claude

La vista más completa está en SettingsUsage en Claude.ai.

Panel de uso de Claude en claude.ai

Este panel combina:

  • Uso del chat de Claude
  • Uso de Claude Code
  • Calendarios de reinicio semanal
  • Límites específicos por modelo

Como pueden existir varios límites a la vez, trata este panel como la fuente de verdad. Un hábito práctico es revisarlo antes de empezar refactors importantes, sesiones largas de depuración o tareas autónomas de codificación.

Cómo exprimir al máximo tus límites de Claude Code

Hablemos de cómo ampliar los límites sin mejorar el plan. A veces, con reducir la sobrecarga conseguimos mucha más capacidad efectiva.

Recorta tu CLAUDE.md

Intenta no superar las 200 líneas por archivo para minimizar el contexto que envías y evitar confundir al agente. Fíjate en:

  • Instrucciones de proyecto desactualizadas
  • Notas históricas
  • Reglas que encajarían mejor en prompts puntuales

Si las instrucciones solo importan para directorios concretos, usa reglas acotadas con frontmatter paths, para que no se apliquen todas constantemente, sino solo en las rutas pertinentes. También puedes tener archivos CLAUDE.md a nivel de proyecto en vez de uno global.

Audita tus servidores MCP

Conserva solo los servidores MCP que estés usando de verdad. Cada servidor conectado añade sobrecarga de esquemas a cada interacción. Trata tu configuración MCP como las pestañas del navegador: si no lo usas ahora, ciérralo.

Una buena forma de gestionarlos es instalarlos a nivel de proyecto cuando sabes que solo necesitas ciertos MCP para proyectos concretos, en lugar de a nivel de usuario. Así Claude no intentará cargarlos en cada proyecto o sesión, solo cuando los necesites para un caso de uso específico.

Usa /compact pronto

El comando /compact resume el historial de la conversación y reduce el coste de tokens a futuro. Al frenar el crecimiento del contexto que se procesa en cada turno, reducimos el uso de la cuota.

No recupera la cuota ya consumida, pero es útil si lo usas antes de que la sesión se vuelva demasiado grande.

Ajusta el modelo a la tarea

No todas las tareas necesitan Opus o Fable. A veces, modelos más pequeños o un uso más inteligente de los modelos ayudan a gestionar la cuota. A menudo puedes aumentar mucho tu capacidad disponible reservando los modelos premium para trabajo de alto valor.

Algunas estrategias de optimización por modelo:

  • Usa Opus para decisiones de arquitectura, razonamiento complejo y requisitos ambiguos
  • Sonnet para edición, búsquedas y trabajo de implementación
  • Haiku para tareas ligeras y lecturas rápidas

Evita, eso sí, cambiar de modelo repetidamente dentro de una sesión. Las cachés de prompts son específicas de cada modelo, así que cada cambio obliga al nuevo modelo a reprocesar desde cero todo el historial a coste completo de tokens, en lugar de leerlo barato desde la caché. Esto puede agotar tu cuota más rápido que quedarte en el mismo, incluso si cambias a un modelo "más barato".

Cuando te topas con el muro: alternativa con la API

Si los límites de la suscripción se convierten en un cuello de botella, la API de Claude es una alternativa. El uso por API no te limita a ventanas de 5 horas ni a topes semanales. En su lugar, pagas según el consumo de tokens.

Este modelo suele encajar para:

  • Pipelines de CI
  • Agentes autónomos de larga duración
  • Automatización a gran escala
  • Flujos de producción con presupuestos previsibles

Ojo con dejar configurada la variable de entorno ANTHROPIC_API_KEY en tu shell de Claude Code. Si esa clave está presente, Claude Code puede autenticarse vía API en lugar de con tu suscripción.

Esto puede generar cargos imprevistos en la API, ya que dejarías de usar los límites de tu suscripción y pasarías a pagar por tokens. Cuando los costes te parezcan extraños, revisar la autenticación debería ser uno de los primeros pasos de diagnóstico.

Para los precios actuales de los modelos, consulta siempre la documentación oficial de Anthropic, ya que las tarifas cambian con frecuencia y varían según el modelo.

Reflexiones finales

Los límites de uso de Claude Code son más fáciles de gestionar cuando entiendes que no se trata simplemente de contar prompts.

El sistema combina:

  • Una ventana deslizante de 5 horas
  • Topes semanales
  • Asignaciones específicas por modelo
  • Sobrecarga de contexto

La gran sorpresa para muchos desarrolladores es que los prompts suelen ser minoría en el uso total de tokens. Archivos CLAUDE.md voluminosos, definiciones de herramientas MCP, memoria automática, búsquedas en repositorios y el historial creciente de conversación consumen con frecuencia más capacidad que las propias preguntas.

En la práctica, la mayoría de quienes llegan al límite inusualmente rápido tienen un problema de configuración más que de capacidad. Antes de mejorar el plan, reduce la sobrecarga limpiando el contexto en lugar de comprar más cuota.

Para seguir mejorando tu flujo de trabajo, te recomiendo nuestra guía de mejores prácticas de Claude Code y el tutorial de Claude Code Hooks, que cubren técnicas para que Claude Code sea más eficiente y resistente en sesiones largas de desarrollo.

Preguntas frecuentes sobre los límites de uso de Claude Code

¿Qué son los límites de uso de Claude Code?

Los límites de uso de Claude Code constan de una ventana de sesión deslizante de 5 horas y uno o varios topes semanales. Tanto Claude Code como el chat de Claude consumen del mismo cupo de suscripción.

¿Cómo consulto el uso de Claude Code?

Puedes consultar el uso con /usage dentro de Claude Code, /status para ver detalles de la cuenta, o el panel de Usage en Claude.ai en SettingsUsage.

¿Qué consume más tokens en Claude Code?

Los factores ocultos más habituales incluyen archivos CLAUDE.md grandes, esquemas de herramientas MCP, memoria automática, historial de conversación, salidas de herramientas y resultados de búsquedas en el repositorio.

¿Cómo puedo reducir el consumo de tokens de Claude Code?

Las mejores prácticas incluyen mantener concisos los archivos CLAUDE.md, desactivar servidores MCP que no uses, usar /compact de forma proactiva, eliminar archivos de memoria innecesarios, ajustar el modelo a la complejidad de la tarea y evitar búsquedas a nivel de todo el repositorio cuando no hagan falta.

¿Se ha lanzado el sistema de créditos del Agent SDK?

No. Anthropic planeó separar el uso programático del uso interactivo de Claude a partir del 15 de junio de 2026, pero pausó este cambio el mismo día del lanzamiento, indicando que "por ahora no cambia nada". Claude Agent SDK, claude -p, las GitHub Actions de Claude Code y las aplicaciones de terceros del Agent SDK siguen consumiendo actualmente de los mismos límites de suscripción que el uso interactivo de Claude Code.


Tim Lu's photo
Author
Tim Lu
LinkedIn

Soy un científico de datos con experiencia en análisis espacial, aprendizaje automático y canalización de datos. He trabajado con GCP, Hadoop, Hive, Snowflake, Airflow y otros procesos de ciencia/ingeniería de datos.

Temas

¡Aprende a usar Claude Code con DataCamp!

Curso

Software Development with Claude Code

4 h
5.1K
Claude Code brings AI assistance to your terminal. Learn the workflows that turn it into a reliable tool for real software development.
Ver detallesRight Arrow
Iniciar Curso
Ver másRight Arrow
Relacionado

blog

Cómo aprender PNL desde cero en 2026: Una guía experta

En esta guía, descubrirás cómo aprender el procesamiento del lenguaje natural (NLP) desde cero. Con un plan de aprendizaje claro y semanal, explorarás conceptos esenciales de la PNL, aplicaciones prácticas y proyectos prácticos para desarrollar tus habilidades.
Laiba Siddiqui's photo

Laiba Siddiqui

13 min

Tutorial

Primeros pasos con Claude 3 y la API de Claude 3

Conozca los modelos Claude 3, las pruebas de rendimiento detalladas y cómo acceder a ellas. Además, descubra la nueva API Python de Claude 3 para generar texto, acceder a funciones de visión y streaming.
Abid Ali Awan's photo

Abid Ali Awan

Tutorial

Ajuste fino de LLaMA 2: Guía paso a paso para personalizar el modelo de lenguaje grande

Aprende a ajustar Llama-2 en Colab utilizando nuevas técnicas para superar las limitaciones de memoria y computación y hacer más accesibles los grandes modelos lingüísticos de código abierto.
Abid Ali Awan's photo

Abid Ali Awan

ChatGPT Code Interpreter

Tutorial

Cómo utilizar ChatGPT Code Interpreter

Todo lo que necesitas saber sobre ChatGPT Code Interpreter de OpenAI
Adel Nehme's photo

Adel Nehme

Tutorial

DCLM-7B de Apple: Configuración, Ejemplo de uso, Ajuste fino

Empieza a utilizar el gran modelo de lenguaje DCLM-7B de Apple y aprende a configurarlo, utilizarlo y ajustarlo para tareas específicas.
Dimitri Didmanidze's photo

Dimitri Didmanidze

Tutorial

Tutorial de DeepSeek-Coder-V2: Ejemplos, instalación, puntos de referencia

DeepSeek-Coder-V2 es un modelo de lenguaje de código de código abierto que rivaliza con el rendimiento de GPT-4, Gemini 1.5 Pro, Claude 3 Opus, Llama 3 70B o Codestral.
Dimitri Didmanidze's photo

Dimitri Didmanidze

Ver MásVer Más