Curso
Estás metido de lleno en un refactor, Claude Code va avanzando, y de repente deja de responder. No hay cuelgue. No hay errores. Solo un aviso de que has alcanzado un límite de uso. Mucha gente piensa que pasa por enviar demasiados prompts. En realidad, los prompts son solo una parte pequeña de la ecuación. A mí me ha ocurrido y me llevó un tiempo entenderlo bien.
El sistema de límites de Claude Code combina ventanas de sesión deslizantes, topes semanales, asignaciones específicas por modelo y un contexto de fondo muy pesado en tokens que se envía con cada solicitud. Archivos de reglas, definiciones de herramientas MCP, archivos de memoria e historial de conversación pueden consumir gran parte de tu capacidad disponible antes incluso de que hayas tecleado mucho.
En esta guía te explico cómo funcionan los límites de uso de Claude Code, cómo consultar tu consumo actual y las fuentes ocultas de sobrecarga que hacen que muchos desarrolladores lleguen a los límites antes de lo esperado.
Si eres nuevo en Claude Code, te recomiendo echar un vistazo antes a nuestro tutorial de Claude Code o hacer el curso Claude Code 101.
Introducción a los modelos Claude
¿Qué son los límites de uso de Claude Code?
El uso de Claude Code está regido por dos sistemas que se solapan:
- Una ventana de sesión deslizante de 5 horas
- Uno o varios topes semanales de uso
Si alcanzas cualquiera de estos, te encontrarás con límites de tasa.
La ventana deslizante de 5 horas
El límite más visible de Claude Code es la ventana deslizante de 5 horas. Tu ventana empieza cuando envías tu primer prompt. Todo lo que hagas durante las siguientes cinco horas tira del mismo cupo. Este cupo se comparte entre Claude Code y el chat de Claude, así que la actividad en uno afecta al otro.
Por ejemplo:
- Primer prompt: 9:00
- La ventana termina: 14:00
Si agotas tu uso disponible a las 10:30, el acceso se pausa hasta que la ventana se reinicie a las 14:00.
Un error común es pensar que empezar una conversación nueva restablece el uso. No lo hace. El comando /clear solo inicia un contexto de conversación limpio. No recupera la asignación de uso ni reinicia el temporizador de 5 horas.
Límites semanales
Además de los límites por tiempo de sesión, Claude Code también impone límites semanales. Aunque aún te quede margen en tu sesión actual, alcanzar un tope semanal puede impedir temporalmente seguir usando el servicio hasta que llegue el reinicio semanal.
Piénsalo así: el tope de 5 horas limita el momento en que puedes usarlo, y el límite semanal pone techo a tu volumen total de uso.
Esto significa que puedes tener capacidad restante en tu sesión de 5 horas y aun así quedarte bloqueado porque has agotado tu asignación semanal. Para la mayoría de usuarios Pro, esta distinción es sencilla. Los planes Max, sin embargo, añaden una capa extra de complejidad.
Límite semanal de Sonnet para usuarios Max
Actualmente Anthropic aplica lo siguiente en los planes Max:
- Un límite semanal que cubre todos los modelos
- Un límite semanal aparte específicamente para el uso de Sonnet
Esta distinción importa porque podrías seguir teniendo capacidad de Sonnet incluso tras agotar tu asignación semanal general, o al revés.
Por ejemplo, imagina que pasas gran parte de la semana usando Sonnet para trabajo de implementación. Podrías agotar tu asignación semanal específica de Sonnet y aun así tener margen en tu tope semanal general. En ese punto, puede que tengas que cambiar de modelo, esperar al reinicio de Sonnet o mejorar tu plan, según los límites que te queden.
También puede pasar lo contrario. Si has utilizado mucho Opus durante la semana, podrías alcanzar tu límite semanal general aunque tu asignación específica de Sonnet no se haya consumido del todo. Como el límite general es el paraguas, alcanzarlo impide seguir usando el servicio independientemente de la capacidad que quede para Sonnet.
Para que las solicitudes a Sonnet tengan éxito, deben cumplirse ambas condiciones:
- Que sigas teniendo margen en tu límite semanal general.
- Que sigas teniendo margen en tu límite semanal de Sonnet.
Las solicitudes a Opus, en cambio, solo consumen del cupo semanal general porque no hay una asignación específica para Opus. Por eso la página de Usage en Claude.ai es tan importante. Muestra cada límite semanal por separado junto con su hora de reinicio, lo que facilita mucho entender qué límite estás a punto de alcanzar antes de una sesión larga de código.

Uso de Claude Code según el plan
Un reto al comparar planes es que Anthropic ya no publica simples "recuentos de prompts".
En su lugar, los planes se describen con multiplicadores de capacidad relativos. Estos multiplicadores reflejan la capacidad que recibes en comparación con la base del plan Pro. No es sencillo obtener cifras exactas; algunas personas hacen un seguimiento de su uso como porcentaje para aproximar cuántos tokens consumen por porcentaje de capacidad.
|
Plan |
Precio mensual |
Capacidad relativa |
Límites semanales |
Compartido con Claude Chat |
|
Pro |
$20 |
De referencia |
Sí |
Sí |
|
Max 5x |
$100 |
5× capacidad Pro |
Sí |
Sí |
|
Max 20x |
$200 |
20× capacidad Pro |
Sí |
Sí |
|
Team |
Variable |
Asignación compartida superior |
Sí |
Sí |
|
Enterprise |
A medida |
Específica de la organización |
Sí |
Sí |
Cambios en los límites de uso en mayo de 2026
En mayo de 2026, Anthropic amplió la capacidad de Claude Code al duplicar los límites de uso por suscripción y eliminar las reducciones en horas punta que afectaban a suscriptores Pro y Max. En lugar de publicar recuentos fijos de prompts, ahora expresa las diferencias entre planes como multiplicadores relativos de capacidad porque el uso real depende del modelo elegido, el tamaño del contexto y el uso de herramientas.
Desde entonces, Anthropic ha ajustado ocasionalmente los límites semanales mediante promociones temporales. Por ejemplo, durante el despliegue de Claude Fable 5, se aumentaron en un 50% los límites semanales de Claude Code para suscriptores elegibles. Como estos incrementos promocionales son temporales, conviene comprobar siempre los límites más recientes en el panel de Usage de Claude antes de planificar cargas de trabajo de larga duración.
Créditos de Agent SDK (junio de 2026)
El plan para separar las sesiones interactivas de código de las cargas de trabajo de agentes automatizados generó cierta confusión en junio de 2026.
Antes del 15 de junio, toda la actividad de Claude Code consumía del mismo cupo de suscripción. Tanto si chateabas en el terminal, ejecutabas una GitHub Action o llamabas a claude -p en un pipeline de CI, todo competía por los mismos límites de cinco horas y semanales.
Anthropic tenía previsto empezar a dividir estas cargas el 15 de junio de 2026, pero pausó el cambio el mismo día del lanzamiento. Esto significa que el uso interactivo y el programático (Agent SDK, claude -p, GitHub Actions) siguen consumiendo del mismo cupo de suscripción que antes.
A julio de 2026, no existe un crédito de Agent SDK separado en producción, ni hay un crédito opcional que activar.
¿Qué está drenando realmente tu cuota?
Muchos desarrolladores se centran en los prompts y el ajuste fino de tokens. El verdadero culpable suele ser el contexto. Cada interacción contiene bastante más información que la pregunta que escribes.
CLAUDE.md y archivos de reglas
Claude Code carga instrucciones automáticamente desde:
-
CLAUDE.md -
Archivos
CLAUDE.mddel directorio padre -
Referencias importadas con
@ -
Archivos
.claude/rules/*.md
Todo este contexto e instrucciones adicionales se incluyen repetidamente en las solicitudes. Esto significa que un archivo de reglas inflado aumenta silenciosamente el consumo de tokens durante toda la sesión. Anthropic recomienda mantener cada archivo CLAUDE.md por debajo de unas 200 líneas.
Para proyectos grandes, plantéate dividir las instrucciones en reglas acotadas con frontmatter de rutas para que solo se carguen cuando proceda. Si quieres profundizar, nuestra guía para escribir el mejor archivo CLAUDE.md cubre estrategias de organización eficaces.
Definiciones de herramientas MCP
Los servidores del Model Context Protocol (MCP) son otra fuente oculta de sobrecarga. Cada servidor MCP conectado inyecta esquemas de herramientas en el contexto de Claude, aunque no llegues a usarlas.
Imagina:
- 5 servidores MCP
- 10 herramientas por servidor
Son 50 definiciones de herramientas incluidas en cada solicitud. Desconectar los servidores MCP que no uses es una de las formas más sencillas de reducir el consumo de tokens de Claude Code.
Un matiz importante: evita añadir o quitar servidores MCP durante una sesión activa. Hacerlo invalida los prefijos de la caché de prompts y puede aumentar el coste de uso.
Memoria automática
Desde Claude Code v2.1.59, la memoria automática está activada por defecto. La memoria es conocimiento global que Claude guarda entre sesiones, dándole más contexto. Puede ir desde métodos para extraer datos de una base de datos hasta detalles técnicos ya implementados.
Al iniciar, Claude carga contenido de MEMORY.md hasta:
- Las primeras 200 líneas
- Los primeros 25 KB
Para algunos flujos de trabajo es útil. Para otros, es contexto de más.
Puedes desactivar la memoria automática de un par de maneras. Para un interruptor permanente que anule cualquier otra configuración (útil en pipelines de CI y entornos automatizados), define la variable de entorno en tu shell:
export CLAUDE_CODE_DISABLE_AUTO_MEMORY=1
También puedes añadir lo siguiente a tu settings.json. Usa ~/.claude/settings.json para desactivarlo en todos los proyectos, o .claude/settings.json para un único proyecto:
{ "autoMemoryEnabled": false }
Si no usas activamente archivos de memoria, desactivar esta función puede reducir el tamaño de contexto base.
Historial de conversación y búsquedas
El historial de conversación crece de forma continua. Cada resultado de herramienta, lectura de archivos, salida de grep, comando de terminal y búsqueda de código pasa a formar parte del contexto de la sesión.
En mi experiencia, la exploración del repositorio suele ser lo que más contribuye. Claude puede leer decenas de archivos solo para encontrar una función. Esos archivos se mantienen en contexto y siguen sumando sobrecarga de tokens en turnos futuros.
Para flujos automatizados, claude -p --bare puede reducir gran parte de esta sobrecarga fija al eliminar el contexto de sesión innecesario. Esto puede ahorrar muchos créditos mensuales de Agent SDK que, de otro modo, se quemarían buscando archivos con Claude.
Cómo consultar tu uso de Claude Code
El mejor momento para revisar tu uso es antes de una sesión larga de código. Así sabrás lo cerca que estás de los límites antes de ponerte a programar.
Usando /usage
Dentro de Claude Code, al escribir /usage verás:
- Consumo de la sesión
- Consumo semanal
- Asignación restante
Es una forma estupenda de tener una vista general de la cuota que te queda en tu sesión interactiva y poder planificar. Empezar una tarea compleja justo antes de tocar el límite quizá no sea lo más inteligente, pero tareas sencillas como limpiar archivos pueden ser un buen uso de la cuota que quede.
Usando /status
También puedes ejecutar /status, que te da la siguiente información:
- Plan actual
- Información de la cuenta
- Estado de uso activo
Conocer tu plan y estado activo te ayuda a anticipar limitaciones. Importa si tu uso es 5× o 20× respecto a la base.
Revisando el panel de Claude
La vista más completa está en Settings → Usage en Claude.ai.

Este panel combina:
- Uso del chat de Claude
- Uso de Claude Code
- Calendarios de reinicio semanal
- Límites específicos por modelo
Como pueden existir varios límites a la vez, trata este panel como la fuente de verdad. Un hábito práctico es revisarlo antes de empezar refactors importantes, sesiones largas de depuración o tareas autónomas de codificación.
Cómo exprimir al máximo tus límites de Claude Code
Hablemos de cómo ampliar los límites sin mejorar el plan. A veces, con reducir la sobrecarga conseguimos mucha más capacidad efectiva.
Recorta tu CLAUDE.md
Intenta no superar las 200 líneas por archivo para minimizar el contexto que envías y evitar confundir al agente. Fíjate en:
- Instrucciones de proyecto desactualizadas
- Notas históricas
- Reglas que encajarían mejor en prompts puntuales
Si las instrucciones solo importan para directorios concretos, usa reglas acotadas con frontmatter paths, para que no se apliquen todas constantemente, sino solo en las rutas pertinentes. También puedes tener archivos CLAUDE.md a nivel de proyecto en vez de uno global.
Audita tus servidores MCP
Conserva solo los servidores MCP que estés usando de verdad. Cada servidor conectado añade sobrecarga de esquemas a cada interacción. Trata tu configuración MCP como las pestañas del navegador: si no lo usas ahora, ciérralo.
Una buena forma de gestionarlos es instalarlos a nivel de proyecto cuando sabes que solo necesitas ciertos MCP para proyectos concretos, en lugar de a nivel de usuario. Así Claude no intentará cargarlos en cada proyecto o sesión, solo cuando los necesites para un caso de uso específico.
Usa /compact pronto
El comando /compact resume el historial de la conversación y reduce el coste de tokens a futuro. Al frenar el crecimiento del contexto que se procesa en cada turno, reducimos el uso de la cuota.
No recupera la cuota ya consumida, pero es útil si lo usas antes de que la sesión se vuelva demasiado grande.
Ajusta el modelo a la tarea
No todas las tareas necesitan Opus o Fable. A veces, modelos más pequeños o un uso más inteligente de los modelos ayudan a gestionar la cuota. A menudo puedes aumentar mucho tu capacidad disponible reservando los modelos premium para trabajo de alto valor.
Algunas estrategias de optimización por modelo:
- Usa Opus para decisiones de arquitectura, razonamiento complejo y requisitos ambiguos
- Sonnet para edición, búsquedas y trabajo de implementación
- Haiku para tareas ligeras y lecturas rápidas
Evita, eso sí, cambiar de modelo repetidamente dentro de una sesión. Las cachés de prompts son específicas de cada modelo, así que cada cambio obliga al nuevo modelo a reprocesar desde cero todo el historial a coste completo de tokens, en lugar de leerlo barato desde la caché. Esto puede agotar tu cuota más rápido que quedarte en el mismo, incluso si cambias a un modelo "más barato".
Cuando te topas con el muro: alternativa con la API
Si los límites de la suscripción se convierten en un cuello de botella, la API de Claude es una alternativa. El uso por API no te limita a ventanas de 5 horas ni a topes semanales. En su lugar, pagas según el consumo de tokens.
Este modelo suele encajar para:
- Pipelines de CI
- Agentes autónomos de larga duración
- Automatización a gran escala
- Flujos de producción con presupuestos previsibles
Ojo con dejar configurada la variable de entorno ANTHROPIC_API_KEY en tu shell de Claude Code. Si esa clave está presente, Claude Code puede autenticarse vía API en lugar de con tu suscripción.
Esto puede generar cargos imprevistos en la API, ya que dejarías de usar los límites de tu suscripción y pasarías a pagar por tokens. Cuando los costes te parezcan extraños, revisar la autenticación debería ser uno de los primeros pasos de diagnóstico.
Para los precios actuales de los modelos, consulta siempre la documentación oficial de Anthropic, ya que las tarifas cambian con frecuencia y varían según el modelo.
Reflexiones finales
Los límites de uso de Claude Code son más fáciles de gestionar cuando entiendes que no se trata simplemente de contar prompts.
El sistema combina:
- Una ventana deslizante de 5 horas
- Topes semanales
- Asignaciones específicas por modelo
- Sobrecarga de contexto
La gran sorpresa para muchos desarrolladores es que los prompts suelen ser minoría en el uso total de tokens. Archivos CLAUDE.md voluminosos, definiciones de herramientas MCP, memoria automática, búsquedas en repositorios y el historial creciente de conversación consumen con frecuencia más capacidad que las propias preguntas.
En la práctica, la mayoría de quienes llegan al límite inusualmente rápido tienen un problema de configuración más que de capacidad. Antes de mejorar el plan, reduce la sobrecarga limpiando el contexto en lugar de comprar más cuota.
Para seguir mejorando tu flujo de trabajo, te recomiendo nuestra guía de mejores prácticas de Claude Code y el tutorial de Claude Code Hooks, que cubren técnicas para que Claude Code sea más eficiente y resistente en sesiones largas de desarrollo.
Preguntas frecuentes sobre los límites de uso de Claude Code
¿Qué son los límites de uso de Claude Code?
Los límites de uso de Claude Code constan de una ventana de sesión deslizante de 5 horas y uno o varios topes semanales. Tanto Claude Code como el chat de Claude consumen del mismo cupo de suscripción.
¿Cómo consulto el uso de Claude Code?
Puedes consultar el uso con /usage dentro de Claude Code, /status para ver detalles de la cuenta, o el panel de Usage en Claude.ai en Settings → Usage.
¿Qué consume más tokens en Claude Code?
Los factores ocultos más habituales incluyen archivos CLAUDE.md grandes, esquemas de herramientas MCP, memoria automática, historial de conversación, salidas de herramientas y resultados de búsquedas en el repositorio.
¿Cómo puedo reducir el consumo de tokens de Claude Code?
Las mejores prácticas incluyen mantener concisos los archivos CLAUDE.md, desactivar servidores MCP que no uses, usar /compact de forma proactiva, eliminar archivos de memoria innecesarios, ajustar el modelo a la complejidad de la tarea y evitar búsquedas a nivel de todo el repositorio cuando no hagan falta.
¿Se ha lanzado el sistema de créditos del Agent SDK?
No. Anthropic planeó separar el uso programático del uso interactivo de Claude a partir del 15 de junio de 2026, pero pausó este cambio el mismo día del lanzamiento, indicando que "por ahora no cambia nada". Claude Agent SDK, claude -p, las GitHub Actions de Claude Code y las aplicaciones de terceros del Agent SDK siguen consumiendo actualmente de los mismos límites de suscripción que el uso interactivo de Claude Code.
Soy un científico de datos con experiencia en análisis espacial, aprendizaje automático y canalización de datos. He trabajado con GCP, Hadoop, Hive, Snowflake, Airflow y otros procesos de ciencia/ingeniería de datos.


