Curso
GPT-5.6 Sol de OpenAI llegó con reseñas que decían que había alcanzado a Anthropic. La firma de evaluación Vals AI dijo al New York Times que Sol estaba más o menos a la par de Claude Fable 5 en benchmarks estándar. La respuesta de Anthropic, en septiembre de 2026, es Claude Fable 5.1, al que define como el modelo más avanzado del mundo para programación y trabajo de conocimiento, junto a su gemelo restringido, Claude Mythos 5.1.
Fable 5.1 mantiene el precio de lista de Fable 5 de $10 por millón de tokens de entrada y $50 por millón de tokens de salida, y reduce las lecturas de caché un 75% hasta $0.25 por millón. Anthropic sitúa el ahorro práctico en torno al 25% para cargas típicas facturadas por token, y de hasta aproximadamente el 45% para flujos altamente agentivos. Ofrece una ventana de contexto de 1M de tokens con un máximo de salida de 128K, y más que duplica la puntuación de Fable 5 en Terminal-Bench-Science 0.1.
En este artículo, cubro todas las novedades de Claude Fable 5.1: sus nuevas funciones, los resultados en benchmarks y cuánto cuesta realmente ponerlo en producción. También puedes ver nuestras guías de Claude Fable 5 y la comparativa Claude Opus 5 vs Claude Fable 5.
Resumen
- Claude Fable 5.1 es el modelo de frontera de disponibilidad general de Anthropic para programación y trabajos de investigación de largo recorrido.
- El precio de lista no cambia respecto a Fable 5, así que el ahorro viene íntegramente de un contexto en caché mucho más barato.
- Ahora supera a Claude Opus 5 en todos los benchmarks publicados por Anthropic, revirtiendo filas donde antes ganaba Opus 5.
- Úsalo para ejecuciones agentivas desatendidas y mantente en Sonnet 5 u Opus 5 para chat y redacción del día a día.
- Claude Mythos 5.1 es el mismo modelo con salvaguardas de ciberseguridad y biología más laxas, disponible solo por invitación.
¿Qué es Claude Fable 5.1?
Claude Fable 5.1 es el modelo de frontera de disponibilidad general de Anthropic para razonamiento exigente y trabajos agentivos de largo horizonte. Se sitúa en la parte alta de la familia Claude por precio, por encima de Claude Opus 5 a $5 / $25 por millón de tokens y Claude Sonnet 5 a $2 / $10, y la documentación de Anthropic lo califica como más lento que ambos en latencia.
¿Qué obtienes a cambio? La capacidad de Fable 5 al precio de lista, más lecturas de caché a una cuarta parte de lo que costaban. El pensamiento es adaptativo y siempre está activo, regulado por un ajuste de esfuerzo que en la API de Claude viene por defecto en high. Su límite de conocimiento es junio de 2026.
El dato clave es Terminal-Bench-Science 0.1, un benchmark de investigación científica agentiva, donde Fable 5.1 logra un 52.6% frente al 24.7% de Fable 5. Anthropic lo acompaña con un caso de la gestora Millennium, cuyo senior portfolio manager describió un fallo improbable —de uno entre un millón— que nadie del equipo había explicado en 4 o 5 años. Fable 5.1 desensambló una librería de un proveedor externo, la cotejó con el volcado de memoria y rastreó el fallo hasta un bug en esa librería.
¿Qué es Claude Mythos 5.1?
Claude Mythos 5.1 es el mismo modelo que Fable 5.1 con salvaguardas más permisivas, accesible solo a través de los programas de acceso de confianza de Anthropic. No es un modelo más grande ni una arquitectura distinta, y Anthropic no ha publicado un precio separado para él. La única diferencia es lo que le permiten hacer las salvaguardas.
El acceso actualmente alcanza a un conjunto de organizaciones de EE. UU., con una ampliación prevista. Lo regulan dos programas, ambos en colaboración con el gobierno de EE. UU.:
- El Cyber Verification Program cubre trabajo de seguridad defensiva.
- El Life Sciences Verification Program cubre I+D profesional en ciencias de la vida.
La brecha entre los gemelos se nota en programación: Mythos 5.1 logra un 60.9% en Terminal-Bench 4.0 frente al 55.8% de Fable 5.1. Decrypt atribuyó esa diferencia a las salvaguardas extra de Fable, que desvían algunas tareas de riesgo a Claude Opus 4.8, como explicamos en nuestro tutorial de Claude Fable 5. Claude Security, el producto de Anthropic para escanear código y proponer parches para revisión humana, ahora funciona sobre Mythos 5.1, y nuestra guía de Claude Mythos 5 explica cómo funcionó la generación anterior de esta división.
Funciones clave de Claude Fable 5.1
Cinco cambios en Fable 5.1 amplían lo que realmente puedes hacer con un modelo Claude, y uno de ellos es una decisión de precios más que de capacidad.
Deja un agente de programación funcionando toda la noche
Puedes encargar a Fable 5.1 un trabajo de varias horas y volver con el trabajo terminado en lugar de un bucle atascado. Los socios de acceso temprano de Anthropic fueron inusualmente concretos:
- Ron Sanzone, en MongoDB, describió un prototipo construido en unos 3 días, donde el modelo primero investigó su código y documentación de servicios, produjo un diseño y luego ejecutó durante horas sin supervisión con bucles de verificación.
- Dwight Temple, en Ramp, reportó una única ejecución desatendida de 38 horas en un problema de machine learning que diagnosticó un resultado previo como un artefacto de etiquetado, lo corrigió, lanzó 6 experimentos en paralelo por la noche y volvió con un resultado y los siguientes pasos.
- Ben Lafferty, en Shopify, lo dijo claro: el modelo lleva su propio registro, reordena prioridades a medida que cambian las cosas y retoma justo donde lo dejó.
La ventana de contexto de 1M de tokens y la salida máxima de 128K son las que hacen posibles ejecuciones tan largas, y Craig Falls, de Jane Street, señaló que Fable 5.1 se mantiene legible a lo largo de tareas largas y de múltiples pasos donde modelos anteriores se volvían difíciles de seguir.
Anthropic midió la seguridad agentiva de este modelo como Mythos 5.1, los mismos pesos con salvaguardas más laxas, y afirma que es el modelo más difícil de romper que han publicado en un benchmark externo de prompt injection. Su auditoría de comportamiento automatizada encontró que Mythos 5.1 intenta y consigue hacer reward hacking con menos frecuencia que Mythos 5, y es menos propenso a buscar recursos fuera de su entorno de prueba cuando se le entrega una tarea imposible.
Anthropic también señala la laguna de ese trabajo: la auditoría tiene menos visibilidad en contextos muy largos y en configuraciones multiagente, precisamente el territorio que ocupa una ejecución de 38 horas.
Mantén un agente de clase Fable asequible con contexto en caché
Las lecturas de caché ahora cuestan $0.25 por millón de tokens, un 75% menos, lo que cambia la aritmética de cualquier bucle agentivo que relee el mismo contexto en cada turno. Anthropic estima alrededor de un 25% menos de coste para cargas típicas facturadas por token, y hasta aproximadamente un 45% para tareas de programación complejas y altamente agentivas. Si el almacenamiento en caché de prompts es nuevo para ti, nuestra guía de prompt caching explica la mecánica.
Busca vulnerabilidades de software sin negativas constantes
Fable 5.1 ahora puede utilizarse para descubrir vulnerabilidades de software, aunque no para desarrollar exploits de ellas. Anthropic afirma que sus salvaguardas de ciberseguridad más recientes bloquean un 60% menos de falsos positivos que antes, y que los usuarios de Claude Code deberían ver de media alrededor de un 60% menos de intervenciones por sesión.
Los límites no han desaparecido. Las pruebas de penetración, la generación de exploits y el escaneo de vulnerabilidades basadas en binarios siguen redirigiéndose a los modelos Opus de Anthropic, igual que el trabajo de investigación y desarrollo en ciencias de la vida. En el lado de biología, las salvaguardas de Fable 5.1 y Fable 5 ahora se activan un 85% menos en preguntas benignas de biología elemental y medicina, lo que corrige el problema de falsos positivos más que la restricción de capacidad.
Entrégale un problema de investigación y deja que profundice
Fable 5.1 entrenó una red neuronal que produjo un nuevo mapa de elevación de alta resolución que cubre un tercio de Venus, a partir de imágenes de radar tomadas por la misión Magellan de la NASA hace más de 30 años. El mapa resuelve detalles de 2 a 3 kilómetros en lugar de 10 a 20, y sus alturas son hasta un 25% más precisas que antes. Anthropic lo publicó con licencia Creative Commons en Zenodo, por delante de las misiones NASA VERITAS y ESA EnVision.
Mythos 5.1 llevó los resultados en ciencias de la vida, algo a tener en cuenta si lees el anuncio por encima. Diseñó proteínas ligando con afinidades 10 veces mayores que los mejores diseños enviados a las competiciones de Adaptyv Bio en 3 dianas, y alcanzó una tasa de ligandos viables de casi el 50% en 12 dianas, donde hoy lo típico es entre el 10% y el 15%. También escribió kernels de GPU a medida que aceleraron 7 modelos de deep learning de código abierto hasta 2.5 veces con salidas idénticas, reduciendo los costes estimados de GPU en análisis genómicos de un 30% a un 60%.
Si trabajas en laboratorio, la vía de acceso importa tanto como la capacidad. El programa AI for Science de Anthropic ofrece créditos gratuitos a investigadores en proyectos de alto impacto, y existe un plan Claude Team con un gran descuento para científicos. La compañía ha adelantado un Estándar de Hardware de Modelos que permite a Claude operar equipamiento de laboratorio directamente.
Mantén los datos de tu empresa en tu propia nube
Enterprise Frontier Safeguards (EFS) almacena los datos del cliente en su propia infraestructura cloud en lugar de la de Anthropic, lo que ofrece la privacidad de un acuerdo de no retención de datos y, aun así, permite la detección de usos indebidos. La revisión humana corre a cargo del cliente por defecto. Anthropic creó EFS con más de 100 clientes y con sus socios cloud en Amazon Web Services, Google Cloud y Microsoft Azure.
Llega por fases a partir de este otoño, cubriendo Claude Code, Claude Enterprise, la Claude Platform, Amazon Bedrock, Google's Agent Platform y Microsoft Foundry. Hasta que aterrice, los clientes elegibles pueden ejecutar Fable 5.1 con no retención de datos.
¿Cómo rinde Claude Fable 5.1 en los benchmarks?
Fable 5.1 supera a Claude Opus 5 en todos los benchmarks publicados por Anthropic, algo que VentureBeat destacó por revertir casos anteriores donde Opus 5 lideraba la familia. Las mayores ganancias frente a Fable 5 se dan en ciencia agentiva y programación en terminal, y las menores en razonamiento académico.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
| GDPval-AA v2 (Elo) | 1853 | 1723 | 1824 | 1711 |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| Humanity's Last Exam (with tools) | 65.0% | 63.8% | 63.6% | Not published |
| OSWorld 2.0 (strict) | 41.7% | 36.1% | 39.6% | Not published |
Todas estas cifras son de Anthropic, medidas con las salvaguardas de producción de Fable 5.1 activadas.
Investigación científica agentiva y programación en terminal
Aquí la brecha generacional salta a la vista. En Terminal-Bench-Science 0.1, que evalúa investigación científica agentiva en una terminal, Fable 5.1 alcanza un 52.6% frente al 24.7% de Fable 5, el 29.0% de Opus 5 y el 22.4% de GPT-5.6 Sol.

Mira el margen, no el decimal. Anthropic informa de un error estándar de ±3.5 a 4.5 puntos por modelo en ese benchmark, y señala que el ranking público sitúa a Opus 5 en 30.0% y a Fable 5 en 21.4%, valores que su propio montaje reproduce dentro del ruido.
Terminal-Bench 4.0, que prueba programación y depuración en línea de comandos por pasos, da a Fable 5.1 un 55.8% frente al 42.0% de Fable 5 y el 52.3% de Opus 5. En CursorBench 3.2.0, que puntúa la programación dentro de un IDE, alcanza un 73.4%, unos puntos por encima de Fable 5 (70.5%) y Opus 5 (70.0%).
Trabajo de conocimiento y flujos de negocio
El trabajo de conocimiento mejora, pero no en el mismo orden. En GDPval-AA v2, una métrica tipo Elo de calidad en trabajo de conocimiento, Fable 5.1 logra 1853 frente a 1824 de Opus 5 y 1723 de Fable 5. Comparado con Opus 5 es un paso moderado; frente a Fable 5, es un salto real.
AutomationBench, que cubre automatización de flujos de negocio, los separa mucho más: 31.4% para Fable 5.1, 26.9% para Opus 5 y 17.1% para Fable 5. Anthropic señala que Fable 5 obtuvo cero en tareas donde intervinieron sus salvaguardas de producción, así que toma esa última cifra como un suelo.
Razonamiento y uso del ordenador
El razonamiento académico es la fila más plana. Humanity's Last Exam sitúa a Fable 5.1 en 60.9% sin herramientas y 65.0% con ellas, frente a 57.8% y 63.8% de Fable 5, y 56.6% y 63.6% de Opus 5. Anthropic no publicó puntuación de GPT-5.6 Sol para este benchmark.
El uso del ordenador parece más fuerte y es más difícil de comparar. Fable 5.1 lidera OSWorld 2.0 con 77.9% en el ajuste parcial y 41.7% en el estricto, frente a 75.4% y 39.6% de Opus 5. Anthropic puntuó estos resultados con la versión de tareas de agosto de 2026 de los autores del benchmark, por lo que no son comparables con cifras previas de OSWorld 2.0, y ambos Fable anotaron ceros en tareas donde intervinieron salvaguardas.
Un matiz recorre toda la tabla: cuando las salvaguardas bloquearon una tarea, Anthropic completó trabajo de ciberseguridad con Claude Opus 4.8 y de biología con Claude Opus 5, lo que, según indica, probablemente reduce las puntuaciones reportadas de Fable en lugar de favorecerlas.
¿Qué nivel de Claude deberías usar?
Fable 5.1 es la opción por defecto solo cuando una tarea dura lo suficiente como para que un giro equivocado cueste más que los tokens. Para todo lo más corto, la propia familia de Anthropic lo supera en precio y en latencia, y Sonnet 5 es la elección sensata del día a día, más que cualquiera de los buques insignia.

El sistema de variantes tiene dos ejes. Fable 5.1 y Mythos 5.1 son un mismo modelo separado por salvaguardas, y sobre ambos hay un ajuste de esfuerzo con niveles Low, Medium y High. Anthropic informa de que Fable 5.1 en Low o Medium iguala o supera a Fable 5 a un coste mucho menor, lo que convierte el dial de esfuerzo en un control de coste más que en un selector de calidad.
Los valores por defecto cambian según la superficie, algo importante antes de juzgar el modelo por una sola sesión. Fable 5.1 viene por defecto en High en Claude Code, en Medium en Claude Cowork y en Claude.ai, y en high en la API de Claude.
| Caso de uso | Elección | Por qué |
|---|---|---|
| Ejecuciones agentivas desatendidas de varias horas | Fable 5.1 en High | Mantiene un plan en trabajos largos y las lecturas de caché a $0.25 mantienen el bucle asequible |
| Planificación y revisión exhaustiva de repositorios | Opus 5 | La misma ventana de contexto de 1M y pensamiento adaptativo a mitad de precio, $5 / $25, con latencia moderada en lugar de lenta |
| Programación y chat cotidianos | Sonnet 5 | $2 / $10 para una ventana de contexto de 1M, y Anthropic lo califica como rápido |
| Trabajo de alto volumen o sensible a la latencia | Haiku 4.5 | $1 / $5 y el más rápido de la familia, aunque baja a ventana de 200K y salida máxima de 64K |
| Investigación defensiva de vulnerabilidades y trabajo en ciencias de la vida | Mythos 5.1 | La única vía más allá de salvaguardas que desvían este trabajo a modelos Opus |
| Trabajo agentivo que quieres en Fable pero no puedes costear en High | Fable 5.1 en Low o Medium | Anthropic reporta resultados al nivel o por encima de Fable 5 por mucho menos |
Precio y disponibilidad de Claude Fable 5.1
Fable 5.1 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida, exactamente lo mismo que Fable 5. Las lecturas de caché concentran todo el cambio de precio, bajando un 75% hasta $0.25 por millón.
| Tarifa | Precio por millón de tokens |
|---|---|
| Entrada | $10 |
| Salida | $50 |
| Lectura de caché | $0.25 |
| Escritura de caché (5 minutos) | $12.50 |
| Escritura de caché (1 hora) | $20 |
| Batch API | 50% de descuento en entrada y salida |
La estimación de Anthropic del efecto neto es de alrededor de un 25% menos de coste para cargas típicas facturadas por token, y de hasta aproximadamente un 45% para tareas de programación complejas y altamente agentivas. No está publicado si los tokens de razonamiento se facturan a la tarifa de salida, algo más relevante aquí que en otros modelos, porque el pensamiento está siempre activo.
Fable 5.1 está disponible de forma general desde hoy en múltiples plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure. Mythos 5.1 no: llega a ciberdefensores y científicos de la vida verificados a través del CVP y el LSVP, actualmente un conjunto de organizaciones de EE. UU., y Anthropic está coordinando con el gobierno de EE. UU. para ampliarlo.
Dos cambios menores afectan a desarrolladores:
- Las nuevas cuentas de API creadas a partir del día de lanzamiento ya no pueden editar el contexto previo de Claude en una conversación multi-turno preservando la transcripción de su pensamiento anterior, una medida anti-destilación que se aplicará a todas las cuentas en futuras versiones.
- En virtud del Código de Prácticas de la Ley de IA de la UE sobre transparencia de contenido generado por IA, Anthropic también marca con agua las salidas de los modelos lanzados después del 2 de agosto de 2026, y una API de detección está en vista previa privada.
¿Cómo obtener acceso a Claude Fable 5.1?
El ID de modelo que los desarrolladores deben usar es claude-fable-5-1, disponible en la API de Claude desde el día del lanzamiento. Más allá de la API de primera parte, Fable 5.1 llega a Claude Code, Claude Cowork, Claude.ai y a las principales nubes, con Amazon Bedrock, Google's Agent Platform y Microsoft Foundry nombradas como superficies compatibles con EFS.
Una llamada mínima se ve así:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-fable-5-1",
max_tokens=1024,
messages=[
{"role": "user", "content": "Trace this crash to its root cause and explain the fix."}
],
)
print(response.content[0].text)
Para la configuración completa, incluido control de costes y streaming, consulta nuestra guía completa de la API de Claude. Nuestro tutorial de la API de Claude Fable 5 construye un asistente de tareas para desarrolladores en Python y solo necesita cambiar el ID de modelo, y nuestro artículo de buenas prácticas de Claude Code cubre el flujo en terminal, donde el esfuerzo High es el valor por defecto.
Reflexiones finales
Anthropic apuesta a que la frontera se mide en horas desatendidas más que en turnos de chat, y ha fijado el precio de Fable 5.1 para que esa apuesta salga barata. Mantener el precio de lista mientras recorta un 75% las lecturas de caché es un movimiento más interesante que cualquier fila de benchmarks, porque ataca la única carga donde una tarifa de salida de $50 es asumible.
Yo apagaría Fable 5 de inmediato y dejaría el trabajo diario en Sonnet 5 u Opus 5. Lo que me hace dudar es la cantidad de ceros por salvaguardas repartidos por la propia tabla de Anthropic, y el hecho de que los resultados científicos más llamativos llegaron de Mythos 5.1, al que casi nadie que lea esto puede acceder.
Si quieres poner un modelo de clase Fable a trabajar en tu propia terminal, te recomiendo nuestro curso Claude Code 101.
Preguntas frecuentes
¿Cómo se compara Claude Fable 5.1 con Claude Opus 5?
Claude Fable 5.1 supera a Claude Opus 5 en todos los benchmarks publicados por Anthropic, incluido un 52.6% frente a 29.0% en Terminal-Bench-Science 0.1 y 55.8% frente a 52.3% en Terminal-Bench 4.0. Opus 5 sigue costando la mitad: $5 / $25 por millón de tokens frente a los $10 / $50 de Fable 5.1, y Anthropic califica su latencia como moderada, mientras que Fable 5.1 es más lento. Usa Fable 5.1 para ejecuciones agentivas largas y desatendidas, y Opus 5 para programación y trabajo de conocimiento cotidianos.
¿Cuánto cuesta Claude Fable 5.1?
Fable 5.1 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida, sin cambios respecto a Fable 5. Las lecturas de caché bajaron un 75% hasta $0.25 por millón, las escrituras de caché cuestan $12.50 para la ventana de 5 minutos y $20 para la de 1 hora, y la Batch API aplica un 50% de descuento en entrada y salida. Anthropic estima aproximadamente un 25% menos de coste global en cargas típicas facturadas por token y hasta alrededor de un 45% en las altamente agentivas.
¿Dónde puedo acceder a Claude Fable 5.1?
Fable 5.1 está disponible de forma general en varias plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores lo invocan en la API de Claude con el ID de modelo claude-fable-5-1, y también está disponible en Claude Code, Claude Cowork y Claude.ai.
¿Cuál es la diferencia entre Claude Fable 5.1 y Claude Mythos 5.1?
Son el mismo modelo con salvaguardas distintas. Fable 5.1 está disponible de forma general, mientras que Mythos 5.1 tiene salvaguardas más permisivas en ciberseguridad y ciencias de la vida y está restringido al Cyber Verification Program y Life Sciences Verification Program de Anthropic, actualmente para un conjunto de organizaciones de EE. UU. Las salvaguardas más laxas se notan en programación, donde Mythos 5.1 logra un 60.9% en Terminal-Bench 4.0 frente al 55.8% de Fable 5.1.
¿Qué nivel de esfuerzo debería usar con Claude Fable 5.1?
Fable 5.1 viene por defecto en High en Claude Code, en Medium en Claude Cowork y en Claude.ai, y en high en la API de Claude. Anthropic informa que Low o Medium igualan o superan a Fable 5 a un coste mucho menor, así que los niveles bajos son un control de coste real más que una degradación. Reserva High para trabajo agentivo de largo horizonte donde un error cueste más que los tokens.
Editor de ciencia de datos en DataCamp | Me encanta hacer previsiones y crear con API.
