Ir al contenido principal

GPT-5.6 Sol, Terra y Luna: la próxima generación de modelos de OpenAI

GPT-5.6 de OpenAI presenta los modelos Sol, Terra y Luna. Desglosamos benchmarks, precios y su comparación con GPT-5.5, Claude y Gemini.
Actualizado 23 sept 2026  · 8 min leer

Explorar con IA

ChatGPTClaudePerplexity

Nota: OpenAI lanzó GPT-6 Astra el 3 de septiembre de 2026 y GPT-6 Sol y Luna el 23 de septiembre de 2026.

GPT-5.6 es una serie de tres modelos que hoy se lanza en un acceso anticipado limitado coordinado con el gobierno de EE. UU. 

Aún no está disponible para uso general, pero ya hay muchas novedades sobre capacidades, especialmente en programación, biología y ciberseguridad, que veremos a continuación.

Si quieres revisar lanzamientos anteriores de OpenAI, tenemos reseñas de cada versión: GPT-5.5 Instant, GPT-5.3 Instant y GPT-5.2. 

Y si quieres comparar GPT-5.6 con los modelos disponibles más recientes, también tenemos artículos: Gemini 3.1 Pro, Claude Opus 5, Claude Mythos 5, Claude Fable 5. 

¿Qué es GPT-5.6?

GPT-5.6 es la nueva generación de modelos de OpenAI. En realidad es una familia de tres modelos y, por fin, llega con una nueva convención de nombres.

En el nuevo sistema, el número indica la generación (5.6) y el nombre define el nivel de capacidad (Sol, Terra, Luna). Una ventaja de esta convención es que cada nivel puede avanzar a su propio ritmo y será menos confuso. "Instant" no era el mejor nombre para señalar el modelo subyacente más reciente.

¿Qué es GPT-5.6 Sol?

Sol es el buque insignia y el modelo más potente y capaz de la serie. Es el nivel con el que OpenAI lidera en todos los benchmarks del lanzamiento, y es el único modelo que desbloquea el esfuerzo de razonamiento max y el modo ultra (más sobre ambos abajo).

Sol también es donde los avances en ciberseguridad y biología son más marcados. Es el modelo a elegir si buscas el mayor techo en problemas complejos de varios pasos y no te importa pagar más por token.

Lo comparamos con los nuevos modelos insignia de Anthropic y SpaceXAI, Claude Opus 5 y Grok 4.6.

¿Qué es GPT-5.6 Terra?

Terra es el modelo equilibrado para el trabajo del día a día. Piénsalo como el predeterminado. Ofrece un rendimiento competitivo con GPT-5.5 siendo aproximadamente 2 veces más barato. Es probable que veamos esto en adelante: calidad de buque insignia de la generación anterior a precio intermedio. 

¿Qué es GPT-5.6 Luna?

Luna es el nivel rápido y asequible. Está pensado para cargas de alto volumen, sensibles a la latencia o con presupuesto ajustado. Como verás en la tabla de benchmarks más abajo, "más barato" no significa necesariamente "más débil" en todas las tareas. Conviene no pasarlo por alto.

En resumen: 

  • Sol es el modelo más potente y con la pila de seguridad más completa
  • Terra es similar a GPT‑5.5 pero más barato
  • Luna es el de menor coste.

¿Qué más trae GPT-5.6?

Esta actualización añade nuevas formas de aumentar el razonamiento y amplía capacidades en varios dominios concretos.

Dos formas nuevas de exigirle más al modelo

GPT-5.6 introduce dos nuevos controles:

  • max reasoning effort: un nuevo ajuste de esfuerzo de razonamiento que da a Sol más tiempo para pensar un problema.

  • ultra mode: este es más interesante. En lugar de un único agente trabajando la tarea, ultra usa subagentes.

Si miras los benchmarks de abajo, verás que ultra aparece como una línea propia ("GPT-5.6 Sol Ultra") y firma la mejor puntuación.

Mejor en código

GPT-5.6 Sol marca un nuevo estado del arte en Terminal-Bench 2.1, publicado hace unas seis semanas. La versión más reciente de Terminal-Bench evalúa flujos de trabajo en la línea de comandos que requieren iteración y coordinación de herramientas. Veremos las cifras en la sección de benchmarks.

Mejor en biología

Este es un benchmark menos conocido: GeneBench v1. Evalúa análisis de genómica y biología cuantitativa de largo recorrido. Según el lanzamiento, GPT-5.6 Sol logra mejores resultados que GPT-5.5 usando menos tokens. 

Mejor (y más controlada) ciberseguridad

OpenAI califica GPT-5.6 Sol como su modelo más capaz hasta la fecha en ciberseguridad y dedica buena parte del anuncio a ello. Sol desplaza la frontera rendimiento/eficiencia en tareas de seguridad de largo recorrido, incluida la investigación y explotación de vulnerabilidades. El anuncio cita más éxitos en benchmarks menos conocidos: 

  • En ExploitBench, OpenAI dice que GPT-5.6 Sol compite con el modelo (no publicado) Mythos Preview usando solo alrededor de un tercio de los tokens de salida.
  • En ExploitGym, un benchmark creado por investigadores de UC Berkeley, los tres modelos muestran mejoras claras a medida que aumenta el razonamiento.

Resultados de benchmarks de GPT-5.6

El titular aquí es el resultado en Terminal-Bench 2.1, que mencioné antes. Así quedan los modelos, de mayor a menor puntuación:

Modelo Terminal-Bench 2.1
GPT-5.6 Sol Ultra 91.9%
GPT-5.6 Sol 88.8%
GPT-5.5 88.0%
GPT-5.6 Luna 84.3%
Claude Mythos 5 84.3%
Claude Fable 5 83.4%
GPT-5.6 Terra 82.5%
Claude Opus 4.8 78.9%
Gemini 3.1 Pro Preview 70.7%

Algunas cosas a destacar:

  • El modo ultra marca diferencias. GPT-5.6 Sol Ultra (91.9%) queda claramente por encima del Sol estándar (88.8%), la prueba más limpia de que el enfoque con subagentes funciona, al menos aquí.

  • El orden por niveles no se refleja a la perfección en este único benchmark. Fíjate que GPT-5.6 Luna puntúa por encima de GPT-5.6 Terra, aunque Terra está posicionado como nivel superior. Y Terra queda por debajo de GPT-5.5 (88.0%) en esta prueba, pese a que OpenAI lo describe como "competitivo con GPT-5.5" en general. Conclusión: los niveles equilibran inteligencia/velocidad/coste a través de muchas tareas en promedio; no garantizan nada en un benchmark concreto.

La pila de seguridad y el acceso limitado

Aquí es donde GPT-5.6 más se aleja de un lanzamiento habitual. En lugar de probar el modelo nosotros mismos (abajo explicamos por qué no podemos), lo más noticioso es cómo se está distribuyendo.

Una pila de salvaguardas por capas

OpenAI argumenta que ninguna salvaguarda aislada aguanta ante usos maliciosos determinados o adaptativos, así que apila varias. En el acceso anticipado de GPT-5.6, las capas incluyen:

  • Entrenamiento a nivel de modelo para rechazar asistencia cibernética prohibida, incluidos intentos de ocultar la intención o hacer jailbreak al modelo.
  • Clasificadores en tiempo real para usos indebidos en ciberseguridad y biología que evalúan la salida a medida que se genera. En casos de mayor riesgo, la generación puede pausarse mientras un modelo de razonamiento mayor revisa la conversación completa, y la salida puede retenerse antes de que te llegue.
  • Revisión a nivel de cuenta que puede analizar conversaciones y señales de riesgo de un usuario para distinguir comportamiento malicioso persistente de trabajo legítimo de doble uso.
  • Acceso diferenciado, monitorización, aplicación y pruebas continuas.

OpenAI avanza que, especialmente durante el acceso anticipado, algunas solicitudes pueden bloquearse o rechazarse, y otras pueden tardar más porque la generación se pause para revisión. También reconoce que las salvaguardas pueden activar falsos positivos en trabajos legítimos de doble uso, donde lo defensivo y lo ofensivo pueden parecerse al principio. 

Red-teaming a gran escala

Para reforzar todo esto, OpenAI dice que ha dedicado una cantidad inusual de cómputo a seguridad: más de 700.000 horas de GPU equivalentes a A100 en red-teaming automatizado orientado a encontrar jailbreaks universales, ataques que generalicen en muchos prompts y contextos en vez de funcionar solo en escenarios estrechos. Esto se complementó con red-teaming humano de terceros, que continúa durante el acceso anticipado, y con un proceso de respuesta rápida para reproducir y parchear nuevos jailbreaks y añadirlos a pruebas futuras.

Por qué el despliegue es tan cauto

OpenAI dice que presentó los planes y capacidades de GPT-5.6 al gobierno de EE. UU. antes del lanzamiento y que, a petición del gobierno, empieza con un acceso limitado para un pequeño grupo de socios de confianza.

Es la segunda vez en un mes que el gobierno de EE. UU. interviene en un lanzamiento de modelos de frontera: hace dos semanas, una directiva de control de exportaciones obligó a Anthropic a retirar Claude Fable 5 y Mythos 5 para todos los clientes del mundo.

Mi lectura: OpenAI observó lo que le pasó a Anthropic y prefirió entregar las llaves desde el principio antes que ver cómo retiraban un modelo ya lanzado. 

Una nota sobre las pruebas

En nuestras reseñas habituales, aquí es donde someteríamos el modelo a pruebas prácticas de razonamiento, búsqueda web y algún prompt de alto riesgo. Esta vez no podemos. GPT-5.6 está en un acceso limitado restringido a un pequeño grupo de socios de confianza, así que aún no está disponible para pruebas generales.

¿Cómo puedo acceder a GPT-5.6?

Durante el acceso anticipado, los modelos GPT-5.6 están disponibles a través de la API y Codex para un grupo selecto de socios y organizaciones de confianza. OpenAI afirma que planea ponerlos a disposición de forma más amplia en ChatGPT, Codex y la API pronto. 

Precios

GPT-5.6 se tarifica por cada 1 M de tokens en los tres niveles:

Modelo Entrada (por 1 M de tokens) Salida (por 1 M de tokens)
GPT-5.6 Sol $5.00 $30.00
GPT-5.6 Terra $2.50 $15.00
GPT-5.6 Luna $1.00 $6.00

Algunos detalles de precio a tener en cuenta:

  • Caché de prompts más predecible, con puntos de ruptura explícitos y un tiempo mínimo de vida de 30 minutos.
  • En GPT-5.6 y posteriores, las escrituras en caché se facturan a 1,25× la tarifa de entrada sin caché, mientras que las lecturas mantienen el 90% de descuento sobre entrada en caché.

Velocidad con Cerebras

OpenAI también dice que lanzará GPT-5.6 Sol en Cerebras con hasta 750 tokens por segundo en julio, con acceso inicialmente limitado a clientes seleccionados a medida que aumente la capacidad. Está pensado directamente para trabajos sensibles a la latencia, donde esperar a un modelo de frontera es el cuello de botella.

Reflexiones finales

GPT-5.6 trae cosas interesantes: una familia en tres niveles más clara, dos formas nuevas de potenciar el razonamiento (max y ultra) y avances en programación, biología y ciberseguridad.

Aun así, el modelo está ahora en un acceso cerrado, así que nadie independiente puede verificar nada por el momento. La historia que cuenta OpenAI —que GPT-5.6 es "tan capaz que hemos tenido que coordinarnos con el gobierno"— suena al marketing más favorecedor posible. Pero eso no lo hace falso, y toda cautela en ciberseguridad es bienvenida. 

Por ahora, el resumen honesto es: las cifras pintan bien, el acceso es muy limitado y la prueba real, literalmente, llegará cuando los modelos estén disponibles de forma amplia. Suscríbete a nuestra newsletter y te mantendremos al día. 


Josef Waples's photo
Author
Josef Waples

Preguntas frecuentes

¿Qué es GPT-5.6?

GPT-5.6 es la nueva generación de modelos de OpenAI. En lugar de un único modelo, llega como una familia de tres: Sol (insignia), Terra (equilibrado para el día a día) y Luna (rápido y de bajo coste).

¿Cuál es la diferencia entre Sol, Terra y Luna?

Son niveles de capacidad. Sol es el modelo más fuerte y capaz. Terra es el nivel intermedio, posicionado como competitivo con GPT-5.5 y aproximadamente 2 veces más barato. Luna es el nivel económico, diseñado para ofrecer buena capacidad al menor coste. En el nuevo sistema de nombres de OpenAI, el número (5.6) es la generación y el nombre (Sol/Terra/Luna) es el nivel estable, de modo que cada nivel puede avanzar en su propio calendario.

¿Puedo usar GPT-5.6 ahora mismo?

Todavía no de forma general. En el lanzamiento, GPT-5.6 está en un acceso limitado disponible a través de la API y Codex para un pequeño grupo de socios y organizaciones de confianza. OpenAI planea poner los modelos a disposición más amplia en ChatGPT, Codex y la API pronto.

¿Por qué el despliegue de GPT-5.6 es tan limitado?

OpenAI dice que presentó los planes y capacidades de los modelos al gobierno de EE. UU. antes del lanzamiento y que, a petición del gobierno, empieza con un acceso limitado para socios cuya participación se compartió con el gobierno. OpenAI ha dicho que no cree que este proceso de acceso deba ser el estándar a largo plazo y lo enmarca como un paso temporal hacia una disponibilidad más amplia mientras trabaja con la Administración en un marco de orden ejecutiva de ciberseguridad.

¿Cuánto cuesta GPT-5.6?

Por cada 1 M de tokens: Sol cuesta $5 de entrada / $30 de salida, Terra $2.50 de entrada / $15 de salida y Luna $1 de entrada / $6 de salida. GPT-5.6 también añade una caché de prompts más predecible: las escrituras en caché se facturan a 1,25× la tarifa de entrada sin caché y las lecturas mantienen el 90% de descuento de entrada en caché.

¿Qué son los modos max y ultra?

Son dos formas nuevas de exigir más al modelo. max es un ajuste de esfuerzo de razonamiento que da a Sol más tiempo para profundizar. ultra va más allá, usando subagentes para acelerar trabajo complejo más allá de lo que puede un agente único. En el anuncio, "GPT-5.6 Sol Ultra" firma la mejor puntuación en Terminal-Bench.

¿Cómo rinde GPT-5.6 en benchmarks?

En Terminal-Bench 2.1 (flujos de trabajo de línea de comandos/programación), GPT-5.6 Sol Ultra lidera con un 91.9%, con Sol estándar en 88.8%, por delante de GPT-5.5 (88.0%) y de competidores como Claude Mythos 5 (84.3%), Claude Fable 5 (83.4%), Claude Opus 4.8 (78.9%) y Gemini 3.1 Pro Preview (70.7%). OpenAI también reporta avances en biología en GeneBench v1 y en ciberseguridad en ExploitBench y ExploitGym, con una evaluación más amplia prometida cuando se abra el acceso general.

¿En qué se diferencia GPT-5.6 de GPT-5.5?

GPT-5.6 es una nueva generación con una familia de tres niveles y nuevos controles de razonamiento max/ultra, además de mejoras en programación, biología y ciberseguridad. También llega con una pila de seguridad más robusta y un despliegue más cauto, coordinado con el gobierno. En comparación, GPT-5.5 fue una actualización ampliamente disponible del modelo por defecto centrada en la calidad de conversación, menos alucinaciones y personalización.

¿Cuándo llegará GPT-5.6 a ChatGPT?

OpenAI no ha dado una fecha firme; solo dice que planea llevar los modelos a ChatGPT, Codex y la API "pronto" y ampliar la disponibilidad "en las próximas semanas". También está prevista para julio una versión alojada en Cerebras de Sol (hasta 750 tokens/segundo), inicialmente para clientes seleccionados.

Temas
Inteligencia Artificial
ChatGPT

Aprende con DataCamp

Curso

Trabajar con la API Responses de OpenAI

3 h
2.7K
Crea aplicaciones de IA inteligentes, interactivas y fiables más fácilmente que nunca con la API OpenAI Responses y GPT-5.
Ver detallesRight Arrow
Iniciar Curso
Ver másRight Arrow
Relacionado

blog

Todo lo que sabemos sobre GPT-5

Descubre cómo GPT-5 evolucionará hasta convertirse en un sistema unificado con funciones avanzadas, cuyo lanzamiento está previsto para el verano de 2025, basándose en la última hoja de ruta de OpenAI y en la historia de GPT.
Josep Ferrer's photo

Josep Ferrer

8 min

An avian AI exits its cage

blog

12 alternativas de código abierto a GPT-4

Alternativas de código abierto a GPT-4 que pueden ofrecer un rendimiento similar y requieren menos recursos informáticos para funcionar. Estos proyectos vienen con instrucciones, fuentes de código, pesos del modelo, conjuntos de datos e IU de chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

¿Qué es GPT-4 y por qué es importante?

OpenAI ha anunciado el lanzamiento de su último gran modelo lingüístico, GPT-4. Este modelo es un gran modelo multimodal que puede aceptar tanto entradas de imagen como de texto y generar salidas de texto.
Abid Ali Awan's photo

Abid Ali Awan

9 min

Tutorial

Cómo ajustar GPT 3.5: Liberar todo el potencial de la IA

Explore GPT-3.5 Turbo y descubra el potencial transformador del ajuste fino. Aprenda a personalizar este modelo de lenguaje avanzado para aplicaciones especializadas, mejore su rendimiento y comprenda los costes asociados, la seguridad y las consideraciones de privacidad.
Moez Ali's photo

Moez Ali

11 min

Tutorial

Visión GPT-4: Guía completa para principiantes

Este tutorial le presentará todo lo que necesita saber sobre GPT-4 Vision, desde cómo acceder a él hasta ejemplos prácticos del mundo real y sus limitaciones.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

Tutorial

Tutorial de DeepSeek-Coder-V2: Ejemplos, instalación, puntos de referencia

DeepSeek-Coder-V2 es un modelo de lenguaje de código de código abierto que rivaliza con el rendimiento de GPT-4, Gemini 1.5 Pro, Claude 3 Opus, Llama 3 70B o Codestral.
Dimitri Didmanidze's photo

Dimitri Didmanidze

8 min

Ver MásVer Más