Ir al contenido principal

Claude Sonnet 5 vs. GPT-5.6: benchmarks, precios y acceso

Sonnet 5 ya está disponible con descuento. GPT-5.6 firma mejores números en Terminal-Bench-2.1, pero aún no está disponible de forma general. Aquí tienes el análisis completo.
Actualizado 23 sept 2026  · 7 min leer

Explorar con IA

ChatGPTClaudePerplexity

Anthropic y OpenAI llegan esta semana con novedades, pero en fases distintas.

\n

GPT-5.6 se ha presentado, pero está restringido a una vista previa limitada. Y aunque GPT-5.6 aún no está disponible de forma general, Claude Sonnet 5 se ha lanzado hoy y ya está activo en todos los planes de Claude, con un precio de API de introducción que, por ahora, incluso mejora el del modelo intermedio de GPT-5.6, Terra.

\n

Esto es lo que sabemos de cada modelo, cómo se comparan y dónde se solapan los datos.

\n

¿Qué es Claude Sonnet 5?

\n

Claude Sonnet 5 es el último modelo de gama media de Anthropic, y la compañía lo presenta como el Sonnet más agentic hasta la fecha. La propuesta: recorta gran parte de la distancia con los modelos de clase Opus en planificación y uso de herramientas, manteniéndose sensiblemente más barato.

\n

Anthropic afirma que Sonnet 5 supone un salto importante respecto a Sonnet 4.6 en razonamiento, programación y uso de herramientas, y que su rendimiento se acerca al de Opus 4.8 en varias evaluaciones agentic, incluidas BrowseComp (búsqueda agentic) y OSWorld-Verified (uso del ordenador).

\n

Opus 4.8 sigue liderando en precisión bruta, especialmente en los ajustes de esfuerzo altos o máximos, pero Sonnet 5 ofrece a los desarrolladores una opción con mejor relación precio-rendimiento. Los modelos de gama media de Anthropic suelen rendir por encima de su categoría cuando llega una nueva generación, hasta que el siguiente Opus se pone al día. Parece que fue hace mucho, pero Claude Sonnet 3.5 llegó a superar al antiguo Claude Opus 3 en varios benchmarks en 2024.

\n

Sonnet 5 también incorpora un tokenizador actualizado, lo que significa que el mismo texto de entrada puede mapear a más tokens que antes (aprox. 1,0–1,35x según el contenido).

\n

¿Qué es GPT-5.6?

\n

GPT-5.6 no es un único modelo. Es una familia de tres, organizada bajo un nuevo esquema de nombres donde el número marca la generación y el nombre indica el nivel de capacidad:

\n
    \n
  • \n

    Sol es el buque insignia. Es el único nivel con acceso a dos nuevos controles: un ajuste de esfuerzo de razonamiento max y el ultra mode, que reparte una tarea entre un conjunto de subagentes.

    \n
  • \n
  • \n

    Terra es el modelo equilibrado para el día a día, comparable a grandes rasgos con GPT-5.5 en calidad global a aproximadamente la mitad de precio.

    \n
  • \n
  • \n

    Luna es el nivel de bajo coste, orientado a cargas sensibles a la latencia.

    \n
  • \n
\n

Con el anuncio, OpenAI destaca avances en programación, biología y ciberseguridad. El gran titular de benchmarks fue su rendimiento en varias pruebas interesantes, especialmente Terminal-Bench 2.1, pero también GeneBench v1, un benchmark de genómica de largo horizonte, y dos benchmarks de desarrollo de exploits (ExploitBench y ExploitGym).

\n

Comparativa de benchmarks: Claude Sonnet 5 y GPT-5.6

\n

Según los anuncios, Sonnet 5 y GPT-5.6 no comparten ni un solo benchmark con cifras publicadas por ambas partes.

\n

Aunque Anthropic ha publicado algunos datos para Sonnet 5 en su post de lanzamiento y en la system card, OpenAI solo ha confirmado por ahora una puntuación de benchmark para GPT-5.6: Terminal-Bench 2.1. Esto es lo que hay oficialmente en cada lado, puesto en conjunto:

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
BenchmarkClaude Sonnet 5GPT-5.6 SolGPT-5.6 Sol UltraGPT-5.6 TerraGPT-5.6 Luna
Terminal-Bench 2.1No publicado88,8%91,9%82,5%84,3%
SWE-bench Pro63,2%No publicado—No publicadoNo publicado
OSWorld-Verified (uso del ordenador)81,2%No publicado—No publicadoNo publicado
Humanity's Last Exam (con herramientas)57,4%No publicado—No publicadoNo publicado
\n
\n

Terminal-Bench 2.1 es la única fila donde GPT-5.6 ha publicado algo, y Sonnet 5 no tiene una puntuación pública para poner ahí. Quizá sea estratégico porque GPT-5.6 ha salido bien parado. 

\n

En los benchmarks donde Sonnet 5 sí tiene cifras —SWE-bench Pro, OSWorld-Verified, Humanity's Last Exam—, GPT-5.6 aún no ha mostrado sus cartas, así que no hay con qué comparar.

\n

La conclusión honesta es que todavía no existe una comparativa completa de benchmarks entre Sonnet 5 y GPT-5.6. Cada empresa ha publicado un conjunto distinto de evaluaciones.

\n

Ampliando el foco: el lugar de cada modelo en el panorama

\n

Como Sonnet 5 y GPT-5.6 no se solapan directamente, merece la pena retroceder y ver cómo encajan sus puntuaciones publicadas frente al resto del campo —Opus 4.8, el suspendido Fable 5, GPT-5.5 y Gemini 3.1 Pro. No zanja Sonnet 5 vs. GPT-5.6, pero muestra dónde se sitúa cada uno respecto al mismo grupo de competidores:

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
BenchmarkClaude Opus 4.8Claude Fable 5 (antes de la suspensión)GPT-5.5Gemini 3.1 ProGPT-5.6 Sol Ultra
Terminal-Bench 2.178,9%83,4%88,0%70,7%91,9%
SWE-bench Pro69,2%80,3%58,6%—No publicado
Humanity's Last Exam (sin herramientas)49,8%59,0%—44,4%No publicado
\n
\n

Un par de apuntes: en Terminal-Bench 2.1, el 91,9% de GPT-5.6 Sol Ultra supera a todos los modelos Claude registrados, incluido Opus 4.8 con 78,9%. Así que OpenAI no exageraba cuando presumía de la puntuación de GPT-5.6 en Terminal-Bench 2.1.

\n

Fable 5 sigue por delante de Opus 4.8 y GPT-5.5 en SWE-bench Pro y en Humanity's Last Exam, incluso estando suspendido. Sus cifras aún no han sido superadas por nadie, incluido GPT-5.6 (que no ha publicado puntuaciones de SWE-bench ni HLE para comparar). El 63,2% de Sonnet 5 en SWE-bench Pro (de la tabla anterior) quedaría por encima del 58,6% de GPT-5.5 pero por debajo de Opus 4.8 y Fable 5 —un símil aproximado, ya que se comparan generaciones distintas en tablas separadas de dos compañías.

\n

Precios de Claude Sonnet 5 y GPT-5.6

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
ModeloEntrada (por 1M de tokens)Salida (por 1M de tokens)
Claude Sonnet 5 (intro, hasta el 31 de agosto de 2026)$2.00$10.00
Claude Sonnet 5 (estándar)$3.00$15.00
GPT-5.6 Sol$5.00$30.00
GPT-5.6 Terra$2.50$15.00
GPT-5.6 Luna$1.00$6.00
\n
\n

Según tarifa de lista, el precio de introducción de Sonnet 5 queda entre GPT-5.6 Terra y Luna, y muy por debajo de Sol. Pero lo más interesante es precisamente ese precio promocional: a $2/$10, Sonnet 5 realmente mejora los $2,50/$15 de GPT-5.6 Terra, al menos durante el verano hasta que suba el precio.

\n

Para ser precisos, la historia de precios es algo más compleja que un cálculo rápido. Anthropic señala que el precio de introducción de Sonnet 5 está calibrado para resultar aproximadamente neutro en coste frente al mayor conteo de tokens del nuevo tokenizador. Y OpenAI, por su parte, introduce un sistema de caché de prompts más predecible para GPT-5.6 y posteriores, con escrituras a caché facturadas a 1,25x la tarifa de entrada sin caché y lecturas a caché con un descuento del 90%. 

\n

¿Por qué lanzar con un precio de introducción con descuento en lugar de fijar la tarifa estándar desde el primer día? La explicación del tokenizador cubre parte, pero el momento también encaja con lo que vemos: un mercado saturado y muy dinámico. En las últimas semanas, Sakana AI lanzó Fugu, un orquestador que enruta entre un conjunto de modelos punteros y dice acercarse a los sistemas de clase Mythos de Anthropic a una fracción del coste. Así que fijar Sonnet 5 a $2/$10 hasta finales de agosto le da a Anthropic un modelo agentic realmente barato y ampliamente disponible al que señalar mientras GPT-5.6 sigue en vista previa. Ser el modelo que la gente puede usar de verdad, y a bajo precio, es una ventaja competitiva clara.

\n

Disponibilidad de Claude Sonnet 5 y GPT-5.6

\n

Claude Sonnet 5 está disponible hoy, en todas partes. Es el modelo por defecto en los planes Free y Pro, accesible en Max, Team y Enterprise, y está activo en Claude Code y en Claude Platform vía API (model string claude-sonnet-5). Puede que hayas visto Claude Sonnet 5 en la ventana de chat antes incluso de leer el anuncio. 

\n

\"claude

\n

GPT-5.6 no está disponible de forma general. Durante la vista previa, solo es accesible a través de la API y Codex para un grupo seleccionado de partners. OpenAI afirma que llegará una disponibilidad más amplia, pero no ha dado fecha. 

\n

Conclusión

\n

En el único benchmark coincidente, el nivel insignia de GPT-5.6 registra puntuaciones superiores al actual buque insignia de Claude, Opus 4.8, lo que sugiere que OpenAI podría tener una ventaja real en capacidades cuando GPT-5.6 se lance de forma generalizada. Pero Sonnet 5 no compite directamente con Sol o Terra en capacidad: es un modelo de gama media que compite en rendimiento agentic por dólar y, en ese frente, está disponible, tiene un precio agresivo y funciona hoy.


Josef Waples's photo
Author
Josef Waples
Temas
Inteligencia Artificial

Aprende con DataCamp

Curso

Introducción a los modelos Claude

3 h
14.6K
Aprende a trabajar con Claude utilizando la API de Anthropic para resolver tareas del mundo real y crear aplicaciones basadas en IA.
Ver detallesRight Arrow
Iniciar Curso
Ver másRight Arrow
Relacionado
An avian AI exits its cage

blog

12 alternativas de código abierto a GPT-4

Alternativas de código abierto a GPT-4 que pueden ofrecer un rendimiento similar y requieren menos recursos informáticos para funcionar. Estos proyectos vienen con instrucciones, fuentes de código, pesos del modelo, conjuntos de datos e IU de chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

Todo lo que sabemos sobre GPT-5

Descubre cómo GPT-5 evolucionará hasta convertirse en un sistema unificado con funciones avanzadas, cuyo lanzamiento está previsto para el verano de 2025, basándose en la última hoja de ruta de OpenAI y en la historia de GPT.
Josep Ferrer's photo

Josep Ferrer

8 min

blog

¿Qué es GPT-4 y por qué es importante?

OpenAI ha anunciado el lanzamiento de su último gran modelo lingüístico, GPT-4. Este modelo es un gran modelo multimodal que puede aceptar tanto entradas de imagen como de texto y generar salidas de texto.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

10 maneras de utilizar ChatGPT para las finanzas

Descubre cómo los modelos lingüísticos de IA como ChatGPT pueden revolucionar tus operaciones financieras, desde la generación de informes hasta la traducción de jerga financiera.
Matt Crabtree's photo

Matt Crabtree

13 min

Tutorial

Cómo ajustar GPT 3.5: Liberar todo el potencial de la IA

Explore GPT-3.5 Turbo y descubra el potencial transformador del ajuste fino. Aprenda a personalizar este modelo de lenguaje avanzado para aplicaciones especializadas, mejore su rendimiento y comprenda los costes asociados, la seguridad y las consideraciones de privacidad.
Moez Ali's photo

Moez Ali

11 min

Tutorial

Visión GPT-4: Guía completa para principiantes

Este tutorial le presentará todo lo que necesita saber sobre GPT-4 Vision, desde cómo acceder a él hasta ejemplos prácticos del mundo real y sus limitaciones.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

Ver MásVer Más