Pular para o conteúdo principal

Claude Sonnet 5 vs. GPT-5.6: benchmarks, preços e acesso

O Sonnet 5 já está disponível com desconto. O GPT-5.6 apresentou números melhores no Terminal-Bench-2.1, mas ainda não está liberado para todos. Confira a análise completa.
Atualizado 23 de set. de 2026  · 7 min lido

Explorar com IA

ChatGPTClaudePerplexity

Anthropic e OpenAI trouxeram novidades nesta semana, mas os lançamentos estão em fases bem diferentes.

\n

O GPT-5.6 foi anunciado, porém permanece em prévia limitada. Enquanto o GPT-5.6 ainda não está amplamente disponível, o Claude Sonnet 5 foi lançado hoje e já está ativo em todos os planos do Claude — com um preço promocional de API que, por enquanto, fica abaixo do modelo intermediário do GPT-5.6, o Terra.

\n

Veja o que já sabemos sobre cada modelo, como eles se comparam e onde os números se cruzam.

\n

O que é o Claude Sonnet 5?

\n

Claude Sonnet 5 é o mais novo modelo intermediário da Anthropic, apresentado como o Sonnet mais agentic até agora. A proposta é reduzir boa parte da distância para os modelos de classe Opus em planejamento e uso de ferramentas, mantendo um custo bem menor.

\n

Segundo a Anthropic, o Sonnet 5 é um salto considerável em relação ao Sonnet 4.6 em raciocínio, código e uso de ferramentas, e seu desempenho agora fica relativamente próximo do Opus 4.8 em várias avaliações agentic, incluindo BrowseComp (busca agentic) e OSWorld-Verified (uso de computador).

\n

O Opus 4.8 ainda lidera em acurácia bruta, especialmente nos níveis de esforço mais altos, mas o Sonnet 5 oferece aos desenvolvedores uma opção com melhor relação custo-benefício. Os modelos intermediários da Anthropic costumam entregar mais do que se espera assim que uma nova geração chega, até que o próximo Opus seja atualizado. Parece que faz tempo, mas o Claude Sonnet 3.5 chegou a superar o antigo Claude Opus 3 em vários benchmarks lá em 2024.

\n

O Sonnet 5 também usa um tokenizer atualizado, o que significa que o mesmo texto de entrada pode virar mais tokens do que antes (algo entre 1,0 e 1,35x, dependendo do conteúdo).

\n

O que é o GPT-5.6?

\n

GPT-5.6 não é um único modelo. É uma família com três níveis, organizada sob um novo esquema de nomes em que o número indica a geração e o nome indica a faixa de capacidade:

\n
    \n
  • \n

    Sol é o carro-chefe. É o único nível com acesso a dois novos controles: uma configuração de esforço de raciocínio max e o ultra mode, que distribui a tarefa para um conjunto de subagentes.

    \n
  • \n
  • \n

    Terra é o modelo do dia a dia, equilibrado — em qualidade geral, é aproximadamente comparável ao GPT-5.5, custando cerca de metade do preço.

    \n
  • \n
  • \n

    Luna é o nível de baixo custo, voltado para workloads que exigem baixa latência.

    \n
  • \n
\n

Com o anúncio, a OpenAI destaca ganhos em código, biologia e cibersegurança. O grande destaque foi o desempenho em vários benchmarks interessantes, especialmente o Terminal-Bench 2.1, mas também o GeneBench v1, um benchmark de genômica de longo horizonte, e dois benchmarks de desenvolvimento de exploits (ExploitBench e ExploitGym).

\n

Comparação de benchmarks: Claude Sonnet 5 vs. GPT-5.6

\n

Pelos anúncios oficiais, Sonnet 5 e GPT-5.6 não compartilham nenhum benchmark com números publicados por ambos os lados.

\n

Embora a Anthropic tenha divulgado alguns números do Sonnet 5 no post de lançamento e no system card, a OpenAI confirmou até agora apenas um resultado do GPT-5.6: o Terminal-Bench 2.1. Aqui está o que há de oficial, lado a lado:

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
BenchmarkClaude Sonnet 5GPT-5.6 SolGPT-5.6 Sol UltraGPT-5.6 TerraGPT-5.6 Luna
Terminal-Bench 2.1Não publicado88,8%91,9%82,5%84,3%
SWE-bench Pro63,2%Não publicado—Não publicadoNão publicado
OSWorld-Verified (uso de computador)81,2%Não publicado—Não publicadoNão publicado
Humanity's Last Exam (com ferramentas)57,4%Não publicado—Não publicadoNão publicado
\n
\n

O Terminal-Bench 2.1 é a única linha em que o GPT-5.6 tem resultados publicados, e o Sonnet 5 não tem pontuação divulgada para comparar. Talvez isso seja estratégico, já que o GPT-5.6 foi muito bem.

\n

Nos benchmarks em que o Sonnet 5 tem números — SWE-bench Pro, OSWorld-Verified e Humanity's Last Exam — o GPT-5.6 ainda não mostrou suas cartas, então não há como comparar.

\n

A conclusão honesta é que ainda não existe uma comparação completa de benchmarks Sonnet 5 vs. GPT-5.6. Cada empresa publicou um conjunto diferente de avaliações.

\n

Ampliando o olhar: onde cada modelo se posiciona no mercado

\n

Como Sonnet 5 e GPT-5.6 não se sobrepõem diretamente, vale observar como as pontuações publicadas de cada um se comparam ao restante do mercado — Opus 4.8, o Fable 5 (suspenso), GPT-5.5 e Gemini 3.1 Pro. Isso não resolve o duelo Sonnet 5 vs. GPT-5.6, mas mostra onde cada um está em relação ao mesmo conjunto de concorrentes:

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
BenchmarkClaude Opus 4.8Claude Fable 5 (pré-suspensão)GPT-5.5Gemini 3.1 ProGPT-5.6 Sol Ultra
Terminal-Bench 2.178,9%83,4%88,0%70,7%91,9%
SWE-bench Pro69,2%80,3%58,6%—Não publicado
Humanity's Last Exam (sem ferramentas)49,8%59,0%—44,4%Não publicado
\n
\n

Alguns pontos: no Terminal-Bench 2.1, os 91,9% do GPT-5.6 Sol Ultra superam todos os modelos Claude registrados, incluindo o Opus 4.8 com 78,9%. Então, a OpenAI não exagerou ao destacar a pontuação do GPT-5.6 no Terminal-Bench 2.1.

\n

Mesmo suspenso, o Fable 5 ainda lidera o Opus 4.8 e o GPT-5.5 no SWE-bench Pro e no Humanity's Last Exam. Ninguém superou esses números até agora, nem o GPT-5.6 (que não publicou pontuações de SWE-bench ou HLE para comparação). Os 63,2% do Sonnet 5 no SWE-bench Pro (da tabela acima) o colocariam acima dos 58,6% do GPT-5.5, mas abaixo do Opus 4.8 e do Fable 5 — um proxy bem aproximado, já que comparamos gerações diferentes em tabelas separadas de duas empresas.

\n

Preços de Claude Sonnet 5 e GPT-5.6

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
ModeloEntrada (por 1M de tokens)Saída (por 1M de tokens)
Claude Sonnet 5 (promo, até 31 de ago. de 2026)US$ 2,00US$ 10,00
Claude Sonnet 5 (padrão)US$ 3,00US$ 15,00
GPT-5.6 SolUS$ 5,00US$ 30,00
GPT-5.6 TerraUS$ 2,50US$ 15,00
GPT-5.6 LunaUS$ 1,00US$ 6,00
\n
\n

Pelo preço de tabela, o valor promocional do Sonnet 5 fica entre o GPT-5.6 Terra e o Luna, e bem abaixo do Sol. Mas o ponto mais interessante é justamente o preço de lançamento: por US$ 2/US$ 10, o Sonnet 5 fica mais barato que o GPT-5.6 Terra (US$ 2,50/US$ 15), pelo menos durante o verão, até um possível reajuste.

\n

Para deixar claro, a discussão de preços é um pouco mais complexa do que uma conta rápida. A Anthropic comenta que o preço promocional do Sonnet 5 foi calibrado para ficar aproximadamente neutro em custo frente à maior contagem de tokens do novo tokenizer. Já a OpenAI, por sua vez, está introduzindo cache de prompt mais previsível para o GPT-5.6 e modelos futuros, com gravações no cache cobradas a 1,25x a taxa de entrada sem cache e leituras com desconto de 90%.

\n

Por que lançar com preço promocional, em vez de definir a tarifa padrão desde o primeiro dia? A explicação do tokenizer cobre parte disso, mas o timing também acompanha o que estamos vendo: um mercado lotado e em ritmo acelerado. Nas últimas semanas, a Sakana AI lançou o Fugu, um orquestrador que roteia entre um pool de modelos de ponta e diz chegar perto dos sistemas da classe Mythos da Anthropic por uma fração do custo. Assim, precificar o Sonnet 5 a US$ 2/US$ 10 até o fim de agosto dá à Anthropic um modelo agentic realmente barato e amplamente disponível para apresentar enquanto o GPT-5.6 ainda está em prévia. Ser o modelo que as pessoas conseguem usar hoje, por um preço baixo, é uma vantagem competitiva real.

\n

Disponibilidade de Claude Sonnet 5 e GPT-5.6

\n

O Claude Sonnet 5 está disponível hoje, para todo mundo. É o modelo padrão nos planos Free e Pro, acessível no Max, Team e Enterprise, e está ativo no Claude Code e na Claude Platform via API (model string claude-sonnet-5). É bem possível que você já tenha visto o Claude Sonnet 5 na janela de chat antes mesmo do anúncio.

\n

\"claude

\n

O GPT-5.6 ainda não está amplamente disponível. Durante a prévia, ele pode ser acessado apenas via API e Codex por um grupo seleto de parceiros. A OpenAI diz que a disponibilidade mais ampla vem aí, mas ainda não deu data.

\n

Considerações finais

\n

No único benchmark em comum, o nível topo de linha do GPT-5.6 apresenta pontuações superiores ao atual flagship da Claude, o Opus 4.8, sugerindo que a OpenAI pode ter uma vantagem real de capacidade quando o GPT-5.6 for lançado amplamente. Mas o Sonnet 5 não é exatamente o concorrente direto do Sol ou do Terra em capacidade — é um modelo intermediário que compete em performance agentic por dólar e, nesse ponto, está disponível, tem preço agressivo e funciona hoje.


Josef Waples's photo
Author
Josef Waples
Tópicos
Inteligência Artificial

Aprenda com a DataCamp

Curso

Introdução aos modelos Claude

3 h
14.6K
Aprenda a trabalhar com o Claude usando a API da Anthropic para resolver tarefas do mundo real e criar aplicativos com inteligência artificial.
Ver detalhesRight Arrow
Iniciar Curso
Ver maisRight Arrow
Relacionado
An avian AI exits its cage

blog

12 Alternativas de código aberto ao GPT-4

GPT-4 alternativas de código aberto que podem oferecer desempenho semelhante e exigem menos recursos computacionais para serem executadas. Esses projetos vêm com instruções, fontes de código, pesos de modelos, conjuntos de dados e interface de usuário do chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

A OpenAI anuncia o GPT-4 Turbo com visão: O que sabemos até o momento

Descubra a atualização mais recente da OpenAI, GPT-4 Turbo com visão, e seus principais recursos, incluindo o corte de conhecimento aprimorado, uma janela de contexto expandida, preço acessível e muito mais.
Richie Cotton's photo

Richie Cotton

7 min

blog

Tudo o que sabemos sobre o GPT-5

Saiba como o GPT-5 evoluirá para um sistema unificado com recursos avançados, visando um lançamento no verão de 2025, com base no mais recente roteiro da OpenAI e no histórico do GPT.
Josep Ferrer's photo

Josep Ferrer

8 min

blog

Os 10 melhores GPTs personalizados na GPT Store

Explore os melhores GPTs personalizados que vimos até agora na loja GPT, desde ferramentas de ciência de dados até assistentes de SEO e geração de imagens.
Nisha Arya Ahmed's photo

Nisha Arya Ahmed

10 min

Tutorial

Como fazer o ajuste fino do GPT 3.5: Liberando todo o potencial da IA

Explore o GPT-3.5 Turbo e descubra o potencial transformador do ajuste fino. Saiba como personalizar esse modelo de linguagem avançado para aplicativos de nicho, aprimorar seu desempenho e entender os custos associados, a segurança e as considerações de privacidade.
Moez Ali's photo

Moez Ali

11 min

Tutorial

Visão GPT-4: Um guia abrangente para iniciantes

Este tutorial apresentará tudo o que você precisa saber sobre o GPT-4 Vision, desde o acesso a ele, passando por exemplos práticos do mundo real, até suas limitações.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

Ver MaisVer Mais