Pular para o conteúdo principal

Claude Sonnet 5: recursos, benchmarks, preços e mais

O Claude Sonnet 5 se aproxima do Opus 4.8 em benchmarks de agentes com menor custo. Descubra seus recursos, benchmarks, preços e mais.
Atualizado 23 de set. de 2026  · 9 min lido

Explorar com IA

ChatGPTClaudePerplexity

A Anthropic lançou o Claude Sonnet 5 em 30 de junho de 2026, e a proposta é direta: este é o modelo Sonnet mais "agente" que a empresa já colocou no ar. Ele consegue planejar, usar ferramentas como navegadores e terminais e operar de forma autônoma em um nível que, até pouco tempo atrás, só modelos maiores da classe Opus alcançavam.

A principal afirmação é que o Sonnet 5 chega perto do Opus 4.8 em raciocínio, uso de ferramentas, programação e tarefas de conhecimento — mas com preço menor. No benchmark de programação agentiva publicado pela Anthropic, o Sonnet 5 marcou 63,2% contra 69,2% do Opus 4.8 e 58,1% do Sonnet 4.6. Em um benchmark de trabalho intelectual, o Sonnet 5 chegou a superar o Opus 4.8 por uma pequena margem.

Neste artigo, eu explico tudo o que há de novo no Claude Sonnet 5, passando pelos recursos, explorando os benchmarks e detalhando quanto ele custa. Se você quiser mais contexto sobre a Anthropic, veja nosso guia recente sobre os comandos de barra do Claude Code e nossa análise do Claude Tag.

O que é o Claude Sonnet 5?

O Claude Sonnet 5 é o modelo intermediário da Anthropic, abaixo da linha Opus, criado para dar conta de trabalhos agentivos que antes exigiam os modelos Opus mais caros. Ele substitui o Sonnet 4.6, lançado em fevereiro de 2026, e usa um tokenizador atualizado que muda como o modelo processa texto.

Para muitos desenvolvedores, a era agentiva começou com modelos da classe Sonnet, como Claude Sonnet 3.5, 3.6 e 3.7, os primeiros lançamentos do Claude a mostrarem competência real em programação e uso de ferramentas. Mais recentemente, os maiores saltos em agentividade migraram para a classe Opus, e o Sonnet 5 é a tentativa da Anthropic de elevar novamente o nível intermediário para perto da fronteira.

Anúncio do Anthropic Sonnet 5

Fonte: Anthropic

O número mais revelador é a relação custo-desempenho. Os próprios gráficos da Anthropic mostram que o Sonnet 4.6 ficou bem abaixo do Opus 4.8 nos testes BrowseComp (busca agentiva) e OSWorld-Verified (uso do computador). Agora, Sonnet 5 e Opus 4.8 ocupam a mesma faixa, com o Sonnet 5 oferecendo menor custo e o Opus 4.8 maior acurácia por um preço mais alto.

O que há de novo no Claude Sonnet 5?

As melhorias do Sonnet 5 giram em torno de um tema: concluir tarefas agentivas de ponta a ponta sem parar no meio. Veja os destaques.

Conclui tarefas de múltiplas etapas de ponta a ponta

A maior mudança prática é a capacidade de levar a tarefa até o fim. Testadores de early access da Anthropic relataram que o modelo conclui tarefas complexas em que versões anteriores do Sonnet travavam no meio do caminho — e que ele checa seu próprio output sem precisar ser solicitado.

Para visualizar isso no seu dia a dia, pense em atribuir um trabalho que passa por dois sistemas: extrair testes com falha de uma execução de CI e depois abrir um pull request com a correção. Versões anteriores do Sonnet tendiam a parar após a primeira metade. O exemplo da própria Anthropic envolveu atualizar os níveis de contas no Salesforce e enviar um anúncio de lançamento para contatos enterprise em uma única passada — um fluxo que, segundo um engenheiro da Zapier, costumava travar no meio.

Para quem está construindo agentes, isso é a diferença entre um modelo que só rascunha um plano e outro que de fato executa. Diminui o número de vezes em que um humano precisa intervir para empurrar o agente adiante.

Ajuste o nível de esforço para equilibrar custo e acurácia

O Sonnet 5 permite ajustar níveis de esforço, para aumentar ou reduzir a profundidade de raciocínio conforme a tarefa e o orçamento. A Anthropic posiciona isso como um jeito de encontrar o ponto ideal entre o Sonnet 5 e o Opus 4.8, em vez de escolher um modelo e ficar preso a ele.

No nível Extra High de raciocínio, o Sonnet 5 performa aproximadamente como o Opus 4.8 no ajuste médio a alto no OSWorld-Verified e no BrowseComp. O porém é que rodar o Sonnet 5 nesse nível pode sair mais caro do que o Opus 4.8 em um ajuste comparável, então o Opus 4.8 continua sendo a melhor opção para algumas tarefas que exigem máxima acurácia.

Se você já usa o Claude Code, os níveis de esforço vão soar familiares. Nós cobrimos o comando /effort e seus níveis no nosso tutorial de comandos de barra do Claude Code.

Execute agentes com mais segurança em produção

O Sonnet 5 chega com melhorias mensuráveis de segurança em relação ao Sonnet 4.6, algo crucial quando um agente interage com sistemas em produção. Nas avaliações pré-implantação da Anthropic, ele se saiu melhor em recusar solicitações maliciosas e resistir a tentativas de sequestro em ataques de prompt injection.

O modelo também apresenta taxas menores de alucinação e bajulação do que o Sonnet 4.6, além de pontuação mais baixa (portanto, mais segura) na auditoria comportamental automatizada da Anthropic, que cobre comportamentos desalinhados como cooperação com mau uso e engano. O cofundador da Lovable resumiu bem: um modelo que sabe dizer não é tão importante quanto um que sabe construir.

O alerta é que o Sonnet 5 ainda mostra taxas mais altas de comportamento desalinhado do que o mais capaz Opus 4.8 e o Claude Mythos Preview, então ele é mais seguro do que seu antecessor, mas não é o modelo mais seguro do portfólio da Anthropic.

Sonnet 5 e comportamento desalinhado

Fonte: Anthropic

Rodando com proteções cibernéticas ativadas por padrão

O Sonnet 5 estreia com proteções cibernéticas em tempo real ativadas por padrão, as mesmas presentes no Claude Opus 4.7 e 4.8. Elas detectam e bloqueiam usos perigosos conforme acontecem.

Nas avaliações da Anthropic, o Sonnet 5 tem habilidades de ciberataque perigosas substancialmente mais fracas do que o Opus 4.8 e o Mythos 5. Em um teste desenvolvido com a Mozilla para explorar vulnerabilidades no Firefox 147, nem o Sonnet 5 nem o Sonnet 4.6 produziram um exploit funcional (ambos com 0,0%), embora o Sonnet 5 tenha mostrado uma taxa de sucesso parcial um pouco maior — algo que a Anthropic atribui a ganhos gerais de inteligência, não a treinamento específico em cibersegurança.

Para pesquisadores de segurança que precisam de menos restrições, a Anthropic recomenda o Opus 4.8. As proteções do Sonnet 5 são menos rígidas do que as que vieram no Fable 5, que bloqueava uma gama mais ampla de tarefas de cibersegurança.

Benchmarks do Claude Sonnet 5

A narrativa de benchmarks da Anthropic para o Sonnet 5 é consistente: ele melhora claramente em relação ao Sonnet 4.6 e fica logo abaixo do Opus 4.8 nas avaliações publicadas até agora. Os números abaixo vêm dos materiais de lançamento da Anthropic. Um alerta: avaliadores independentes relataram valores diferentes para os mesmos benchmarks, provavelmente por causa de variações em datasets, configurações de contexto ou scaffolds de agentes — então trate os números como dependentes da configuração.

  Sonnet 5 Sonnet 4.6 Opus 4.8
Para referência
Programação agentiva
SWE-bench Pro
63,2% 58,1% 69,2%
Programação agentiva
Terminal-Bench 2.1
80,4% 67,0% 82,7%
Raciocínio multidisciplinar
Humanity's Last Exam
43,2%
sem ferramentas
57,4%
com ferramentas
34,6%
sem ferramentas
46,8%
com ferramentas
49,8%
sem ferramentas
57,9%
com ferramentas
Uso de computador
OSWorld-Verified
81,2% 78,5% 83,4%
Trabalho de conhecimento
GDPval-AA v2
1618 1395 1615

Programação agentiva

No benchmark de programação agentiva publicado pela Anthropic, o Sonnet 5 marca 63,2%, contra 69,2% do Opus 4.8 e 58,1% do Sonnet 4.6. Esse benchmark mede se um modelo consegue escrever, rodar e corrigir código em múltiplas etapas, em vez de produzir um único trecho.

A distância para o Opus 4.8 é de cerca de 6 pontos, enquanto o salto sobre o Sonnet 4.6 é de aproximadamente 5 pontos. Para desenvolvedores, isso significa que o Sonnet 5 é uma atualização clara em relação ao modelo intermediário anterior, embora ainda não alcance o topo de linha.

Pontuações do Sonnet 5 em uso agentivo de computador

Fonte: Anthropic

OSWorld-Verified e BrowseComp

O OSWorld-Verified mede habilidade de uso do computador, controlando um desktop para concluir tarefas reais, e o BrowseComp mede busca agentiva na web. A Anthropic atualizou a metodologia do OSWorld-Verified e agora reporta o Sonnet 4.6 em 78,5% na configuração revisada.

Nos dois testes, o Sonnet 5 melhora consistentemente em relação ao Sonnet 4.6 em todos os níveis de esforço, enquanto o Opus 4.8 segue como a opção de maior acurácia. No esforço Extra High, o Sonnet 5 chega aproximadamente ao desempenho médio-alto do Opus 4.8, mas, nesse ponto, a vantagem de custo diminui — por isso a Anthropic apresenta os dois modelos como uma faixa única custo-acurácia, não como um upgrade direto.

Trabalho de conhecimento

Em um benchmark de trabalho intelectual, o Sonnet 5 supera ligeiramente o Opus 4.8, segundo o TechCrunch. Isso chama atenção porque o Opus 4.8 costuma ser o modelo associado às decisões mais difíceis e a pesquisas profundas.

A Anthropic também atualizou o avaliador do Humanity's Last Exam e agora reporta o Sonnet 4.6 com 34,6% (sem ferramentas) e 46,8% (com ferramentas), motivo pelo qual esses números diferem do lançamento original do Sonnet 4.6. Para quem está na prática, o resultado em trabalho de conhecimento sugere que o Sonnet 5 é viável para análise e pesquisa que antes pareciam território do Opus.

Como ele se compara a outros modelos da Anthropic

Para uma visão mais ampla de onde a linha Sonnet se posiciona, nossa cobertura de Sakana Fugu vs Claude Fable 5 ajuda. Nessa comparação, o Claude Fable 5, de nível superior, marcou 80,3% no SWE-Bench Pro e 59,0% no Humanity's Last Exam (sem ferramentas), bem acima dos números do nível intermediário aqui.

Essa distribuição é proposital. O portfólio da Anthropic vai do Sonnet 5 — agentivo e mais acessível — passando pelo Opus 4.8 e pelas classes Mythos e Fable, com cada nível trocando custo por acurácia nos problemas mais difíceis.

Preços e disponibilidade do Claude Sonnet 5

O Claude Sonnet 5 está disponível globalmente desde o lançamento. Ele é o modelo padrão dos planos Free e Pro, e também está disponível para usuários Max, Team e Enterprise, além do Claude Code e da Claude Platform.

Desenvolvedores podem chamá-lo via API do Claude usando o ID do modelo claude-sonnet-5. A precificação funciona em duas fases:

  • Preço promocional (até 31 de agosto de 2026): US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída
  • Preço padrão (após 31 de agosto de 2026): US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída

Um ponto para considerar no orçamento: o Sonnet 5 usa um tokenizador atualizado, então a mesma entrada pode gerar mais tokens do que antes — algo entre 1,0 e 1,35 vez, dependendo do tipo de conteúdo. A Anthropic definiu o preço promocional para que a migração do Sonnet 4.6 fique aproximadamente neutra em custo. A empresa também elevou os rate limits no Chat, Cowork, Claude Code e na Claude Platform para lidar com o consumo maior de tokens trazido pelos níveis de esforço mais altos.

Claude Sonnet 5 vs. Sonnet 4.6 e Opus 4.8 em um relance

Para quem quer um comparativo rápido, é assim que os três modelos se alinham segundo os números publicados pela Anthropic.

Modelo Programação agentiva OSWorld-Verified Preço de entrada / saída (por 1M tokens)
Sonnet 5 63,2% Melhora em relação ao 4.6 em todos os níveis de esforço US$ 2 / US$ 10 (promo), depois US$ 3 / US$ 15
Sonnet 4.6 58,1% 78,5% (revisado) US$ 3 / US$ 15
Opus 4.8 69,2% Opção de maior acurácia US$ 5 / US$ 25

Considerações finais

O Sonnet 5 é o recado mais claro da Anthropic de que capacidade agentiva agora é expectativa básica em todas as faixas de preço — não um recurso exclusivo do topo de linha. O diferencial deixou de ser quem faz trabalho agentivo melhor; passa a ser quem faz isso com custo baixo e confiabilidade, sem supervisão humana.

O que mais chama a atenção é o preço promocional. A Anthropic parece querer que os clientes testem o Sonnet 5 em cargas reais com o menor custo possível durante a janela de migração — um movimento deliberado para tirar rotinas agentivas do Opus 4.8 e liberar essa capacidade. No preço, ele também pressiona o GPT-5.5 da OpenAI e o Gemini 3.1 Pro do Google, embora o Gemini 3.5 Flash siga mais barato.

Se você está construindo agentes que executam tarefas sustentadas e de múltiplas etapas, o Sonnet 5 parece o novo padrão para começar — subindo para o Opus 4.8 apenas quando a tarefa realmente exigir a acurácia extra. O alerta honesto é que alguns reviews independentes veem o Sonnet 5 trocando profundidade de raciocínio por velocidade de código; para ciência em nível de PhD ou tarefas com muita navegação, o Opus 4.8 pode continuar sendo a escolha mais segura.

Se quiser colocar a mão na massa com o tipo de automação para o qual o Sonnet 5 foi projetado, recomendo nosso tutorial de Routines do Claude Code, que mostra como rodar um agente de programação em horários agendados na nuvem. 

FAQs

Como o Claude Sonnet 5 se compara ao Opus 4.8?

O Sonnet 5 chega perto do Opus 4.8 em tarefas agentivas, mas não iguala completamente. Em programação agentiva, marca 63,2% versus 69,2% do Opus 4.8, embora supere ligeiramente o Opus 4.8 em um benchmark de trabalho de conhecimento. O Opus 4.8 continua sendo a opção de maior acurácia para as tarefas mais difíceis de raciocínio e ciência, enquanto o Sonnet 5 oferece capacidade similar por um preço menor.

Onde posso acessar o Claude Sonnet 5?

O Claude Sonnet 5 está disponível em todos os planos desde o lançamento. É o modelo padrão dos planos Free e Pro e está disponível para usuários Max, Team e Enterprise, no Claude Code e na Claude Platform. Desenvolvedores podem acessá-lo via API. 

Quanto custa o Claude Sonnet 5?

Até 31 de agosto de 2026, o Sonnet 5 tem preço promocional de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. Depois, passa a ser US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída. 

Quais padrões de segurança o Claude Sonnet 5 segue?

As avaliações pré-implantação da Anthropic indicam que o Sonnet 5 é, no geral, mais seguro do que o Sonnet 4.6, com melhor recusa a solicitações maliciosas, maior resistência a prompt injection e taxas menores de alucinação e bajulação. Ele vem com proteções cibernéticas em tempo real ativadas por padrão, as mesmas do Opus 4.7 e 4.8. 

Para quais casos de uso o Claude Sonnet 5 é melhor?

O Sonnet 5 foi feito para trabalho agentivo e de múltiplas etapas, como programação sustentada, depuração, uso de ferramentas e automações entre dois sistemas nas quais versões anteriores do Sonnet travavam. Testadores destacaram forças em código legado (brownfield) e rastreamento de causa raiz. Para raciocínio científico em nível de PhD ou tarefas com muita navegação, o Opus 4.8 pode continuar sendo a escolha preferida. 


Matt Crabtree's photo
Author
Matt Crabtree
LinkedIn

Escritor e editor de conteúdo na área de edtech. Comprometido com a exploração de tendências de dados e entusiasmado com o aprendizado da ciência de dados.

Tópicos
Inteligência Artificial
Modelos de idiomas grandes

Principais cursos da DataCamp

Curso

Introdução aos modelos Claude

3 h
14.5K
Aprenda a trabalhar com o Claude usando a API da Anthropic para resolver tarefas do mundo real e criar aplicativos com inteligência artificial.
Ver detalhesRight Arrow
Iniciar Curso
Ver maisRight Arrow
Relacionado
An avian AI exits its cage

blog

12 Alternativas de código aberto ao GPT-4

GPT-4 alternativas de código aberto que podem oferecer desempenho semelhante e exigem menos recursos computacionais para serem executadas. Esses projetos vêm com instruções, fontes de código, pesos de modelos, conjuntos de dados e interface de usuário do chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

A OpenAI anuncia o GPT-4 Turbo com visão: O que sabemos até o momento

Descubra a atualização mais recente da OpenAI, GPT-4 Turbo com visão, e seus principais recursos, incluindo o corte de conhecimento aprimorado, uma janela de contexto expandida, preço acessível e muito mais.
Richie Cotton's photo

Richie Cotton

7 min

blog

Tudo o que sabemos sobre o GPT-5

Saiba como o GPT-5 evoluirá para um sistema unificado com recursos avançados, visando um lançamento no verão de 2025, com base no mais recente roteiro da OpenAI e no histórico do GPT.
Josep Ferrer's photo

Josep Ferrer

8 min

AI shaking hands with a human

blog

As 5 melhores ferramentas de IA para ciência de dados em 2026

Os avanços recentes na IA têm o potencial de mudar drasticamente a ciência de dados. Dá uma olhada nesse artigo pra conhecer as cinco melhores ferramentas de IA que todo cientista de dados precisa saber.
Javier Canales Luna's photo

Javier Canales Luna

9 min

blog

Stability AI anuncia a difusão estável 3: Tudo o que sabemos até agora

Saiba mais sobre as novas atualizações do Stable Diffusion e descubra os recursos do modelo de texto para imagem da versão 3.
Richie Cotton's photo

Richie Cotton

Tutorial

Primeiros passos com o Claude 3 e a API do Claude 3

Saiba mais sobre os modelos Claude 3, benchmarks de desempenho detalhados e como acessá-los. Além disso, descubra a nova API Python do Claude 3 para geração de texto, acesso a recursos de visão e streaming.
Abid Ali Awan's photo

Abid Ali Awan

Ver MaisVer Mais