A Anthropic não publicou um benchmark direto entre Opus 5 e Sonnet 5. Cada post de lançamento compara o modelo ao seu próprio antecessor e ao Opus 4.8. Então, os números abaixo contam só parte da história. O resto é o mesmo juízo que você faria em qualquer comparação Opus vs. Sonnet: de quanta \"potência máxima\" você realmente precisa e quanto está disposto a pagar por isso.
\nO que é o Claude Opus 5?
\nOpus 5 é o modelo topo de linha da Anthropic, lançado em 24 de julho de 2026, com preço de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. A Anthropic o descreve como estado da arte no Frontier-Bench e no GDPval-AA, e próximo do Fable 5 (maior) pela metade do preço. É o modelo padrão no Claude Max e o mais poderoso no Claude Pro.
\nSeu diferencial é a autoverificação: checar o próprio trabalho, construir estruturas de teste quando não há fonte de dados e contestar instruções ruins em vez de simplesmente cumprir.
\nO que é o Claude Sonnet 5?
\nSonnet 5 é o modelo intermediário da Anthropic, lançado em 30 de junho de 2026. A Anthropic o descreve como o Sonnet mais \"agente\" até agora, com desempenho próximo ao Opus 4.8 por um preço menor. É o modelo padrão nos planos Free e Pro, e também está disponível no Max, Team, Enterprise e na API.
\nPreço: US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída até 31 de agosto de 2026; depois, padrão de US$ 3/US$ 15.
\nA diferença entre os tiers, na prática
\nEsta é a parte que os posts de lançamento não detalham, porque vale para a linha de modelos da Anthropic como um todo, não só para este par.
\nOpus é o modelo de teto
\nVocê recorre a ele quando errar sai caro, quando a tarefa é longa e autônoma sem alguém revisando no meio do caminho, ou quando o problema é realmente inédito e não só uma variação do que o modelo já viu mil vezes. Refatorações profundas em múltiplos arquivos, pesquisas ambíguas, execuções longas de agentes em que erros se acumulam — esse é o território do Opus. Você está pagando para o modelo pegar os próprios erros antes que virem seu problema.
\nSonnet é o trator de trabalho
\nEle foi feito para ser rápido e barato o suficiente para rodar o tempo todo: assistentes de chat, classificação em alto volume, codificação iterativa em que você está no loop revisando a cada poucos passos, aplicações sensíveis à latência. O teto de julgamento é mais baixo, mas em grande parte do trabalho real você nem chega a esbarrar nele. No dia a dia da maioria dos times, o uso deve privilegiar o Sonnet, chamando o Opus apenas quando a tarefa realmente precisa dele.
\nEspecificamente, o Sonnet 5 é a tentativa da Anthropic de empurrar esse teto mais alto do que o normal para um modelo intermediário — daí \"o Sonnet mais agente até agora\" e a afirmação de que ele se aproxima do Opus 4.8 em algumas tarefas. Esse é o contexto para ler os números de benchmark abaixo: o Sonnet 5 não é só barato; ele é barato e mais próximo do nível Opus do que os Sonnets anteriores.
\nO que os números dos releases mostram de fato
\nPreço
\nA diferença mais clara e inequívoca. O Sonnet 5 custa US$ 2/US$ 10 (até 31 de agosto) ou US$ 3/US$ 15 (padrão), contra os US$ 5/US$ 25 fixos do Opus 5 — o Sonnet 5 sai por 40% a 60% do preço do Opus 5, dependendo do período.
\nAlinhamento
\nO único ponto em que os dois posts de lançamento se citam diretamente. A auditoria automatizada da Anthropic concluiu que o Opus 5 \"segue melhor a Constituição do Claude do que o Opus 4.8, o Sonnet 5 ou o Fable 5\" — um resultado declarado, não inferência. O Opus 5 marcou 2,3 nessa auditoria, sua melhor pontuação de segurança até agora. O Sonnet 5 melhorou em relação ao seu antecessor (menos alucinações, menos complacência, mais resistência a sequestros por prompt-injection), mas a Anthropic observa que ele ainda apresenta taxa de comportamento desalinhado maior do que o Opus 4.8.
\nCibersegurança
\nAmbos os modelos foram mantidos fora de treinamento cibernético deliberado, mas chegaram a lugares diferentes.
\nO Opus 5 chega perto do Mythos 5 em encontrar vulnerabilidades, embora fique atrás na etapa de transformá-las em exploits. O Sonnet 5 fica mais atrás: a Anthropic afirma claramente que o Sonnet 5 tem \"capacidades cibernéticas substancialmente piores que o Opus 4.8 e o Mythos 5\" e, em uma avaliação de desenvolvimento de exploit no Firefox, ele nunca produziu um exploit totalmente funcional (0,0% de sucesso, só um leve avanço sobre o Sonnet 4.6 em tentativas parciais).
\nSe seu caso de uso toca qualquer coisa próxima de cyber, essa diferença é real e favorece claramente o Opus 5.
\nProgramação e trabalho de conhecimento
\nAqui, os dois posts usam conjuntos de benchmark diferentes, então não há uma comparação direta e limpa.
\nO Opus 5 mais que dobra o Opus 4.8 no Frontier-Bench v0.1 e fica a menos de 0,5% do Fable 5 no CursorBench 3.2 pela metade do custo. O Sonnet 5 é descrito como se aproximando do Opus 4.8 no BrowseComp e no OSWorld-Verified em esforço alto.
\nLendo isso junto com a lógica de tiers acima: o Sonnet 5 chega perto nas tarefas específicas que a Anthropic destacou, mas as vitórias do Opus 5 parecem maiores e mais amplas. Trate este ponto como direcional, não como medida definitiva.
\nQuando escolher cada um
\nEscolha o Opus 5 se
\na tarefa é crítica, longa ou realmente inédita; você trabalha com ciências da vida, química ou fluxos agentivos complexos de múltiplas etapas; você precisa do modelo mais alinhado disponível; qualquer coisa próxima de cibersegurança está no escopo.
\nEscolha o Sonnet 5 se
\nvocê roda alto volume, a latência importa ou a tarefa é bem delimitada a ponto de não exigir o teto de julgamento do Opus; você está no Free ou Pro, onde ele já é o padrão; o custo por token é a sua principal restrição.
\nNenhum dos dois, se
\nvocê precisa de trabalho em cibersegurança com menos restrições. O Opus 5 recua automaticamente para o Opus 4.8, e o Sonnet 5 fica claramente atrás do Opus 4.8.
\nConsiderações finais
\nO principal fator de decisão aqui é o mesmo que define qualquer escolha entre Opus e Sonnet: esta tarefa precisa do teto máximo ou só precisa ser feita com confiabilidade em escala? O Sonnet 5 empurra esse teto mais alto do que os Sonnets anteriores — essa é a grande novidade do seu lançamento. Mas onde a Anthropic colocou um número comparando os dois — a auditoria de alinhamento — o Opus 5 ficou na frente, e a história de cibersegurança aponta na mesma direção. Deixe o Sonnet 5 como padrão para volume e chame o Opus 5 quando a tarefa não pode se dar ao luxo de uma resposta errada.