Pular para o conteúdo principal

Grok 4.6 vs Claude Opus 5: código, preço e qual usar

O Grok 4.6 custa bem menos que o Claude Opus 5 ($2/$6 vs $5/$25), mas o Opus 5 ainda lidera em Elo para trabalho de conhecimento e no nosso teste de shader de aurora. Veja quem deve usar qual.
Atualizado 30 de ago. de 2026  · 12 min lido

Explorar com IA

ChatGPTClaudePerplexity

Em 12 de agosto de 2026, a SpaceXAI lançou o Grok 4.6 com foco em agentes de longa duração e trabalhos interativos e visuais mais ambiciosos. Ele empata com o GPT-5.6 Sol no Artificial Analysis Intelligence Index e tem preço de $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída. O Claude Opus 5 já era o carro-chefe para o dia a dia da Anthropic: padrão no Claude Max, o modelo mais forte no Claude Pro, e pela metade do preço do Claude Fable 5 a $5 / $25 por milhão de tokens.

Neste artigo, vou comparar Grok 4.6 e Claude Opus 5 em código, trabalho de conhecimento, projetos visuais e preço. Para uma análise mais detalhada de cada modelo, veja nosso guia do Grok 4.6 e nosso guia do Claude Opus 5.

Resumo

  • O Opus 5 lidera os compostos publicados: 63 vs 61 no AA Intelligence Index, 1.861 vs 1.753 de Elo no GDPval-AA v2.
  • O Grok 4.6 está na mesma fronteira custando de 24% a 40% do preço de tabela do Opus.
  • Escolha o Opus 5 para desempenho máximo em agentes de trabalho de conhecimento e código em repositórios.
  • Escolha o Grok 4.6 quando custo ou número de interações for o limitador, mas você quiser desempenho comparável.
  • Um mês pesado em geração com 1M in / 4M out sai por $26 no Grok 4.6 contra $105 no Opus 5.

O que é o Grok 4.6?

O Grok 4.6 é o modelo de fronteira da SpaceXAI de agosto de 2026, construído sobre o Grok 4.5 para agentes de longa duração e trabalhos interativos e visuais mais ambiciosos. O ID do modelo na API é grok-4.6. A janela de contexto é de 500.000 tokens, com tarifa 2x quando o prompt passa de 200.000 tokens.

O texto da própria xAI enfatiza primeiras entregas melhores em projetos visuais e interativos, além de mais autoavaliação em trajetórias longas. A Artificial Analysis dá nota 61 no Intelligence Index, no nível do GPT-5.6 Sol e atrás do Claude Opus 5 (máx., 63). Ele está no Cursor e no Grok Build, e na API da SpaceXAI, além de OpenRouter, Vercel e Cloudflare.

Para chamar por conta própria, siga nosso tutorial da API do Grok 4.6. Se você se importa mais com o wrapper de agente do que com a ficha técnica do modelo, também rodamos o Grok Build contra o Claude Code em um dataset de churn com armadilhas. Também o comparamos com o atual carro-chefe da OpenAI no nosso guia Grok 4.6 vs GPT-5.6 Sol.

O que é o Claude Opus 5?

O Claude Opus 5 é o modelo atual da classe Opus da Anthropic, vendido como um companheiro de uso diário criterioso que chega perto do Claude Fable 5 pela metade do preço. O ID do modelo na API é claude-opus-5. Ele é o padrão no Claude Max e o modelo mais forte no Claude Pro, pelos mesmos $5 / $25 por milhão de tokens do Opus 4.8.

A Anthropic reporta números de estado da arte no Frontier-Bench v0.1 (43,3%) e no GDPval-AA v2 (1.861 Elo), mantendo-se atrás do Mythos 5 em exploração de cibersegurança. O modo Fast roda cerca de 2,5x mais rápido que o padrão por duas vezes o preço base. Desenvolvedores começam pela Claude API; catálogos em nuvem também o listam na Amazon Bedrock, Google Vertex AI e Azure AI Foundry.

Detalhamos o lançamento no nosso guia do Claude Opus 5 e o caminho de requisições no nosso tutorial da API do Opus 5. Se você está escolhendo dentro do próprio stack da Anthropic, veja nossos comparativos Opus 5 vs Fable 5 e Opus 5 vs Sonnet 5.

Grok 4.6 vs Claude Opus 5: comparação lado a lado

Opus 5 lidera em qualidade; Grok 4.6 é mais barato

Nos compostos que ambos publicam, o Opus 5 está um pouco à frente: 63 contra 61 no Artificial Analysis Intelligence Index, e 1.861 contra 1.753 de Elo no GDPval-AA v2. O preço de tabela não chega perto: Grok 4.6 sai a $2/$6 por 1M de tokens, contra $5/$25 do Opus 5.

Recurso Grok 4.6 Claude Opus 5
AA Intelligence Index 61 63 (máx.)
GDPval-AA v2 (Elo) 1753 1861
API input / output por 1M $2 / $6 $5 / $25
Janela de contexto 500k 1M
Recarga para contexto longo 2x em prompts com ≥200k tokens Não publicado
ID do modelo na API grok-4.6 claude-opus-5

Codificação e fluxos agentic

O Opus 5 lidera as métricas de código publicadas que ambos compartilham. Principalmente no DeepSWE v1.1, o Opus 5 marca 68,8% contra 65,9% do Cursor para o Grok 4.6 High.

Outro sinal é o resultado do nosso Grok Build vs Claude Code: Grok 4.6 high contra Claude Opus 5 high, uma conversa cada, em uma tabela de churn com vazamentos plantados. O Grok Build entregou menos respostas, porém mais imediatamente utilizáveis. O Claude Code foi mais fundo, mas também cometeu um bug no formato do dashboard.

Se você já paga preços da Anthropic para trabalho em repositórios, o Opus 5 é a carta publicada mais segura. Se você quer um modelo de fronteira para código sem pagar como um, o Grok 4.6 é a opção no Cursor que eu realmente deixaria ativa.

Trabalho de conhecimento e agentes de longo horizonte

O Opus 5 lidera em trabalho de conhecimento: o GDPval-AA v2 é 1.861 para o Opus 5 e 1.753 para o Grok 4.6. A Artificial Analysis ainda coloca o Grok atrás apenas do Opus 5 nesse ponto, com barras de erro sobrepostas ao Fable 5 e ao Qwen3.8 Max.

A diferença de eficiência é maior. No AA-Briefcase, o Grok 4.6 marca 1.577, atrás da família Opus 5, mas conclui em cerca de 53 interações e ~0,5B de tokens de entrada. O Opus 5 (máx.) leva cerca de 103 interações e ~2,0B de tokens de entrada. A conclusão: o Opus 5 vence no placar; o Grok 4.6 vence no orçamento de tokens.

Trabalhos visuais e interativos

A proposta da SpaceXAI para o Grok 4.6 é um primeiro passe mais forte em projetos visuais e interativos. O lançamento do Opus 5 pela Anthropic é mais discreto nesse ponto e mais barulhento em verificação, além de "saídas visuais muito mais fortes" sem um número público contra o Grok.

Por isso rodamos uma tarefa compartilhada de shader. Ambos os modelos escreveram GLSL real, mas o resultado do Opus 5 aderiu um pouco melhor ao briefing e reagiu mais ao movimento do cursor. O resultado do Grok 4.6 também ficou com um visual muito bonito e fez isso em menos interações.

Preços: o que você realmente paga

Trabalho pesado em geração custa $26 no Grok, $105 no Opus

Preço de lista é a diferença mais limpa nesta comparação. O Grok 4.6 cobra $2 por entrada e $6 por saída a cada 1M de tokens, enquanto o Opus 5 é $5 e $25. Isso torna o modelo da Anthropic 2,5 vezes mais caro na entrada e mais de 4 vezes na saída — uma diferença grande. Por exemplo, um mês pesado em geração com 1M in / 4M out sai por $26 no Grok 4.6 e $105 no Opus 5. Um assistente mais equilibrado em 1M in / 250K out sai por $3,50 contra $11,25.

Tarifas de tokens lado a lado

Estas são as tarifas padrão publicadas, além dos extras que realmente existem para ambos os modelos.

Tarifa Grok 4.6 Claude Opus 5
Entrada, por 1M de tokens $2,00 $5,00
Saída, por 1M de tokens $6,00 $25,00
Leitura de cache, por 1M de tokens $0,50 $0,50
Gravação de cache, por 1M de tokens $1,00 (≥200k linha) $6,25 (5 min) / $10 (1 hora)
Variante Fast $4 / $12 (2x) $10 / $50 (2x; ~2,5x velocidade)
Recarga para contexto longo 2x em prompts com ≥200k tokens ($4 / $1 / $12) Não publicado

O prêmio na saída é o que mais pesa. O modo Fast é uma sobreposição 2x em ambos, não um terceiro formato. O Opus 5 também publica um desconto de 50% para lotes ($2,50 / $12,50), que o Grok 4.6 não oferece atualmente.

Quanto custa um workload real

Fórmula única: (volume ÷ 1M) × tarifa, somando entrada e saída, nas tarifas padrão, exceto a linha acima do limite, que usa a recarga 2x do Grok. Números arredondados para os centavos abaixo de $10; acima disso, para o dólar mais próximo.

Workload Grok 4.6 Claude Opus 5 Diferença
Assistente equilibrado: 1M in / 250K out $3,50 $11,25 Opus 5 +$7,75 (221%)
Geração pesada: 1M in / 4M out $26 $105 Opus 5 +$79 (304%)
Retriévo, abaixo do limite: 10M in / 1M out $26 $75 Opus 5 +$49 (188%)
Retriévo, acima do limite: 10M in / 1M out $52 $75 Opus 5 +$23 (44%)

Em retrieval abaixo de 200k, a história é a tarifa de entrada ($26 vs $75). Dito isso, a recarga de 200k do Grok pesa aqui: ao cruzar o limite, o mesmo agregado 10M / 1M vira apenas $52 vs $75. A recarga diminui a diferença, mas não torna o Opus 5 mais barato.

Como o Grok 4.6 e o Claude Opus 5 se saíram

Gráficos de fornecedor não dizem se um modelo consegue desenhar a cena que você descreveu. Rodamos uma tarefa compartilhada de agente de código do nosso banco de testes e avaliamos as entregas.

O teste

Avaliamos ambos na criação de um shader em tela cheia exibindo uma aurora sobre um horizonte de montanhas, hospedado em p5.js, com mouse e tempo passados como uniforms. O teste se inspira nos prompts de shader do Ethan Mollick. Padronizamos o tema para tornar os resultados comparáveis. Ambos rodaram uma única vez, sem retries, dentro do Cursor com ferramentas idênticas. Ambos usaram a variante de raciocínio high.

Prompt literal:

Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.

Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.

O que o Grok 4.6 produziu

O Grok 4.6 entregou um index.html funcional em 13 interações. O efeito é um fragment shader GLSL real, com p5 apenas hospedando o canvas. As cortinas se movem de forma aurora-like, com uma divisão de três cores que fica mais bonita do que o verde predominante do Opus 5, além de estrelas piscando ao fundo.

O ponto fraco é a paisagem. As montanhas parecem uma silhueta de desenho, por isso a aderência estética é 4, não 5. A interatividade do cursor é mediana: como se vê no vídeo abaixo, o gráfico reage bastante no eixo x, mas pouco no eixo y.

O que o Claude Opus 5 produziu

O Opus 5 também passou, também com GLSL genuíno. A aderência estética está em dia: três cadeias de montanhas em tons de cinza diferentes, cortinas que lembram aurora, estrelas piscando. A cor é majoritariamente verde, que é a cor mais comum da aurora. Então ele é mais correto, embora as três cores do Grok fiquem mais bonitas na minha opinião. A interatividade do cursor é melhor que a do shader do Grok, com as cortinas dobrando e iluminando em ambos os eixos.

O Opus precisou de bem mais interações do que o Grok, 46 no total. Dito isso, 19 foram para pedir permissão para executar comandos de verificação (o que não era permitido pelas regras do teste), então apenas 27 são relevantes para a criação pura do shader. Ainda assim, o Grok usou só metade do número de interações do Opus.

Resultados

Métrica Grok 4.6 high Claude Opus 5 high
Interações (turns) 13 27
Executabilidade passou passou
Aderência estética 4 5
Competência em shader 5 5
Interatividade ao cursor 3 5
Seguiu a técnica 5 5

O Opus 5 ficou mais próximo do briefing: montanhas em camadas e resposta do mouse em ambos os eixos. As cortinas do Grok 4.6 são mais coloridas e ele também passou, mas as montanhas estão simplificadas demais e o cursor atua principalmente no eixo x.

Isso é n=1, não é métrica de tokens ou custo, e só avalia shaders de cenas descritas com GLSL reativo ao cursor, não código em repositório ou trabalho de conhecimento.

Quando escolher Grok 4.6 vs Claude Opus 5

Opus 5 para a cena, Grok 4.6 para a fatura

Se o placar decide, Opus 5. Se a fatura decide, o Grok 4.6 é o modelo de fronteira que eu realmente deixaria ativo.

Escolha o Claude Opus 5 se...

  • O Elo em trabalho de conhecimento é o critério de contratação. GDPval-AA v2 (1.861 vs 1.753) e o AA Index (63 vs 61) ficam com o Opus 5 (máx.).
  • O trabalho é código em repositório. O Opus 5 tem as linhas publicadas: 68,8% no DeepSWE v1.1 contra 65,9% do Grok 4.6 High, além de 79,2% no SWE-bench Pro e 43,3% no Frontier-Bench, onde o Grok não tem nota.
  • Seu time já vive no Claude Max, Claude Code ou Claude Pro. O Opus 5 é o padrão do Max e o modelo mais forte no Pro, então trocar por um desconto de 4x em saída só compensa se você realmente mover a carga de trabalho.
  • A saída é visual e precisa bater com uma cena descrita. No nosso único run de shader, o Opus 5 aderiu melhor ao briefing e respondeu em ambos os eixos do mouse.

Escolha o Grok 4.6 se...

  • A tabela de preços decide. $2/$6 contra $5/$25 é a diferença que sobrevive a qualquer formato de workload que calculamos, incluindo a própria recarga de 200k do Grok. Um mês pesado em geração sai por $26 vs $105.
  • O número de interações entra na conta. No AA-Briefcase, o Grok 4.6 usou cerca de 53 interações e 0,5B de tokens de entrada, contra ~103 e ~2,0B do Opus 5 máx.
  • Você quer um modelo de fronteira no Cursor ou no Grok Build sem pagar preço de Opus, e um primeiro passe forte vale mais do que um acabamento perfeito.

Como começar com Grok 4.6 e Claude Opus 5

Ambos os modelos podem ser acessados de várias formas. As strings de modelo a usar são grok-4.6 e claude-opus-5

Superfície Grok 4.6 Claude Opus 5
App para consumidor Grok Build; Cursor (desktop, web, iOS, CLI) Claude Pro; padrão no Claude Max
API de primeiro nível Sim (SpaceXAI API) Sim (Claude API)
Nuvens Amazon Bedrock, Google Vertex AI, Azure AI Foundry Amazon Bedrock, Google Vertex AI, Azure AI Foundry
Agentes de código Cursor, Grok Build Claude Code, Cursor
Roteadores de terceiros OpenRouter, Vercel, Cloudflare OpenRouter, Vercel, Cloudflare
ID do modelo na API grok-4.6 claude-opus-5

Usando Grok 4.6 e Claude Opus 5 em um agente de código

No Cursor, ambos aparecem no seletor. O Claude Code é nativo da Anthropic; o Grok Build lê uma árvore .claude/, coisa que o Claude Code não recíproca para arquivos .grok/. Na API, é só trocar uma string dentro de cada SDK do fornecedor.

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # Grok 4.6 é grok-4.6 no SDK da SpaceXAI, não neste client
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)

A configuração completa de cada API está no nosso tutorial da API do Grok 4.6 e no nosso tutorial da API do Claude Opus 5. Se você quer o produto de agente e não o ID do modelo, comece pelo Claude Code 101.

Considerações finais

Se o trabalho é uma cena visual descrita ou um agente de trabalho de conhecimento que você vai avaliar por Elo, use o Claude Opus 5. Se o trabalho é um agente de código de fronteira que você também vai avaliar pela fatura, use o Grok 4.6.

O que chama atenção é o quão pouco os benchmarks decidem. Dois pontos no AA Index, ou cem de Elo no GDPval-AA, é uma diferença menor do que a da tabela de preços: $105 contra $26 para o mesmo mês pesado em geração. Os modelos são próximos; as faturas, não.

Se você quer os conceitos por trás desses agentes, recomendo a trilha de habilidades AI Fundamentals. Para o fluxo nativo da Anthropic, o Claude Code 101 é o ponto de partida prático.

FAQs

Quando devo usar o Grok 4.6 em vez do Claude Opus 5?

Use o Grok 4.6 quando o custo da API for o limitador. Ele custa $2/$6 por 1M de tokens contra $5/$25 do Opus 5, então um mês pesado em geração sai por $26 versus $105. Ele também concluiu nosso shader de aurora com metade das interações do Opus e com bom resultado, e a Artificial Analysis reporta menos interações e tokens de entrada do que o Opus 5 máx. no AA-Briefcase.

Quando devo usar o Claude Opus 5 em vez do Grok 4.6?

Use o Claude Opus 5 quando a qualidade decidir: ele lidera em Elo para trabalho de conhecimento (1.861 vs 1.753 no GDPval-AA v2), no AA Index (63 vs 61) e em linhas de código publicadas como o DeepSWE v1.1 (68,8% vs 65,9%).

Como Grok 4.6 e Claude Opus 5 se comparam em preço?

O Grok 4.6 custa $2 na entrada e $6 na saída por 1M de tokens. O Claude Opus 5 é $5 e $25, o mesmo do Opus 4.8. O Grok 4.6 aplica recarga 2x em prompts com 200k tokens ou mais; o Opus 5 não publica recarga para contexto longo. Leituras de cache custam $0,50 / 1M em ambos nas tarifas padrão.

Quais são os IDs de modelo na API para Grok 4.6 e Claude Opus 5?

O Grok 4.6 é grok-4.6 na SpaceXAI API. O Claude Opus 5 é claude-opus-5 na Claude API. Eles não são intercambiáveis entre SDKs; cada ID pertence ao seu próprio client.

Posso usar Grok 4.6 e Claude Opus 5 juntos?

Sim, se o seu seletor de agentes expuser ambos. O Cursor lista Grok 4.6 e Claude Opus 5 como modelos selecionáveis, e a maioria dos roteadores e catálogos em nuvem usuais carregam ambos, então o seletor raramente é o limitador. A assimetria está nos agentes de primeiro nível: o Claude Code é nativo da Anthropic e não roda Grok, enquanto o Grok Build lê uma árvore .claude/, então a configuração no formato do Claude carrega nessa direção, mas não no caminho inverso.


Tom Farnschläder's photo
Author
Tom Farnschläder
LinkedIn

Editor de Ciência de Dados @ DataCamp | Fazer previsões e construir com APIs é a minha paixão.

Tópicos

Aprenda IA com a DataCamp!

Programa

Fundamentos da IA

10 h
Descubra os fundamentos da IA, aprenda a usar a IA de forma eficaz no trabalho e mergulhe em modelos como o chatGPT para navegar pelo cenário dinâmico da IA.
Ver detalhesRight Arrow
Iniciar Curso
Ver maisRight Arrow
Relacionado
An avian AI exits its cage

blog

12 Alternativas de código aberto ao GPT-4

GPT-4 alternativas de código aberto que podem oferecer desempenho semelhante e exigem menos recursos computacionais para serem executadas. Esses projetos vêm com instruções, fontes de código, pesos de modelos, conjuntos de dados e interface de usuário do chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

blog

O que é o Mistral Large 2? Como funciona, casos de uso e muito mais

O Mistral Large 2 é o modelo de idioma mais recente da Mistral AI, competindo com modelos como GPT-4o, Llama 3.1 e Claude 3 Opus.
Ryan Ong's photo

Ryan Ong

8 min

blog

A OpenAI anuncia o GPT-4 Turbo com visão: O que sabemos até o momento

Descubra a atualização mais recente da OpenAI, GPT-4 Turbo com visão, e seus principais recursos, incluindo o corte de conhecimento aprimorado, uma janela de contexto expandida, preço acessível e muito mais.
Richie Cotton's photo

Richie Cotton

7 min

blog

ChatGPT vs Google Bard: Um guia comparativo para chatbots de IA

Uma introdução amigável para iniciantes aos dois chatbots com tecnologia de IA sobre os quais todos estão falando.
Javier Canales Luna's photo

Javier Canales Luna

14 min

Tutorial

DeepSeek-Coder-V2 Tutorial: Exemplos, instalação, padrões de referência

O DeepSeek-Coder-V2 é um modelo de linguagem de código de código aberto que rivaliza com o desempenho do GPT-4, Gemini 1.5 Pro, Claude 3 Opus, Llama 3 70B ou Codestral.
Dimitri Didmanidze's photo

Dimitri Didmanidze

Tutorial

Primeiros passos com o Claude 3 e a API do Claude 3

Saiba mais sobre os modelos Claude 3, benchmarks de desempenho detalhados e como acessá-los. Além disso, descubra a nova API Python do Claude 3 para geração de texto, acesso a recursos de visão e streaming.
Abid Ali Awan's photo

Abid Ali Awan

Ver MaisVer Mais