Lewati ke konten utama

Grok 4.6 vs Claude Opus 5: Pengodean, Harga, dan Mana yang Dipakai

Grok 4.6 menekan harga Claude Opus 5 di $2/$6 versus $5/$25, tetapi Opus 5 tetap memimpin Elo pekerjaan-pengetahuan dan uji shader aurora kami. Berikut siapa yang sebaiknya memakai yang mana.
Diperbarui 30 Agu 2026  · 12 mnt baca

Jelajahi dengan AI

ChatGPTClaudePerplexity

Pada 12 Agustus 2026, SpaceXAI merilis Grok 4.6 dengan fokus pada agen berdurasi panjang serta pekerjaan interaktif dan visual yang lebih ambisius. Model ini menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index dan dibanderol $2 per satu juta token input serta $6 per satu juta token output. Claude Opus 5 sudah menjadi flagship harian Anthropic: default di Claude Max, model terkuat di Claude Pro, dan setengah harga dari Claude Fable 5 pada $5 / $25 per satu juta token.

Di artikel ini, saya membandingkan Grok 4.6 dan Claude Opus 5 untuk pengodean, pekerjaan pengetahuan, proyek visual, dan harga. Untuk ulasan lebih mendalam masing-masing model, lihat panduan Grok 4.6 dan panduan Claude Opus 5 kami.

Ringkasnya

  • Opus 5 memimpin pada komposit yang dipublikasikan: 63 vs 61 pada AA Intelligence Index, 1.861 vs 1.753 Elo pada GDPval-AA v2.
  • Grok 4.6 berada di frontier yang sama dengan harga 24–40% dari harga daftar Opus.
  • Pilih Opus 5 untuk performa puncak pada agen pekerjaan-pengetahuan dan pengodean repositori.
  • Pilih Grok 4.6 bila biaya atau jumlah giliran menjadi kendala, namun Anda ingin performa sebanding.
  • Bulan yang berat pada generasi di 1M masuk / 4M keluar adalah $26 di Grok 4.6 versus $105 di Opus 5.

Apa itu Grok 4.6?

Grok 4.6 adalah model frontier SpaceXAI per Agustus 2026, dibangun di atas Grok 4.5 untuk agen berdurasi panjang dan pekerjaan interaktif serta visual yang lebih ambisius. ID model API adalah grok-4.6. Context window-nya 500.000 token, dengan tarif 2x saat prompt melewati 200.000 token.

Tulisan xAI menekankan first pass pada proyek visual dan interaktif, plus lebih banyak pengujian mandiri pada lintasan panjang. Artificial Analysis memberi skor 61 pada Intelligence Index, selevel dengan GPT-5.6 Sol dan di belakang Claude Opus 5 (maks, 63). Model ini tersedia di Cursor dan Grok Build, serta di API SpaceXAI, OpenRouter, Vercel, dan Cloudflare.

Untuk memanggilnya sendiri, ikuti tutorial API Grok 4.6 kami. Jika Anda lebih peduli pada pembungkus agen ketimbang kartu model, kami juga menjalankan Grok Build melawan Claude Code pada dataset churn yang direkayasa. Kami juga membandingkannya dengan model flagship OpenAI saat ini di panduan Grok 4.6 vs GPT-5.6 Sol.

Apa itu Claude Opus 5?

Claude Opus 5 adalah model kelas Opus terbaru dari Anthropic, dijual sebagai daily driver yang cermat dan mendekati Claude Fable 5 dengan setengah harga. ID model API adalah claude-opus-5. Model ini menjadi default di Claude Max dan yang terkuat di Claude Pro, dengan harga $5 / $25 per satu juta token, sama seperti Opus 4.8.

Anthropic melaporkan angka state-of-the-art pada Frontier-Bench v0.1 (43,3%) dan GDPval-AA v2 (1.861 Elo), sembari tetap di belakang Mythos 5 pada eksploitasi keamanan siber. Mode cepat berjalan sekitar 2,5x kecepatan default dengan dua kali harga dasar. Pengembang memulai dari Claude API; katalog cloud juga mencantumkannya di Amazon Bedrock, Google Vertex AI, dan Azure AI Foundry.

Kami membahas peluncurannya di panduan Claude Opus 5 dan alur permintaan di tutorial API Opus 5. Jika Anda memilih di dalam tumpukan Anthropic sendiri, lihat panduan perbandingan kami Opus 5 vs Fable 5 dan Opus 5 vs Sonnet 5.

Grok 4.6 vs Claude Opus 5: Perbandingan Head-to-Head

Opus 5 memimpin kualitas; Grok 4.6 lebih murah

Pada komposit yang dipublikasikan kedua lab, Opus 5 sedikit di depan: 63 versus 61 pada Artificial Analysis Intelligence Index, dan 1861 versus 1753 Elo pada GDPval-AA v2. Kartu tarifnya jauh berbeda: Grok 4.6 adalah $2/$6 per 1M token dibanding Opus 5 di $5/$25.

Fitur Grok 4.6 Claude Opus 5
AA Intelligence Index 61 63 (maks)
GDPval-AA v2 (Elo) 1753 1861
API input / output per 1M $2 / $6 $5 / $25
Context window 500k 1M
Biaya tambahan konteks panjang 2x pada ≥200k token prompt Tidak dipublikasikan
ID model API grok-4.6 claude-opus-5

Pengodean dan alur kerja agentic

Opus 5 memimpin pada baris pengodean yang dipublikasikan dan dimiliki keduanya. Paling menonjol, pada DeepSWE v1.1, Opus 5 berada di 68,8% melawan 65,9% di Cursor untuk Grok 4.6 High.

Sinyal lain adalah hasil dari uji Grok Build vs Claude Code kami: Grok 4.6 high versus Claude Opus 5 high, satu percakapan masing-masing, pada tabel churn dengan kebocoran yang ditanam. Grok Build memberi jawaban lebih sedikit namun lebih langsung bisa dipakai. Claude Code menggali lebih dalam, namun juga mengirim bug format dasbor.

Jika Anda sudah membayar harga Anthropic untuk pekerjaan repositori, Opus 5 adalah kartu yang lebih aman menurut publikasi. Jika Anda menginginkan model pengodean frontier tanpa harga frontier, Grok 4.6 adalah pilihan Cursor yang benar-benar akan saya nyalakan terus.

Pekerjaan pengetahuan dan agen cakrawala panjang

Opus 5 unggul pada pekerjaan pengetahuan: GDPval-AA v2 adalah 1861 untuk Opus 5 dan 1753 untuk Grok 4.6. Artificial Analysis tetap menempatkan Grok hanya di belakang Opus 5 di sana, dengan rentang galat yang tumpang tindih melawan Fable 5 dan Qwen3.8 Max.

Kesenjangan efisiensinya lebih besar. Pada AA-Briefcase, Grok 4.6 mencetak 1577, di belakang keluarga Opus 5, namun selesai sekitar 53 giliran dan sekitar 0,5 miliar token input. Opus 5 (maks) membutuhkan sekitar 103 giliran dan sekitar 2,0 miliar token input. Intinya, Opus 5 menang di papan skor, sedangkan Grok 4.6 menang di anggaran token.

Pekerjaan visual dan interaktif

Proposal SpaceXAI untuk Grok 4.6 adalah first pass yang lebih kuat pada proyek visual dan interaktif. Peluncuran Opus 5 dari Anthropic lebih senyap di area itu dan lebih lantang pada verifikasi, plus "keluaran visual jauh lebih kuat" tanpa angka publik melawan Grok.

Itulah mengapa kami menjalankan tugas shader bersama. Kedua model menulis GLSL yang nyata, namun hasil Opus 5 lebih sesuai dengan brief dan lebih responsif terhadap pergerakan kursor. Hasil Grok 4.6 juga tampak sangat bagus dan melakukannya dalam giliran yang lebih sedikit.

Harga: berapa yang benar-benar Anda bayar

Pekerjaan berat generasi adalah $26 di Grok, $105 di Opus

Harga daftar adalah celah paling jelas di perbandingan ini. Grok 4.6 adalah $2 input dan $6 output per 1M token, sedangkan Opus 5 adalah $5 dan $25. Ini membuat model Anthropic 2,5 kali lebih mahal pada input dan lebih dari 4 kali pada output—jelas perbedaan besar. Misalnya, bulan yang berat pada generasi di 1M masuk / 4M keluar adalah $26 di Grok 4.6 dan $105 di Opus 5. Asisten yang lebih seimbang di 1M masuk / 250K keluar adalah $3,50 versus $11,25.

Tarif token berdampingan

Ini adalah tarif standar yang dipublikasikan, plus ekstra yang benar-benar ada untuk kedua model.

Tarif Grok 4.6 Claude Opus 5
Input, per 1M token $2,00 $5,00
Output, per 1M token $6,00 $25,00
Pembacaan cache input, per 1M token $0,50 $0,50
Penulisan cache, per 1M token $1,00 (≥200k baris) $6,25 (5 menit) / $10 (1 jam)
Varian cepat $4 / $12 (2x) $10 / $50 (2x; ~2,5x kecepatan)
Biaya tambahan konteks panjang 2x pada ≥200k token prompt ($4 / $1 / $12) Tidak dipublikasikan

Premium pada output yang paling terasa. Mode cepat adalah overlay 2x pada keduanya, bukan bentuk ketiga. Opus 5 juga mempublikasikan diskon batch 50% ($2,50 / $12,50), yang saat ini tidak ditawarkan Grok 4.6.

Biaya beban kerja nyata

Formulanya: (volume ÷ 1M) × tarif, dijumlahkan pada input dan output, pada tarif standar kecuali baris di atas ambang, yang memakai biaya tambahan 2x Grok. Angka dibulatkan ke sen untuk nominal di bawah $10, jika tidak ke dolar terdekat.

Beban kerja Grok 4.6 Claude Opus 5 Selisih
Asisten seimbang: 1M masuk / 250K keluar $3,50 $11,25 Opus 5 +$7,75 (221%)
Berat generasi: 1M masuk / 4M keluar $26 $105 Opus 5 +$79 (304%)
Retrieval, di bawah ambang: 10M masuk / 1M keluar $26 $75 Opus 5 +$49 (188%)
Retrieval, di atas ambang: 10M masuk / 1M keluar $52 $75 Opus 5 +$23 (44%)

Retrieval di bawah 200k adalah cerita tarif input ($26 vs $75). Namun, biaya tambahan 200k Grok berperan di sini: Lewati ambang itu, agregat 10M / 1M yang sama menjadi $52 vs $75. Biaya tambahan memang mengecilkan celahnya, tapi tidak membuat Opus 5 lebih murah.

Bagaimana Performa Grok 4.6 dan Claude Opus 5

Grafik vendor tidak akan memberi tahu Anda apakah sebuah model bisa menggambar adegan yang Anda jelaskan. Kami menjalankan satu tugas agen pengodean bersama dari bank uji kami, lalu menilai hasilnya.

Uji coba

Kami menguji keduanya pada kemampuan membuat grafik shader layar penuh yang menampilkan aurora di atas cakrawala pegunungan, di-host di p5.js, dengan mouse dan waktu dipass sebagai uniform. Tes ini terinspirasi oleh prompt shader Ethan Mollick. Kami menamainya agar hasilnya lebih mudah dibandingkan. Kedua model dijalankan sekali, tanpa ulang, di dalam Cursor dengan tool yang identik. Keduanya menggunakan varian penalaran tinggi.

Prompt verbatim:

Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.

Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.

Apa yang dihasilkan Grok 4.6

Grok 4.6 mengirim index.html yang berfungsi dalam 13 giliran. Efeknya adalah GLSL fragment shader yang nyata dengan p5 hanya untuk hosting kanvas. Tirai bergerak dengan gaya seperti aurora, dengan pembagian tiga warna yang terlihat lebih bagus daripada lembaran hijau dominan milik Opus 5, plus bintang-bintang yang berkedip di latar belakang.

Kekurangannya ada pada lanskap. Pegunungan terbaca seperti siluet kartun, itulah mengapa kecocokan estetikanya 4 bukan 5. Interaktivitas kursor biasa saja: Seperti yang terlihat pada video di bawah, grafik sangat responsif pada sumbu x, namun tidak terlalu pada sumbu y.

Apa yang dihasilkan Claude Opus 5

Opus 5 juga lulus, juga dalam GLSL yang autentik. Kecocokan estetikanya tepat: tiga jajaran pegunungan dalam rona abu-abu berbeda, tirai yang terbaca sebagai aurora, bintang berkedip. Warnanya sebagian besar hijau, yang memang warna aurora paling umum. Jadi lebih benar, meski tiga warna Grok terlihat lebih bagus menurut saya. Interaktivitas kursor lebih baik dibanding shader Grok, dengan tirai yang membengkok dan mencerah di kedua sumbu.

Opus membutuhkan jauh lebih banyak giliran daripada Grok, total 46. Namun, 19 di antaranya terkait permintaan izin menjalankan perintah verifikasi (yang tidak diizinkan menurut aturan tes), jadi hanya 27 yang relevan untuk pembuatan shader murni. Tetap saja, Grok hanya membutuhkan separuh jumlah giliran Opus.

Hasil

Ukuran Grok 4.6 high Claude Opus 5 high
Giliran 13 27
Dapat dijalankan lulus lulus
Kecocokan estetika 4 5
Kompetensi shader 5 5
Interaktivitas kursor 3 5
Mengikuti teknik 5 5

Opus 5 lebih dekat dengan brief: pegunungan berlapis dan respons mouse pada kedua sumbu. Tirai Grok 4.6 terlihat lebih berwarna dan tetap lulus, namun pegunungannya terlalu disederhanakan, dan kursor terutama menggerakkan sumbu x.

Ini adalah n=1, bukan angka token atau biaya, dan hanya menguji shader adegan terdeskripsi dengan GLSL reaktif kursor, bukan pengodean repositori atau pekerjaan pengetahuan.

Kapan Memilih Grok 4.6 vs Claude Opus 5

Opus 5 untuk adegan, Grok 4.6 untuk tagihan

Jika papan skor yang menentukan, Opus 5. Jika faktur yang menentukan, Grok 4.6 adalah model frontier yang benar-benar akan saya nyalakan terus.

Pilih Claude Opus 5 jika...

  • Elo pekerjaan-pengetahuan menjadi kriteria rekrutmen. GDPval-AA v2 (1.861 vs 1.753) dan AA Index (63 vs 61) keduanya milik Opus 5 (maks).
  • Pekerjaannya adalah pengodean repositori. Opus 5 memiliki baris yang dipublikasikan: 68,8% pada DeepSWE v1.1 melawan 65,9% untuk Grok 4.6 High, plus 79,2% pada SWE-bench Pro dan 43,3% pada Frontier-Bench, yang tidak memiliki skor untuk Grok.
  • Tim Anda sudah hidup di Claude Max, Claude Code, atau Claude Pro. Opus 5 adalah default di Max dan model terkuat di Pro, jadi beralih demi diskon output 4x hanya layak jika Anda benar-benar memindahkan bebannya.
  • Keluaran yang dibutuhkan adalah visual yang harus cocok dengan adegan terdeskripsi. Dalam satu uji shader kami, Opus 5 memenuhi brief lebih dekat dan merespons pada kedua sumbu mouse.

Pilih Grok 4.6 jika...

  • Kartu tarif yang menentukan. $2/$6 melawan $5/$25 adalah celah yang bertahan pada semua bentuk beban kerja yang kami hitung, termasuk biaya tambahan 200k milik Grok. Bulan berat generasi adalah $26 versus $105.
  • Jumlah giliran yang menentukan tagihan. Pada AA-Briefcase, Grok 4.6 memakai sekitar 53 giliran dan 0,5 miliar token input melawan ~103 dan ~2,0 miliar milik Opus 5 maks.
  • Anda ingin model frontier di Cursor atau Grok Build tanpa membayar harga Opus, dan first pass yang kuat lebih Anda butuhkan daripada hasil akhir.

Cara Memulai dengan Grok 4.6 dan Claude Opus 5

Kedua model bisa diakses dengan berbagai cara. String model yang digunakan adalah grok-4.6 dan claude-opus-5

Permukaan Grok 4.6 Claude Opus 5
Aplikasi konsumen Grok Build; Cursor (desktop, web, iOS, CLI) Claude Pro; default di Claude Max
API pihak pertama Ya (SpaceXAI API) Ya (Claude API)
Platform cloud Amazon Bedrock, Google Vertex AI, Azure AI Foundry Amazon Bedrock, Google Vertex AI, Azure AI Foundry
Agen pengodean Cursor, Grok Build Claude Code, Cursor
Router pihak ketiga OpenRouter, Vercel, Cloudflare OpenRouter, Vercel, Cloudflare
ID model API grok-4.6 claude-opus-5

Menggunakan Grok 4.6 dan Claude Opus 5 dalam agen pengodean

Di Cursor, keduanya muncul di daftar pilihan. Claude Code bersifat native Anthropic; Grok Build membaca pohon .claude/, yang tidak akan dibalas Claude Code untuk berkas .grok/. API hanyalah pertukaran satu string di dalam masing-masing SDK vendor.

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)

Penyiapan lengkap untuk masing-masing API ada di tutorial API Grok 4.6 dan tutorial API Claude Opus 5 kami. Jika Anda menginginkan produk agen alih-alih ID model, mulailah dari Claude Code 101.

Pemikiran Akhir

Jika pekerjaannya adalah adegan visual terdeskripsi atau agen pekerjaan-pengetahuan yang akan Anda nilai berdasarkan Elo, gunakan Claude Opus 5. Jika pekerjaannya adalah agen pengodean frontier yang juga akan Anda nilai pada faktur, gunakan Grok 4.6.

Yang menonjol adalah betapa sedikitnya tolok ukur yang menentukan. Dua poin pada AA Index, atau seratus Elo pada GDPval-AA, adalah celah yang lebih sempit daripada yang ada di kartu tarif: $105 versus $26 untuk bulan berat generasi yang sama. Modelnya berdekatan; tagihannya tidak.

Jika Anda menginginkan konsep di balik para agen ini, saya merekomendasikan AI Fundamentals skill track. Untuk alur kerja native Claude, Claude Code 101 adalah titik mula yang praktis.

FAQ

Kapan saya harus menggunakan Grok 4.6 dibanding Claude Opus 5?

Gunakan Grok 4.6 ketika biaya API menjadi kendala. Model ini dibanderol $2/$6 per 1M token melawan Opus 5 di $5/$25, sehingga bulan berat generasi adalah $26 versus $105. Model ini juga menyelesaikan shader aurora kami dalam setengah jumlah giliran Opus dengan hasil yang baik, dan Artificial Analysis melaporkan lebih sedikit giliran serta token input daripada Opus 5 maks pada AA-Briefcase.

Kapan saya harus menggunakan Claude Opus 5 dibanding Grok 4.6?

Gunakan Claude Opus 5 ketika kualitas yang menentukan: model ini memimpin pada Elo pekerjaan-pengetahuan (1.861 vs 1.753 pada GDPval-AA v2), AA Index (63 vs 61), dan baris pengodean yang dipublikasikan seperti DeepSWE v1.1 (68,8% vs 65,9%).

Bagaimana perbandingan harga Grok 4.6 dan Claude Opus 5?

Grok 4.6 adalah $2 untuk input dan $6 untuk output per 1M token. Claude Opus 5 adalah $5 dan $25, sama seperti Opus 4.8. Grok 4.6 mengenakan biaya tambahan 2x untuk prompt pada atau di atas 200k token; Opus 5 tidak mempublikasikan biaya tambahan konteks panjang. Pembacaan cache adalah $0,50 / 1M pada keduanya di tarif standar.

Apa ID model API untuk Grok 4.6 dan Claude Opus 5?

Grok 4.6 adalah grok-4.6 pada SpaceXAI API. Claude Opus 5 adalah claude-opus-5 pada Claude API. Keduanya bukan pertukaran langsung lintas SDK; masing-masing ID milik kliennya sendiri.

Bisakah saya menggunakan Grok 4.6 dan Claude Opus 5 secara bersamaan?

Bisa, jika pemilih agen Anda menampilkan keduanya. Cursor mencantumkan Grok 4.6 dan Claude Opus 5 sebagai model yang dapat dipilih, dan sebagian besar router serta katalog cloud yang umum mendukung keduanya, jadi pemilih jarang menjadi kendala. Asimetri terjadi pada agen pihak pertama: Claude Code bersifat native Anthropic dan tidak akan menjalankan Grok, sementara Grok Build membaca pohon .claude/, sehingga konfigurasi berbentuk Claude bisa terbawa ke arah itu tetapi tidak sebaliknya.


Tom Farnschläder's photo
Author
Tom Farnschläder
LinkedIn

Tom adalah seorang ilmuwan data dan pendidik teknis. Ia menulis dan mengelola tutorial serta artikel blog ilmu data DataCamp. Sebelumnya, Tom bekerja di bidang ilmu data di Deutsche Telekom.

Topik

Belajar AI Bersama DataCamp!

Program

Dasar-Dasar Kecerdasan Buatan

10 Hr
Pelajari dasar-dasar kecerdasan buatan (AI), pelajari cara memanfaatkan AI secara efektif untuk pekerjaan, dan jelajahi model seperti ChatGPT untuk memahami lanskap AI yang dinamis.
Lihat DetailRight Arrow
Mulai Kursus
Lihat Lebih BanyakRight Arrow