Program
Gunakan Claude Opus 5 ketika kualitas yang menentukan: model ini memimpin pada Elo pekerjaan-pengetahuan (1.861 vs 1.753 pada GDPval-AA v2), AA Index (63 vs 61), dan baris pengodean yang dipublikasikan seperti DeepSWE v1.1 (68,8% vs 65,9%).
Pada 12 Agustus 2026, SpaceXAI merilis Grok 4.6 dengan fokus pada agen berdurasi panjang serta pekerjaan interaktif dan visual yang lebih ambisius. Model ini menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index dan dibanderol $2 per satu juta token input serta $6 per satu juta token output. Claude Opus 5 sudah menjadi flagship harian Anthropic: default di Claude Max, model terkuat di Claude Pro, dan setengah harga dari Claude Fable 5 pada $5 / $25 per satu juta token.
Di artikel ini, saya membandingkan Grok 4.6 dan Claude Opus 5 untuk pengodean, pekerjaan pengetahuan, proyek visual, dan harga. Untuk ulasan lebih mendalam masing-masing model, lihat panduan Grok 4.6 dan panduan Claude Opus 5 kami.
Grok 4.6 adalah model frontier SpaceXAI per Agustus 2026, dibangun di atas Grok 4.5 untuk agen berdurasi panjang dan pekerjaan interaktif serta visual yang lebih ambisius. ID model API adalah grok-4.6. Context window-nya 500.000 token, dengan tarif 2x saat prompt melewati 200.000 token.
Tulisan xAI menekankan first pass pada proyek visual dan interaktif, plus lebih banyak pengujian mandiri pada lintasan panjang. Artificial Analysis memberi skor 61 pada Intelligence Index, selevel dengan GPT-5.6 Sol dan di belakang Claude Opus 5 (maks, 63). Model ini tersedia di Cursor dan Grok Build, serta di API SpaceXAI, OpenRouter, Vercel, dan Cloudflare.
Untuk memanggilnya sendiri, ikuti tutorial API Grok 4.6 kami. Jika Anda lebih peduli pada pembungkus agen ketimbang kartu model, kami juga menjalankan Grok Build melawan Claude Code pada dataset churn yang direkayasa. Kami juga membandingkannya dengan model flagship OpenAI saat ini di panduan Grok 4.6 vs GPT-5.6 Sol.
Claude Opus 5 adalah model kelas Opus terbaru dari Anthropic, dijual sebagai daily driver yang cermat dan mendekati Claude Fable 5 dengan setengah harga. ID model API adalah claude-opus-5. Model ini menjadi default di Claude Max dan yang terkuat di Claude Pro, dengan harga $5 / $25 per satu juta token, sama seperti Opus 4.8.
Anthropic melaporkan angka state-of-the-art pada Frontier-Bench v0.1 (43,3%) dan GDPval-AA v2 (1.861 Elo), sembari tetap di belakang Mythos 5 pada eksploitasi keamanan siber. Mode cepat berjalan sekitar 2,5x kecepatan default dengan dua kali harga dasar. Pengembang memulai dari Claude API; katalog cloud juga mencantumkannya di Amazon Bedrock, Google Vertex AI, dan Azure AI Foundry.
Kami membahas peluncurannya di panduan Claude Opus 5 dan alur permintaan di tutorial API Opus 5. Jika Anda memilih di dalam tumpukan Anthropic sendiri, lihat panduan perbandingan kami Opus 5 vs Fable 5 dan Opus 5 vs Sonnet 5.

Pada komposit yang dipublikasikan kedua lab, Opus 5 sedikit di depan: 63 versus 61 pada Artificial Analysis Intelligence Index, dan 1861 versus 1753 Elo pada GDPval-AA v2. Kartu tarifnya jauh berbeda: Grok 4.6 adalah $2/$6 per 1M token dibanding Opus 5 di $5/$25.
| Fitur | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| AA Intelligence Index | 61 | 63 (maks) |
| GDPval-AA v2 (Elo) | 1753 | 1861 |
| API input / output per 1M | $2 / $6 | $5 / $25 |
| Context window | 500k | 1M |
| Biaya tambahan konteks panjang | 2x pada ≥200k token prompt | Tidak dipublikasikan |
| ID model API | grok-4.6 |
claude-opus-5 |
Opus 5 memimpin pada baris pengodean yang dipublikasikan dan dimiliki keduanya. Paling menonjol, pada DeepSWE v1.1, Opus 5 berada di 68,8% melawan 65,9% di Cursor untuk Grok 4.6 High.
Sinyal lain adalah hasil dari uji Grok Build vs Claude Code kami: Grok 4.6 high versus Claude Opus 5 high, satu percakapan masing-masing, pada tabel churn dengan kebocoran yang ditanam. Grok Build memberi jawaban lebih sedikit namun lebih langsung bisa dipakai. Claude Code menggali lebih dalam, namun juga mengirim bug format dasbor.
Jika Anda sudah membayar harga Anthropic untuk pekerjaan repositori, Opus 5 adalah kartu yang lebih aman menurut publikasi. Jika Anda menginginkan model pengodean frontier tanpa harga frontier, Grok 4.6 adalah pilihan Cursor yang benar-benar akan saya nyalakan terus.
Opus 5 unggul pada pekerjaan pengetahuan: GDPval-AA v2 adalah 1861 untuk Opus 5 dan 1753 untuk Grok 4.6. Artificial Analysis tetap menempatkan Grok hanya di belakang Opus 5 di sana, dengan rentang galat yang tumpang tindih melawan Fable 5 dan Qwen3.8 Max.
Kesenjangan efisiensinya lebih besar. Pada AA-Briefcase, Grok 4.6 mencetak 1577, di belakang keluarga Opus 5, namun selesai sekitar 53 giliran dan sekitar 0,5 miliar token input. Opus 5 (maks) membutuhkan sekitar 103 giliran dan sekitar 2,0 miliar token input. Intinya, Opus 5 menang di papan skor, sedangkan Grok 4.6 menang di anggaran token.
Proposal SpaceXAI untuk Grok 4.6 adalah first pass yang lebih kuat pada proyek visual dan interaktif. Peluncuran Opus 5 dari Anthropic lebih senyap di area itu dan lebih lantang pada verifikasi, plus "keluaran visual jauh lebih kuat" tanpa angka publik melawan Grok.
Itulah mengapa kami menjalankan tugas shader bersama. Kedua model menulis GLSL yang nyata, namun hasil Opus 5 lebih sesuai dengan brief dan lebih responsif terhadap pergerakan kursor. Hasil Grok 4.6 juga tampak sangat bagus dan melakukannya dalam giliran yang lebih sedikit.

Harga daftar adalah celah paling jelas di perbandingan ini. Grok 4.6 adalah $2 input dan $6 output per 1M token, sedangkan Opus 5 adalah $5 dan $25. Ini membuat model Anthropic 2,5 kali lebih mahal pada input dan lebih dari 4 kali pada output—jelas perbedaan besar. Misalnya, bulan yang berat pada generasi di 1M masuk / 4M keluar adalah $26 di Grok 4.6 dan $105 di Opus 5. Asisten yang lebih seimbang di 1M masuk / 250K keluar adalah $3,50 versus $11,25.
Ini adalah tarif standar yang dipublikasikan, plus ekstra yang benar-benar ada untuk kedua model.
| Tarif | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Input, per 1M token | $2,00 | $5,00 |
| Output, per 1M token | $6,00 | $25,00 |
| Pembacaan cache input, per 1M token | $0,50 | $0,50 |
| Penulisan cache, per 1M token | $1,00 (≥200k baris) | $6,25 (5 menit) / $10 (1 jam) |
| Varian cepat | $4 / $12 (2x) | $10 / $50 (2x; ~2,5x kecepatan) |
| Biaya tambahan konteks panjang | 2x pada ≥200k token prompt ($4 / $1 / $12) | Tidak dipublikasikan |
Premium pada output yang paling terasa. Mode cepat adalah overlay 2x pada keduanya, bukan bentuk ketiga. Opus 5 juga mempublikasikan diskon batch 50% ($2,50 / $12,50), yang saat ini tidak ditawarkan Grok 4.6.
Formulanya: (volume ÷ 1M) × tarif, dijumlahkan pada input dan output, pada tarif standar kecuali baris di atas ambang, yang memakai biaya tambahan 2x Grok. Angka dibulatkan ke sen untuk nominal di bawah $10, jika tidak ke dolar terdekat.
| Beban kerja | Grok 4.6 | Claude Opus 5 | Selisih |
|---|---|---|---|
| Asisten seimbang: 1M masuk / 250K keluar | $3,50 | $11,25 | Opus 5 +$7,75 (221%) |
| Berat generasi: 1M masuk / 4M keluar | $26 | $105 | Opus 5 +$79 (304%) |
| Retrieval, di bawah ambang: 10M masuk / 1M keluar | $26 | $75 | Opus 5 +$49 (188%) |
| Retrieval, di atas ambang: 10M masuk / 1M keluar | $52 | $75 | Opus 5 +$23 (44%) |
Retrieval di bawah 200k adalah cerita tarif input ($26 vs $75). Namun, biaya tambahan 200k Grok berperan di sini: Lewati ambang itu, agregat 10M / 1M yang sama menjadi $52 vs $75. Biaya tambahan memang mengecilkan celahnya, tapi tidak membuat Opus 5 lebih murah.
Grafik vendor tidak akan memberi tahu Anda apakah sebuah model bisa menggambar adegan yang Anda jelaskan. Kami menjalankan satu tugas agen pengodean bersama dari bank uji kami, lalu menilai hasilnya.
Kami menguji keduanya pada kemampuan membuat grafik shader layar penuh yang menampilkan aurora di atas cakrawala pegunungan, di-host di p5.js, dengan mouse dan waktu dipass sebagai uniform. Tes ini terinspirasi oleh prompt shader Ethan Mollick. Kami menamainya agar hasilnya lebih mudah dibandingkan. Kedua model dijalankan sekali, tanpa ulang, di dalam Cursor dengan tool yang identik. Keduanya menggunakan varian penalaran tinggi.
Prompt verbatim:
Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.
Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.
Grok 4.6 mengirim index.html yang berfungsi dalam 13 giliran. Efeknya adalah GLSL fragment shader yang nyata dengan p5 hanya untuk hosting kanvas. Tirai bergerak dengan gaya seperti aurora, dengan pembagian tiga warna yang terlihat lebih bagus daripada lembaran hijau dominan milik Opus 5, plus bintang-bintang yang berkedip di latar belakang.
Kekurangannya ada pada lanskap. Pegunungan terbaca seperti siluet kartun, itulah mengapa kecocokan estetikanya 4 bukan 5. Interaktivitas kursor biasa saja: Seperti yang terlihat pada video di bawah, grafik sangat responsif pada sumbu x, namun tidak terlalu pada sumbu y.
Opus 5 juga lulus, juga dalam GLSL yang autentik. Kecocokan estetikanya tepat: tiga jajaran pegunungan dalam rona abu-abu berbeda, tirai yang terbaca sebagai aurora, bintang berkedip. Warnanya sebagian besar hijau, yang memang warna aurora paling umum. Jadi lebih benar, meski tiga warna Grok terlihat lebih bagus menurut saya. Interaktivitas kursor lebih baik dibanding shader Grok, dengan tirai yang membengkok dan mencerah di kedua sumbu.
Opus membutuhkan jauh lebih banyak giliran daripada Grok, total 46. Namun, 19 di antaranya terkait permintaan izin menjalankan perintah verifikasi (yang tidak diizinkan menurut aturan tes), jadi hanya 27 yang relevan untuk pembuatan shader murni. Tetap saja, Grok hanya membutuhkan separuh jumlah giliran Opus.
| Ukuran | Grok 4.6 high | Claude Opus 5 high |
|---|---|---|
| Giliran | 13 | 27 |
| Dapat dijalankan | lulus | lulus |
| Kecocokan estetika | 4 | 5 |
| Kompetensi shader | 5 | 5 |
| Interaktivitas kursor | 3 | 5 |
| Mengikuti teknik | 5 | 5 |
Opus 5 lebih dekat dengan brief: pegunungan berlapis dan respons mouse pada kedua sumbu. Tirai Grok 4.6 terlihat lebih berwarna dan tetap lulus, namun pegunungannya terlalu disederhanakan, dan kursor terutama menggerakkan sumbu x.
Ini adalah n=1, bukan angka token atau biaya, dan hanya menguji shader adegan terdeskripsi dengan GLSL reaktif kursor, bukan pengodean repositori atau pekerjaan pengetahuan.

Jika papan skor yang menentukan, Opus 5. Jika faktur yang menentukan, Grok 4.6 adalah model frontier yang benar-benar akan saya nyalakan terus.
Pilih Grok 4.6 jika...
Kedua model bisa diakses dengan berbagai cara. String model yang digunakan adalah grok-4.6 dan claude-opus-5.
| Permukaan | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Aplikasi konsumen | Grok Build; Cursor (desktop, web, iOS, CLI) | Claude Pro; default di Claude Max |
| API pihak pertama | Ya (SpaceXAI API) | Ya (Claude API) |
| Platform cloud | Amazon Bedrock, Google Vertex AI, Azure AI Foundry | Amazon Bedrock, Google Vertex AI, Azure AI Foundry |
| Agen pengodean | Cursor, Grok Build | Claude Code, Cursor |
| Router pihak ketiga | OpenRouter, Vercel, Cloudflare | OpenRouter, Vercel, Cloudflare |
| ID model API | grok-4.6 |
claude-opus-5 |
Di Cursor, keduanya muncul di daftar pilihan. Claude Code bersifat native Anthropic; Grok Build membaca pohon .claude/, yang tidak akan dibalas Claude Code untuk berkas .grok/. API hanyalah pertukaran satu string di dalam masing-masing SDK vendor.
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)
Penyiapan lengkap untuk masing-masing API ada di tutorial API Grok 4.6 dan tutorial API Claude Opus 5 kami. Jika Anda menginginkan produk agen alih-alih ID model, mulailah dari Claude Code 101.
Jika pekerjaannya adalah adegan visual terdeskripsi atau agen pekerjaan-pengetahuan yang akan Anda nilai berdasarkan Elo, gunakan Claude Opus 5. Jika pekerjaannya adalah agen pengodean frontier yang juga akan Anda nilai pada faktur, gunakan Grok 4.6.
Yang menonjol adalah betapa sedikitnya tolok ukur yang menentukan. Dua poin pada AA Index, atau seratus Elo pada GDPval-AA, adalah celah yang lebih sempit daripada yang ada di kartu tarif: $105 versus $26 untuk bulan berat generasi yang sama. Modelnya berdekatan; tagihannya tidak.
Jika Anda menginginkan konsep di balik para agen ini, saya merekomendasikan AI Fundamentals skill track. Untuk alur kerja native Claude, Claude Code 101 adalah titik mula yang praktis.
Gunakan Grok 4.6 ketika biaya API menjadi kendala. Model ini dibanderol $2/$6 per 1M token melawan Opus 5 di $5/$25, sehingga bulan berat generasi adalah $26 versus $105. Model ini juga menyelesaikan shader aurora kami dalam setengah jumlah giliran Opus dengan hasil yang baik, dan Artificial Analysis melaporkan lebih sedikit giliran serta token input daripada Opus 5 maks pada AA-Briefcase.
Gunakan Claude Opus 5 ketika kualitas yang menentukan: model ini memimpin pada Elo pekerjaan-pengetahuan (1.861 vs 1.753 pada GDPval-AA v2), AA Index (63 vs 61), dan baris pengodean yang dipublikasikan seperti DeepSWE v1.1 (68,8% vs 65,9%).
Grok 4.6 adalah $2 untuk input dan $6 untuk output per 1M token. Claude Opus 5 adalah $5 dan $25, sama seperti Opus 4.8. Grok 4.6 mengenakan biaya tambahan 2x untuk prompt pada atau di atas 200k token; Opus 5 tidak mempublikasikan biaya tambahan konteks panjang. Pembacaan cache adalah $0,50 / 1M pada keduanya di tarif standar.
Grok 4.6 adalah grok-4.6 pada SpaceXAI API. Claude Opus 5 adalah claude-opus-5 pada Claude API. Keduanya bukan pertukaran langsung lintas SDK; masing-masing ID milik kliennya sendiri.
Bisa, jika pemilih agen Anda menampilkan keduanya. Cursor mencantumkan Grok 4.6 dan Claude Opus 5 sebagai model yang dapat dipilih, dan sebagian besar router serta katalog cloud yang umum mendukung keduanya, jadi pemilih jarang menjadi kendala. Asimetri terjadi pada agen pihak pertama: Claude Code bersifat native Anthropic dan tidak akan menjalankan Grok, sementara Grok Build membaca pohon .claude/, sehingga konfigurasi berbentuk Claude bisa terbawa ke arah itu tetapi tidak sebaliknya.
Tom adalah seorang ilmuwan data dan pendidik teknis. Ia menulis dan mengelola tutorial serta artikel blog ilmu data DataCamp. Sebelumnya, Tom bekerja di bidang ilmu data di Deutsche Telekom.
Belajar AI Bersama DataCamp!
Program
Kursus
Kursus