Tracks
品質で決めるなら Claude Opus 5。知識業務の Elo(GDPval-AA v2 で 1,861 対 1,753)、AA Index(63 対 61)、DeepSWE v1.1(68.8% 対 65.9%)といった公開コーディング指標でリードしています。
2026年8月12日、SpaceXAI は Grok 4.6 をリリースしました。長時間稼働のエージェントや、より野心的な対話型・ビジュアル系の作業に焦点を当てています。GPT-5.6 Sol と Artificial Analysis の Intelligence Index で肩を並べ、価格は入力100万トークンあたり $2、出力100万トークンあたり $6。Claude Opus 5 はすでに Anthropic の日常使いの旗艦モデルで、Claude Max のデフォルト、Claude Pro でも最強モデル。価格は Claude Fable 5 の半分で、100万トークンあたり $5 / $25 です。
本記事では、Grok 4.6 と Claude Opus 5 をコーディング、知識業務、ビジュアル案件、価格の観点から比較します。各モデルの詳細は、Grok 4.6 ガイド と Claude Opus 5 ガイド を参照してください。
Grok 4.6 は SpaceXAI の 2026年8月のフロンティアモデルで、Grok 4.5 を基に、長時間稼働のエージェントや、より野心的な対話型・ビジュアル系の作業に最適化されています。API のモデルIDは grok-4.6。コンテキストウィンドウは 500,000 トークンで、プロンプトが 200,000 トークンを超えると料金が 2 倍になります。
xAI の説明では、ビジュアルおよび対話型プロジェクトでの初回出力の強化や、長い軌跡での自己検証を強調。Artificial Analysis の Intelligence Index では 61 点で、GPT-5.6 Sol と同等、Claude Opus 5(最大)の 63 点に次ぐ位置です。Cursor と Grok Build に対応し、SpaceXAI API に加え OpenRouter、Vercel、Cloudflare からも利用可能。
自分で呼び出すには、Grok 4.6 API チュートリアル を参照してください。モデルカードよりエージェントのラッパーが重要な場合は、仕込み有りのチャーンデータセットで Grok Build と Claude Code の比較 も実施しています。OpenAI の現行旗艦モデルとの比較は Grok 4.6 vs GPT-5.6 Sol ガイドを参照。
Claude Opus 5 は Anthropic の現行 Opus クラスモデルで、思慮深い日常使いのドライバーとして、半額で Claude Fable 5 に迫る実力をうたいます。API のモデルIDは claude-opus-5。Claude Max のデフォルトであり、Claude Pro の最強モデル。価格は Opus 4.8 と同じく 100万トークンあたり $5 / $25。
Anthropic は Frontier-Bench v0.1(43.3%)および GDPval-AA v2(1,861 Elo)で最先端と報告する一方、サイバーセキュリティの攻撃面では Mythos 5 に及ばないと述べています。Fast モードはデフォルトの約 2.5 倍速で、基本料金の 2 倍。開発者は Claude API から利用を開始し、Amazon Bedrock、Google Vertex AI、Azure AI Foundry のクラウドカタログにも掲載。
リリースの詳細は Claude Opus 5 ガイド、リクエストの流れは Opus 5 API チュートリアル を参照。Anthropic のスタック内で選ぶ場合は、Opus 5 vs Fable 5 と Opus 5 vs Sonnet 5 の比較ガイドもどうぞ。

両ラボが公開する合成指標では、Opus 5 がわずかに優勢。Artificial Analysis の Intelligence Index で 63 対 61、GDPval-AA v2 の Elo で 1861 対 1753。料金表は差が大きく、Grok 4.6 は 100万トークンあたり $2/$6、Opus 5 は $5/$25 です。
| 項目 | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| AA Intelligence Index | 61 | 63(最大) |
| GDPval-AA v2(Elo) | 1753 | 1861 |
| API 入力 / 出力(100万あたり) | $2 / $6 | $5 / $25 |
| コンテキストウィンドウ | 500k | 1M |
| 長文サーチャージ | プロンプトが 200k トークン以上で 2x | 未公開 |
| API モデルID | grok-4.6 |
claude-opus-5 |
両者が共有する公開コーディング指標では Opus 5 が先行。とりわけ DeepSWE v1.1 で、Grok 4.6 High の Cursor 計測 65.9% に対し、Opus 5 は 68.8%。
もう一つのシグナルは、Grok Build vs Claude Code の実験結果。Grok 4.6 high と Claude Opus 5 high を、仕込みのリークがあるチャーンテーブルで各1会話。Grok Build は、少ない手数で即使える回答を出しました。Claude Code はより深掘りした一方、ダッシュボードのフォーマットバグも混入。
すでにリポジトリ作業で Anthropic の価格を払っているなら、公開カードとしては Opus 5 がより安全。フロンティア級のコーディング性能を、フロンティア級のコストなしで求めるなら、実際に Cursor で常用したいのは Grok 4.6 です。
知識業務では Opus 5 がリード。GDPval-AA v2 は Opus 5 が 1861、Grok 4.6 が 1753。Artificial Analysis でも Grok は Opus 5 に次ぎ、Fable 5 や Qwen3.8 Max とは誤差範囲が重なる評価です。
効率差はより大きい。AA-Briefcase では、Grok 4.6 はスコア 1577 と Opus 5 ファミリーに及ばない一方、約 53 ターン・約 5 億入力トークンで完了。Opus 5(最大)は約 103 ターン・約 20 億入力トークン。要点は、スコアボードは Opus 5、トークン予算は Grok 4.6 が勝つということ。
SpaceXAI は Grok 4.6 を、ビジュアルと対話型プロジェクトでの強い初回出力として訴求。Anthropic の Opus 5 の発表は、この領域では控えめで、検証面を強調しつつ「ビジュアル出力が大幅に向上」と述べるものの、Grok に対する公的な数値は未提示。
そこで共通のシェーダータスクを実施。両モデルとも実際の GLSL を出力しましたが、Opus 5 の結果はブリーフにより忠実で、カーソルの動きへの反応も強め。Grok 4.6 も見映えは非常に良く、しかも少ないターンで仕上げました。

定価はこの比較で最もわかりやすい差。Grok 4.6 は入力 $2・出力 $6(各100万トークン)、Opus 5 は入力 $5・出力 $25。つまり、入力は 2.5 倍、出力は 4 倍超と、差は明確。たとえば、生成偏重の月間(入力100万/出力400万)は Grok 4.6 が $26、Opus 5 が $105。よりバランス型のアシスタント(入力100万/出力25万)は $3.50 対 $11.25。
標準レートの公開値と、両モデルで実在する追加料金です。
| レート | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| 入力(100万トークンあたり) | $2.00 | $5.00 |
| 出力(100万トークンあたり) | $6.00 | $25.00 |
| キャッシュ読み取り(100万あたり) | $0.50 | $0.50 |
| キャッシュ書き込み(100万あたり) | $1.00(200k 行以上) | $6.25(5分) / $10(1時間) |
| 高速バリアント | $4 / $12(2x) | $10 / $50(2x;約 2.5x 速) |
| 長文サーチャージ | プロンプトが 200k トークン以上で 2x($4 / $1 / $12) | 未公開 |
痛いのは出力プレミアム。Fast モードは両者とも 2 倍のオーバーレイで、別形態ではありません。Opus 5 は 50% のバッチ割引($2.50 / $12.50)も公開していますが、Grok 4.6 には現状なし。
計算式は一度だけ明示:各(ボリューム ÷ 100万)× 単価 を入力と出力で合算。しきい値超過行のみ Grok の 2x サーチャージを適用。$10 未満はセント単位、それ以上はドル単位で四捨五入。
| ワークロード | Grok 4.6 | Claude Opus 5 | 差分 |
|---|---|---|---|
| バランス型アシスタント:入力100万/出力25万 | $3.50 | $11.25 | Opus 5 +$7.75(221%) |
| 生成偏重:入力100万/出力400万 | $26 | $105 | Opus 5 +$79(304%) |
| 検索、しきい値未満:入力1000万/出力100万 | $26 | $75 | Opus 5 +$49(188%) |
| 検索、しきい値超え:入力1000万/出力100万 | $52 | $75 | Opus 5 +$23(44%) |
200k 未満の検索は入力単価の勝負($26 対 $75)。とはいえ Grok の 200k サーチャージも影響するため、これを跨ぐと同じ 1000万/100万 でも $52 対 $75 に。差は縮まるものの、Opus 5 の方が安くなるわけではありません。
ベンダーの表は、描写したシーンを本当に描けるかは教えてくれません。そこでテストバンクから共通のコーディング・エージェント課題を1つ走らせ、成果物を評価しました。
両者に、フルウィンドウのシェーダーグラフィックで、星空の下、山並みの地平線上にカーテン状に揺れるオーロラを描画するページを p5.js でホストし、マウスと時間をユニフォームとして渡す課題を出しました。テストは Ethan Mollick のシェーダープロンプト に着想を得ており、比較可能性を高めるためテーマを統一。両モデルともリトライなしの 1 回実行、Cursor 内で同一ツールを使用。いずれも高推論バリアントを選択。
プロンプト全文:
Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.
Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.
Grok 4.6 は 13 ターンで動作する index.html を出荷。効果は本物の GLSL フラグメントシェーダーで、p5 はキャンバスのホスト役のみ。カーテンはオーロラらしく揺れ、3 色分割で、主に緑の一枚布だった Opus 5 より見映えは良好。背景の星も点滅します。
弱点は風景。山並みがカートゥーンのシルエット風で、審美的な一致度が 5 ではなく 4 の理由。カーソルの相互作用は中程度で、下の動画のとおり x 軸にはよく反応しますが、y 軸はさほどでもありません。
Opus 5 も合格で、本物の GLSL。審美的な一致は良好で、濃淡の異なる 3 つの山並み、オーロラと読めるカーテン、点滅する星。色は主に緑で、実際のオーロラで最も一般的な色。私見では Grok の 3 色の方が見栄えはしますが、正しさでは Opus に分があります。カーソル相互作用は Grok のシェーダーよりも良く、カーテンが両軸で曲がり明るくなります。
Opus は Grok より多く、合計 46 ターンを要しました。ただし、そのうち 19 ターンは(テストルールで許可されない)検証コマンドの実行許可に関連したものだったため、シェーダーの純粋な作成に関係するのは 27 ターン。それでも、Grok は Opus の半分のターン数で済みました。
| 指標 | Grok 4.6 high | Claude Opus 5 high |
|---|---|---|
| ターン数 | 13 | 27 |
| 実行可否 | 合格 | 合格 |
| 審美的一致 | 4 | 5 |
| シェーダー習熟度 | 5 | 5 |
| カーソル相互作用 | 3 | 5 |
| 手法の遵守 | 5 | 5 |
Opus 5 はブリーフへの適合度が高く、層状の山並みと両軸のマウス反応を実現。Grok 4.6 のカーテンはよりカラフルで合格水準ながら、山並みは単純化され、カーソルは主に x 軸を駆動。
これは n=1 の結果であり、トークン数やコストの指標ではありません。リポジトリコーディングや知識業務ではなく、記述シーンの GLSL(カーソル反応付き)を突いたテストに限ります。

スコアボードで決めるなら Opus 5。請求書で決めるなら、常用したいフロンティアモデルは Grok 4.6 です。
Grok 4.6 を選ぶなら…
両モデルは複数の経路で利用可能です。使用するモデル文字列は grok-4.6 と claude-opus-5。
| 面 | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| コンシューマーアプリ | Grok Build/Cursor(デスクトップ、Web、iOS、CLI) | Claude Pro/Claude Max のデフォルト |
| ファーストパーティ API | あり(SpaceXAI API) | あり(Claude API) |
| クラウドプラットフォーム | Amazon Bedrock、Google Vertex AI、Azure AI Foundry | Amazon Bedrock、Google Vertex AI、Azure AI Foundry |
| コーディングエージェント | Cursor、Grok Build | Claude Code、Cursor |
| サードパーティルーター | OpenRouter、Vercel、Cloudflare | OpenRouter、Vercel、Cloudflare |
| API モデルID | grok-4.6 |
claude-opus-5 |
Cursor では、両者ともピッカーに表示されます。Claude Code は Anthropic ネイティブ。Grok Build は .claude/ ツリーを読みますが、Claude Code は .grok/ を相互に読みません。API 側は、各ベンダーの SDK の中でモデル文字列を差し替えるだけです。
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)
各 API のフルセットアップは、Grok 4.6 API チュートリアル と Claude Opus 5 API チュートリアル にあります。モデルIDではなくエージェント製品を使いたい場合は、Claude Code 101 から始めてください。
記述シーンのビジュアル案件や、Elo で評価する知識業務エージェントなら Claude Opus 5。請求書も評価に含まれるフロンティア級のコーディングエージェントなら Grok 4.6。
際立つのは、ベンチマークの決定力の低さ。AA Index の 2 ポイント差、GDPval-AA の 100 Elo 差より、料金表の差の方が大きい(同じ生成偏重の月で $105 対 $26)。モデルは接戦でも、請求は接戦ではありません。
これらのエージェントの背景概念を学ぶなら、AI Fundamentals スキルトラック を。Claude ネイティブのワークフローなら、実践的な導入として Claude Code 101 をおすすめします。
API コストが制約なら Grok 4.6 を選んでください。100万トークンあたり $2/$6 に対し、Opus 5 は $5/$25。したがって、生成偏重の月は $26 対 $105 です。オーロラのシェーダーも、Opus の半分のターンで良好な結果に到達。AA-Briefcase でも、Artificial Analysis は Opus 5 最大より少ないターン数と入力トークンを報告しています。
品質で決めるなら Claude Opus 5。知識業務の Elo(GDPval-AA v2 で 1,861 対 1,753)、AA Index(63 対 61)、DeepSWE v1.1(68.8% 対 65.9%)といった公開コーディング指標でリードしています。
Grok 4.6 は、入力が 100万トークンあたり $2、出力が $6。Claude Opus 5 は $5 と $25(Opus 4.8 と同じ)。Grok 4.6 は 200k トークン以上のプロンプトで 2 倍課金、Opus 5 は長文サーチャージを公開していません。キャッシュ読み取りは標準レートで双方 $0.50/100万です。
Grok 4.6 は SpaceXAI API での grok-4.6。Claude Opus 5 は Claude API での claude-opus-5。SDK をまたいだドロップイン置換はできず、各IDはそれぞれのクライアント専用です。
はい。ピッカーで両方選べるなら併用可能です。Cursor は Grok 4.6 と Claude Opus 5 をモデルとして選択可能で、一般的なルーターやクラウドのカタログでも両者を取り扱うため、ピッカーが制約になることは稀です。非対称なのはファーストパーティのエージェントで、Claude Code は Anthropic ネイティブのため Grok では動作せず、Grok Build は .claude/ ツリーを読み込むので、Claude 由来の設定は Grok 側へは持ち越せますが、その逆は不可です。
DataCamp で AI を学ぼう!