Track
Используйте Claude Opus 5, когда решает качество: он лидирует по Elo для интеллектуальной работы (1 861 против 1 753 на GDPval-AA v2), в AA Index (63 против 61) и в опубликованных метриках кода вроде DeepSWE v1.1 (68,8% против 65,9%).
12 августа 2026 года SpaceXAI выпустила Grok 4.6 с упором на долгоживущих агентов и более амбициозные интерактивные и визуальные задачи. Он сравнялся с GPT-5.6 Sol в Artificial Analysis Intelligence Index и стоит $2 за миллион входных токенов и $6 за миллион выходных токенов. Claude Opus 5 уже был флагманом Anthropic для ежедневной работы: модель по умолчанию в Claude Max, самая сильная в Claude Pro и вдвое дешевле Claude Fable 5 — $5 / $25 за миллион токенов.
В этой статье мы сравним Grok 4.6 и Claude Opus 5 по работе с кодом, интеллектуальным задачам, визуальным проектам и цене. Для подробных обзоров каждой модели смотрите наш гайд по Grok 4.6 и наш гайд по Claude Opus 5.
Grok 4.6 — фронтирная модель SpaceXAI августа 2026 года, построенная на Grok 4.5 для долгоживущих агентов и более амбициозных интерактивных и визуальных задач. ID модели в API — grok-4.6. Окно контекста — 500 000 токенов, с двойным тарифом при превышении 200 000 токенов в промпте.
В обзоре xAI акцент на первых проходах по визуальным и интерактивным проектам, а также на усиленном самотестировании на длинных траекториях. Artificial Analysis оценивает её в 61 по Intelligence Index — на уровне GPT-5.6 Sol и позади Claude Opus 5 (макс., 63). Модель доступна в Cursor и Grok Build, а также в SpaceXAI API, OpenRouter, Vercel и Cloudflare.
Чтобы вызвать её самостоятельно, следуйте нашему туториалу по API Grok 4.6. Если вам важнее агентная обёртка, чем карточка модели, мы также запустили Grok Build против Claude Code на подстроенном датасете ухода клиентов. Мы также сравнили её с текущим флагманом OpenAI в гайде Grok 4.6 vs GPT-5.6 Sol.
Claude Opus 5 — текущая модель класса Opus от Anthropic, позиционируется как вдумчивый «ежедневный драйвер», близкий к Claude Fable 5 за половину цены. ID модели в API — claude-opus-5. Это модель по умолчанию в Claude Max и самая сильная в Claude Pro, по тем же $5 / $25 за миллион токенов, что и Opus 4.8.
Anthropic сообщает передовые результаты на Frontier-Bench v0.1 (43,3%) и GDPval-AA v2 (1 861 Elo), оставаясь позади Mythos 5 в эксплуатации кибербезопасности. Режим Fast примерно в 2,5 раза быстрее базового за двойную цену. Разработчики стартуют с Claude API; модель также доступна в облаках Amazon Bedrock, Google Vertex AI и Azure AI Foundry.
Запуск мы разбираем в гайде по Claude Opus 5, а путь запроса — в нашем туториале по API Opus 5. Если выбираете внутри стека Anthropic, смотрите сравнения Opus 5 vs Fable 5 и Opus 5 vs Sonnet 5.

По композитам, которые публикуют обе лаборатории, Opus 5 немного впереди: 63 против 61 в Artificial Analysis Intelligence Index и 1861 против 1753 Elo на GDPval-AA v2. По тарифам разрыв значительный: Grok 4.6 — $2/$6 за 1M токенов против $5/$25 у Opus 5.
| Характеристика | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| AA Intelligence Index | 61 | 63 (макс.) |
| GDPval-AA v2 (Elo) | 1753 | 1861 |
| API: вход / выход за 1M | $2 / $6 | $5 / $25 |
| Окно контекста | 500k | 1M |
| Наценка за длинный контекст | 2x при ≥200k токенов в промпте | Не публикуется |
| ID модели в API | grok-4.6 |
claude-opus-5 |
Opus 5 лидирует по опубликованным метрикам кода, которые есть у обоих. Особенно на DeepSWE v1.1: у Opus 5 — 68,8% против 65,9% у Cursor для Grok 4.6 High.
Ещё один сигнал — результат нашего прогона Grok Build vs Claude Code: Grok 4.6 high против Claude Opus 5 high, по одному диалогу, на таблице оттока с заложенными утечками. Grok Build дал меньше, но более сразу применимых ответов. Claude Code копнул глубже, но привёз баг в формате дашборда.
Если вы уже платите тарифы Anthropic за работу в репозитории, Opus 5 — более безопасный опубликованный выбор. Если нужен фронтирный кодер без фронтирного ценника, Grok 4.6 — тот вариант в Cursor, который действительно стоит оставить включённым.
Opus 5 лидирует в интеллектуальной работе: GDPval-AA v2 — 1861 у Opus 5 и 1753 у Grok 4.6. Artificial Analysis по‑прежнему ставит Grok позади только Opus 5, с пересекающимися доверительными интервалами с Fable 5 и Qwen3.8 Max.
Разрыв по эффективности больше. На AA-Briefcase Grok 4.6 набирает 1577, отставая от семейства Opus 5, но завершает примерно за 53 хода и около 0,5 млрд входных токенов. Opus 5 (макс.) тратит примерно 103 хода и около 2,0 млрд входных токенов. Вывод: Opus 5 выигрывает табло, а Grok 4.6 — бюджет токенов.
Подача SpaceXAI для Grok 4.6 — более сильный первый проход по визуальным и интерактивным проектам. Запуск Anthropic Opus 5 тише в этой теме и громче про верификацию, плюс «значительно более сильные визуальные результаты» без публичного сравнения с Grok.
Поэтому мы запустили общий шейдерный таск. Обе модели писали настоящий GLSL, но результат Opus 5 чуть точнее соответствовал заданию и активнее реагировал на движение курсора. У Grok 4.6 тоже получился очень приятный вид и при этом — меньше ходов.

Прайс-лист — самый наглядный разрыв. Grok 4.6 — $2 за вход и $6 за выход на 1M токенов, тогда как Opus 5 — $5 и $25. Это делает модель Anthropic в 2,5 раза дороже по входу и более чем в 4 раза — по выходу, что, очевидно, существенно. Например, месяц с упором на генерацию при 1M входа / 4M выхода — $26 на Grok 4.6 и $105 на Opus 5. Более сбалансированный ассистент при 1M входа / 250K выхода — $3,50 против $11,25.
Это опубликованные стандартные ставки плюс реальные доплаты, которые есть у обеих моделей.
| Ставка | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Вход, за 1M токенов | $2.00 | $5.00 |
| Выход, за 1M токенов | $6.00 | $25.00 |
| Чтение из кэша, за 1M токенов | $0.50 | $0.50 |
| Запись кэша, за 1M токенов | $1.00 (≥200k строка) | $6.25 (5 минут) / $10 (1 час) |
| Вариант Fast | $4 / $12 (2x) | $10 / $50 (2x; ~2,5x скорость) |
| Наценка за длинный контекст | 2x при ≥200k токенов в промпте ($4 / $1 / $12) | Не публикуется |
Премия по выходу — самая болезненная. Режим Fast — это 2x-надбавка у обеих, а не третий тариф. У Opus 5 также есть 50% скидка на батчи ($2,50 / $12,50), которой у Grok 4.6 сейчас нет.
Формула одна: (объём ÷ 1M) × ставка, суммируем вход и выход, по стандартным ставкам, кроме строки сверх порога, где у Grok действует наценка 2x. Числа округлены до цента при сумме ниже $10, иначе — до ближайшего доллара.
| Нагрузка | Grok 4.6 | Claude Opus 5 | Разница |
|---|---|---|---|
| Сбалансированный ассистент: 1M входа / 250K выхода | $3.50 | $11.25 | Opus 5 +$7.75 (221%) |
| Генерация: 1M входа / 4M выхода | $26 | $105 | Opus 5 +$79 (304%) |
| Извлечение, ниже порога: 10M входа / 1M выхода | $26 | $75 | Opus 5 +$49 (188%) |
| Извлечение, сверх порога: 10M входа / 1M выхода | $52 | $75 | Opus 5 +$23 (44%) |
Извлечение ниже 200k — история про ставку входа ($26 против $75). При этом наценка Grok от 200k важна: перейдите порог — и те же 10M / 1M в сумме получаются $52 против $75. Наценка сокращает разрыв, но не делает Opus 5 дешевле.
Графики вендоров не скажут, нарисует ли модель описанную вами сцену. Мы провели один общий таск для кодирующего агента из нашей базы тестов, затем зафиксировали результаты.
Мы проверили обе модели на умении создать полноэкранную графику-шейдер с северным сиянием над горным горизонтом, размещённую в p5.js, с передачей мыши и времени как uniform-параметров. Тест вдохновлён промптами шейдеров Итана Моллика. Мы задали тему, чтобы упростить сравнение. Обе модели запускались по одному разу, без повторов, внутри Cursor с одинаковыми инструментами. Обе использовали вариант с повышенным рассуждением.
Дослованный промпт:
Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.
Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.
Grok 4.6 прислал рабочий index.html за 13 ходов. Эффект — реальный фрагментный шейдер GLSL, p5 только хостит канвас. Занавеси движутся по-«северносветному», с трёхцветным разделением, которое выглядит приятнее, чем у Opus 5 с преимущественно зелёным полотном, плюс мигающие звёзды на фоне.
Промах — пейзаж. Горы читаются как мультяшный силуэт, поэтому совпадение с эстетикой — 4, а не 5. Интерактивность с курсором средняя: как видно на видео ниже, графика сильно реагирует по оси X, но слабо по оси Y.
Opus 5 тоже прошёл тест, тоже с настоящим GLSL. Совпадение с брифом отличное: три горных хребта в разных оттенках серого, занавеси, которые читаются как сияние, мигающие звёзды. Цвет в основном зелёный — самый частый цвет северного сияния. Так что формально корректнее, хотя три цвета Grok выглядят, на мой взгляд, наряднее. Интерактивность с курсором лучше, чем у шейдера Grok: занавеси изгибаются и светлеют по обеим осям.
Opus сделал куда больше ходов — всего 46. Однако 19 из них были попытками запросить разрешение на выполнение верификационных команд (что по правилам теста было нельзя), так что к созданию шейдера относятся лишь 27. Всё равно Grok уложился в половину числа ходов Opus.
| Метрика | Grok 4.6 high | Claude Opus 5 high |
|---|---|---|
| Ходы | 13 | 27 |
| Запускаемость | pass | pass |
| Совпадение с эстетикой | 4 | 5 |
| Компетентность в шейдерах | 5 | 5 |
| Интерактивность курсора | 3 | 5 |
| Следование технике | 5 | 5 |
Opus 5 ближе к брифу: послойные горы и реакция мыши по обеим осям. Занавеси Grok 4.6 выглядят более красочно и тест прошли, но горы упрощены, а курсор в основном управляет осью X.
Это единичный прогон, не про токены или стоимость, и он проверяет только описанные сцены в шейдерах с реакцией на курсор в GLSL, а не работу в репозитории или интеллектуальные задачи.

Если решает табло — Opus 5. Если решает счёт к оплате — Grok 4.6 — тот фронтир, который стоит оставить включённым.
Выбирайте Grok 4.6, если…
Обе модели доступны разными способами. Строки моделей: grok-4.6 и claude-opus-5.
| Поверхность | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Пользовательское приложение | Grok Build; Cursor (desktop, web, iOS, CLI) | Claude Pro; дефолт в Claude Max |
| API первого лица | Да (SpaceXAI API) | Да (Claude API) |
| Облачные платформы | Amazon Bedrock, Google Vertex AI, Azure AI Foundry | Amazon Bedrock, Google Vertex AI, Azure AI Foundry |
| Агенты для кода | Cursor, Grok Build | Claude Code, Cursor |
| Сторонние роутеры | OpenRouter, Vercel, Cloudflare | OpenRouter, Vercel, Cloudflare |
| ID модели в API | grok-4.6 |
claude-opus-5 |
В Cursor обе — в списке выбора. Claude Code — нативный для Anthropic; Grok Build читает дерево .claude/, а Claude Code не распознаёт файлы .grok/. В API это замена одной строки только внутри SDK соответствующего вендора.
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)
Полная настройка для каждого API — в нашем туториале по API Grok 4.6 и туториале по API Claude Opus 5. Если вам нужен агент как продукт, а не ID модели, начните с Claude Code 101.
Если задача — описанная визуальная сцена или агент для интеллектуальной работы, который вы будете оценивать по Elo, используйте Claude Opus 5. Если это фронтирный кодирующий агент, который вы будете также оценивать по счёту к оплате, используйте Grok 4.6.
Бросается в глаза, насколько мало решают бенчмарки. Два пункта в AA Index или сотня Elo в GDPval-AA — зазор уже, чем в прайс-листе: $105 против $26 за тот же месяц с упором на генерацию. Модели близки; счета — нет.
Если хотите разобраться в концепциях за этими агентами, рекомендуем трек навыков AI Fundamentals. Для нативного Claude-воркфлоу практическим стартом будет Claude Code 101.
Используйте Grok 4.6, когда ограничение — стоимость API. Его тариф — $2/$6 за 1M токенов против $5/$25 у Opus 5, так что месяц с упором на генерацию — $26 против $105. Он также завершил наш шейдер «северного сияния» вдвое меньшим числом ходов с хорошим результатом, а Artificial Analysis сообщает меньше ходов и входных токенов, чем у Opus 5 max на AA-Briefcase.
Используйте Claude Opus 5, когда решает качество: он лидирует по Elo для интеллектуальной работы (1 861 против 1 753 на GDPval-AA v2), в AA Index (63 против 61) и в опубликованных метриках кода вроде DeepSWE v1.1 (68,8% против 65,9%).
Grok 4.6 — $2 за вход и $6 за выход на 1M токенов. Claude Opus 5 — $5 и $25, как у Opus 4.8. У Grok 4.6 действует наценка 2x для промптов от 200k токенов и выше; у Opus 5 наценка за длинный контекст не публикуется. Чтение из кэша — $0,50 / 1M у обеих по стандарту.
Grok 4.6 — это grok-4.6 в SpaceXAI API. Claude Opus 5 — claude-opus-5 в Claude API. Это не взаимозаменяемые строки между SDK; у каждого клиента свой ID.
Да, если ваш селектор агентов показывает обе. Cursor предлагает Grok 4.6 и Claude Opus 5 как выбираемые модели, и большинство роутеров и облачных каталогов поддерживают обе, так что селектор редко ограничение. Асимметрия — в нативных агентах: Claude Code — нативен для Anthropic и не запустит Grok, тогда как Grok Build читает дерево .claude/, так что конфигурация под Claude переносится в эту сторону, но не обратно.
Учитесь ИИ с DataCamp!
Track
Course
Course