Track
SpaceXAI выпустила Grok 4.6 12 августа 2026 года, примерно через месяц после того, как OpenAI сделала семейство GPT-5.6 общедоступным 9 июля. Оба релиза предлагают схожую идею: долго работающие агенты, которые держат задачу через множество шагов, и более сильные первые проходы в интерактивной работе. Grok 4.6 вышел с заявлением о паритете с GPT-5.6 Sol в Artificial Analysis Intelligence Index, ставя модель за $6 в сегменте вывода рядом с моделью за $20 и предлагая попытаться найти разницу.
В этой статье мы сравним Grok 4.6 и GPT-5.6 Sol по агентному программированию, длинным циклам знаний, работе с контекстом, настройкам рассуждений и цене, а затем пропустим обе модели через один сложный билд внутри одного и того же код-агента. За более подробным разбором каждой модели по отдельности см. наш гид по Grok 4.6 и наш гид по GPT-5.6 Sol, Terra и Luna.
TL;DR
- Возможности близки: обе модели набирают 61 в Artificial Analysis Intelligence Index и возглавляют примерно половину опубликованных кодинговых бенчмарков каждая.
- Разница — в цене, и не линейная: у Sol вход дороже в 2 раза, а выход — в 3,3 раза.
- Обе модели берут наценку за длинные подсказки, и у Grok порог наступает раньше — 200 000 токенов против 272 000 у Sol.
- В нашем практическом билде обе выдали корректную, стабильную симуляцию. Sol дошёл за 3 шага; Grok потребовалось 14.
- Выбирайте Grok 4.6 для циклов с тяжёлыми рассуждениями и генерацией; выбирайте GPT-5.6 Sol для окна в 1 050 000 токенов, терминал-ориентированной инженерии или наименьшего числа шагов до готового артефакта.
Что такое Grok 4.6?
Grok 4.6 — пограничная модель SpaceXAI для кодинга, агентных задач и работы с знаниями, выпущенная 12 августа 2026 года. Она развивает Grok 4.5 с упором на долго работающих агентов и более амбициозную интерактивную и визуальную работу. По словам SpaceXAI, модель удерживает сложные задачи на множестве шагов: от исследования темы и работы с кодовой базой до превращения идеи в рабочее приложение. В обучающий прогон добавили отобранные модельные данные рассуждений и агентный RL по оптимизации ядра, веб‑разработке и САПР.
Отличительная часть — ценовая позиция. Grok 4.6 сохраняет базовые тарифы Grok 4.5 — $2 и $6 за 1M входных и выходных токенов — при этом прибавляя 5 пунктов в Artificial Analysis Intelligence Index, что, как отмечает Artificial Analysis, необычно на переднем крае, где рост возможностей обычно сопровождается повышением цены.
Чтобы увидеть модель в деле, наш туториал по API Grok 4.6 показывает пошаговую сборку агента с инструментами, а наш туториал Grok Build строит ML‑проект внутри код-агента, где 4.6 теперь модель по умолчанию. Мы также рассмотрели агент‑тиммейт SpaceXAI в материале Grok Bot.
Что такое GPT-5.6 Sol?
GPT-5.6 Sol — флагман семейства GPT-5.6 от OpenAI, общедоступен с 9 июля 2026 года, наряду с Terra для повседневной работы и Luna как эконом-уровнем. OpenAI позиционирует Sol не только по «сырой» мощности, но и по эффективности: передовые результаты в кодинге, работе с знаниями, кибербезопасности и науке при меньшем расходе токенов. Более сильное компьютерное использование позволяет ему инспектировать и улучшать отрендеренный результат, а не только генерировать код за ним.
Две новые ручки возможностей. Настройка max даёт модели больше времени, чем xhigh, на рассуждения и правки, а ultra по умолчанию координирует четыре агента параллельно, обменивая токены на лучший счёт за меньшее стендовое время. На Terminal-Bench 2.1 Sol Ultra достигает 91.9% против 88.8% у обычного Sol.
Для практики с моделью см. наш туториал по Cursor Agent Mode, где с GPT-5.6 Sol строится REST API, и наш гид по ChatGPT Work с end‑to‑end процессом Data Science на GPT-5.6. Если нужен другой дуэт, мы сравнили его с флагманом Anthropic в Claude Opus 5 vs GPT-5.6 Sol.
Grok 4.6 vs GPT-5.6 Sol: сравнение лоб в лоб
Коротко: по возможностям модели сопоставимы, по цене — очень разные.

Обе на уровне 61 в Intelligence Index, делят кодовые бенчмарки, при этом у Sol вывод дороже в 3,3 раза.
| Характеристика | Grok 4.6 | GPT-5.6 Sol |
|---|---|---|
| Релиз | 12 августа 2026 | 9 июля 2026 |
| AA Intelligence Index | 61 | 61 |
| Вход / выход за 1M токенов | $2 / $6 | $4 / $20 |
| Контекстное окно | 500 000 токенов | 1 050 000 токенов |
| Порог длинного контекста | 200 000 токенов | 272 000 токенов |
| Тарифы выше порога | $4 / $12 | 2x вход, 1.5x выход |
| Настройки рассуждений | Low, medium, high, xhigh | None до max, плюс ultra |
| ID модели в API | grok-4.6 |
gpt-5.6-sol |
| Срез знаний | 1 февраля 2026 | 16 февраля 2026 |
Кодинг и агентные рабочие процессы
Таблица Cursor, Grok 4.6 на high против GPT-5.6 Sol на max, не выявляет явного лидера. Grok ведёт на CursorBench v3.2 с 69.9% против 67.2% и на GDPval-AA v2 с 1753 Elo против 1728. Sol берёт DeepSWE v1.1 — 73% против 65.9%, и Terminal-Bench v3.0 — 34.6% против 26%.
| Бенчмарк | Grok 4.6 (high) | GPT-5.6 Sol (max) | Примечания |
|---|---|---|---|
| AA Intelligence Index | 61 | 61 | Композиция из девяти бенчмарков; ничья |
| CursorBench v3.2 | 69.9% | 67.2% | Собственная агент‑рамка Cursor |
| DeepSWE v1.1 | 65.9% | 73% | Длинный горизонт в реальных кодовых базах |
| Terminal-Bench v3.0 | 26% | 34.6% | Обе низко; другая версия, чем 2.1 у OpenAI |
| FrontierCode v1.1 Extended | 61.3% | 60.6% | В пределах шума |
| APEX-Agents | 57.5% | 56.7% | В пределах шума |
Читать эти разрывы стоит с осторожностью:
- Настройки усилия не сопоставлены: у Grok high, у Sol max.
- Сторонние строки — лучшие из самоотчётов или публичных цифр, а не единая рамка.
- Terminal-Bench v3.0 в таблице Cursor — это не Terminal-Bench 2.1 в посте OpenAI (88.8% для Sol). Разные версии.
Grok сильнее в IDE‑агентном цикле. Sol сильнее на длинном горизонте по репозиториям и в командной строке.
Длинные агентные циклы в знаниевой работе
Grok 4.6 лидирует на AA-Briefcase, приватном наборе Artificial Analysis для длинных знаниевых задач, с 1577 Elo против 1502 у Sol. На Harvey LAB, оценке юридических задач, опубликованные цифры — 15.8% против 2.5%, разрыв в 6 раз при низких абсолютных значениях у обеих, так что воспринимайте это как сигнал, а не установленную разницу.
Grok также показывает 50.7% на банковской части набора инструментального использования Artificial Analysis. Его 88.4% на Terminal-Bench v2.1 сопоставимы с лидирующими моделями, но это v2.1, а не v3.0 выше.
Контекстное окно и работа с длинным контекстом
У Sol примерно вдвое больше окно: 1 050 000 токенов против 500 000 у Grok 4.6, плюс потолок вывода в 128 000 токенов, которому SpaceXAI не противопоставляет текстовый лимит. Выше 500K эквивалента Grok нет.
Обе модели меняют цену за длинные подсказки до этих потолков, и у Grok порог наступает раньше:
- Grok 4.6: после 200 000 токенов — 2x на вход и 2x на выход на весь запрос.
- GPT-5.6 Sol: после 272 000 токенов — 2x на вход и 1.5x на выход на весь запрос.
Между 200 000 и 272 000 входные тарифы сходятся на $4. Grok остаётся дешевле по выходу, но разрыв меньше, чем подразумевает базовая пара.
Контроль усилия рассуждений
У Sol больше «ручек»: от none до max, плюс ultra, который запускает четыре агента параллельно. Grok 4.6 предлагает low, medium, high по умолчанию и xhigh. Сбрасывать Sol на none для дешёвой классификации — полезно. Прыжок Ultra на Terminal-Bench 2.1 с 88.8% до 91.9% реален, но оба экстрема тарифицируются по ставке вывода, которая в 3,3 раза выше, чем у Grok.
Встроенные поверхности инструментов
Grok 4.6 поддерживает function calling, веб‑поиск, X‑поиск и выполнение кода. GPT-5.6 Sol добавляет поиск по файлам, генерацию изображений, интерпретатор кода, хостинг‑шелл, apply patch, computer use и поиск инструментов в Responses API.
У Sol также есть Programmatic Tool Calling: модель пишет и запускает небольшую программу, которая координирует инструменты и фильтрует промежуточные результаты вместо того, чтобы прогонять каждый ответ инструмента обратно через модель.
Цены: что вы реально платите
Цена — самое явное отличие, и она не масштабируется ровно.
Тарифы на токены рядом
| Ставка | Grok 4.6 | GPT-5.6 Sol |
|---|---|---|
| Вход, за 1M токенов | $2.00 | $4.00 |
| Выход, за 1M токенов | $6.00 | $20.00 |
| Чтение из кэша (вход), за 1M токенов | $0.50 | $0.40 |
| Порог длинного контекста | 200 000 токенов запроса | 272 000 входных токенов |
| Выше порога | 2x на вход и выход | 2x на вход, 1.5x на выход |
| Быстрый вариант, вход / выход | $4.00 / $12.00 | Не применяется |
У Sol вход дороже в 2 раза, выход — в 3,3 раза, так что разрыв растёт с каждым написанным моделью токеном. Токены рассуждений тарифицируются по ставке вывода у обеих. Чтение из кэша близко ($0.50 против $0.40), но SpaceXAI предупреждает, что без prompt_cache_key в Responses API часто платите полную входную ставку на холодном кэше сервера. Подробнее об этом в нашем туториале по API Grok 4.6.
Сколько стоит реальная нагрузка
Формула: (объём ÷ 1M) × ставка, суммируя вход и выход по стандартным тарифам.
| Нагрузка | Grok 4.6 | GPT-5.6 Sol | Разница |
|---|---|---|---|
| Генерация‑тяжёлая: 1M вход / 4M выход | $26 | $84 | +$58 (223%) |
| Ретрив, ниже порога: 10M вход / 1M выход | $26 | $60 | +$34 (131%) |
| Ретрив, выше порога: 10M вход / 1M выход | $52 | $110 | +$58 (112%) |
Генерация‑тяжёлая строка показывает, где сказывается разрыв по ставке вывода. Две строки ретрива одинаковы по 10M вход / 1M выход и различаются лишь тем, находится ли каждый запрос выше обоих порогов — разница между ними и есть наценка. У Grok счёт удваивается с $26 до $52. У Sol — с $60 до $110. Относительная премия сужается со 131% до 112%, хотя долларовый разрыв растёт. Ни один вендор не публиковал токен‑счёты по общей нагрузке, так что воспринимайте эти итоги как сравнение ставок, а не реальный счёт.
Как показали себя Grok 4.6 и GPT-5.6 Sol
Мы запустили одну сложную задачу билда против обеих моделей в одном и том же код‑агенте.
Тест
Мы проверили обе модели на создании одностраничной физической симуляции, потому что оба вендора заявляют сильную работу в интерактиве и визуале. Одинаковый промпт, побайтно идентичный, вставлен в свежий чат в пустом рабочем пространстве. По одной попытке, без ретраев и без подруливания по ходу.
Build a single-file HTML page (inline CSS and JS, canvas, no build step, no external libraries, no network) that simulates a few dozen balls of varying sizes bouncing inside a slowly rotating square container, under gravity. The balls should collide with each other and with the container walls, and lose a little energy on each collision so the system settles rather than gaining energy over time. The container keeps rotating throughout, so the balls should slosh and re-pile as it turns.
Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions, make reasonable assumptions and note them briefly in a comment at the top of the file.
Обе модели запускались в Cursor 25 августа 2026 года: Grok 4.6 на high reasoning, GPT-5.6 Sol на high reasoning. Результат описывает их как агентов, а не «голые» модели. Сеть была отклонена для обеих.
Что выдал Grok 4.6
Grok предоставил рабочий index.html, прошедший проверку на запуск: один файл, анимация при загрузке, без неотловленных ошибок в консоли, продолжает работать спустя 30 секунд. Удержание в контейнере сохранялось при вращении коробки, столкновения шаров между собой выглядели правдоподобно, а система теряла энергию и успокаивалась, а не разгонялась.
На это ушло 14 ходов ассистента, с несколькими раундами самокоррекции. Он также запросил доступ к браузеру, чтобы проверить свою работу, что мы отклонили по правилу теста о разрешениях.
Что выдал GPT-5.6 Sol
Sol также прошёл проверку запуска и получил те же 5 за корректность физики и 5 за стабильность. Его контейнер вращается медленнее, чем у Grok, из‑за чего «плеск» и перераскладка видны лучше — и это единственная ось, где он обошёл Grok по визуальному качеству.
Он дошёл до результата за 3 хода и в целом был заметно быстрее Grok.
Результаты
Оценки по осям — от 1 до 5, выставлялись по 30‑секундному просмотру каждой симуляции по рубрике, составленной до запуска.
| Метрика | Grok 4.6 (high) | GPT-5.6 Sol (high) |
|---|---|---|
| Ходы | 14 | 3 |
| Запускаемость | Pass | Pass |
| Корректность физики | 5 | 5 |
| Стабильность во времени | 5 | 5 |
| Визуальное качество | 4 | 5 |
| Итог | 3.5 | 5 |
По артефакту это почти ничья: обе корректно реализовали физику и оставались стабильными. Разница — в усилии. Sol дошёл до того же результата за 3 хода против 14 у Grok, из‑за чего общий балл Grok падает до 3.5.
Но помните: это n=1 на визуальном билде, воспринимайте как одну точку данных, а не бенчмарк, и это ничего не говорит о больших кодовых базах или длинных цепочках ретрива.
Когда выбирать Grok 4.6, а когда GPT-5.6 Sol
Так как возможности близки, выбор сводится к форме нагрузки, размеру контекста и тому, насколько важны число ходов по сравнению со стоимостью за токен. Выбирайте Grok, когда дешёвый вывод доминирует в счёте. Выбирайте Sol, когда нужно большее окно или меньше ходов.

Выберите Grok 4.6, если…
- Ваша нагрузка много пишет. При $6 за 1M выходных токенов против $20 у Sol, месяц с тяжёлой генерацией обойдётся в $26 вместо $84, и токены рассуждений тарифицируются по той же ставке вывода.
- Ваши подсказки остаются ниже 200 000 токенов. Именно там действуют полные ставки $2 и $6 у Grok.
- Ваш агент работает внутри IDE. Grok лидирует на CursorBench v3.2 с 69.9%, и это модель по умолчанию в Grok Build.
- Вы следите за стоимостью за токен больше, чем за числом ходов.
Выберите GPT-5.6 Sol, если…
- Нужно больше 500K токенов контекста. Окно в 1 050 000 токенов у Sol не имеет аналога у Grok 4.6.
- Ваши агенты работают на длинном горизонте в реальных репозиториях. 73% у Sol на DeepSWE v1.1 против 65.9% у Grok — самый широкий кодовый разрыв в любую сторону.
- Число ходов важнее цены за токен. Sol завершил наш физический билд за 3 хода против 14 у Grok.
- Нужен более тонкий контроль усилия. Sol работает от none до max и добавляет
ultra.
С чего начать с Grok 4.6 и GPT-5.6 Sol
Обе модели — это замена одной строки, если вы уже используете совместимую с OpenAI конечную точку. Строки — grok-4.6 и gpt-5.6-sol. OpenAI также маршрутизирует алиас gpt-5.6 на Sol.
| Поверхность | Grok 4.6 | GPT-5.6 Sol |
|---|---|---|
| Нативный API | xAI API | OpenAI API |
| Пользовательское приложение | Приложение Grok и Grok.com | ChatGPT |
| Кодовые агенты | Grok Build (модель по умолчанию), Cursor (все тарифы) | Codex, Cursor |
| Шлюзы моделей | OpenRouter, Vercel, Cloudflare | OpenRouter, Vercel, Cloudflare |
| ID модели в API | grok-4.6 |
gpt-5.6-sol |
Использование Grok 4.6 и GPT-5.6 Sol в код‑агенте
В Cursor обе модели доступны в списке выбора — так мы и запускали билд‑тест. Переключение — это смена модели в пикере, а не переписывание конфигурации.
Через API замена — одна строка. xAI обслуживает конечную точку, совместимую с OpenAI:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["XAI_API_KEY"],
base_url="https://api.x.ai/v1", # drop this line for gpt-5.6-sol
)
response = client.responses.create(
model="grok-4.6", # swap for "gpt-5.6-sol"
input="Find and fix the bug: function median(a){a.sort();return a[a.length/2]}",
)
print(response.output_text)
Для полного набора настроек см. наш туториал по API Grok 4.6, наш туториал по Cursor Agent Mode и наш туториал по Grok Build.
Итоговые мысли
Если ваш счёт доминируют выход и токены рассуждений, используйте Grok 4.6. Ничьё по Intelligence Index при менее чем трети цены за вывод — самый простой выбор здесь. Если нужно окно в миллион токенов или длинная работа по репозиториям, используйте GPT-5.6 Sol и примите наценку. Перед переключением проверьте, по какую сторону порога в 200 000 токенов у Grok лежат ваши подсказки.
В нашем тесте заявленные свойства подтвердились: обе модели показали хорошие результаты. При этом Sol был намного быстрее Grok и потребовал лишь около 20% его ходов — это заметный разрыв. Если вы хотите не читать о моделях в агенте, а научиться эффективно их запускать, рекомендуем наш курс Software Development with Cursor.
Grok 4.6 vs GPT-5.6 Sol — часто задаваемые вопросы
Grok 4.6 лучше, чем GPT-5.6 Sol?
Однозначного победителя нет. Обе набирают 61 в Artificial Analysis Intelligence Index и по очереди лидируют примерно в половине опубликованных кодинговых бенчмарков: Grok 4.6 берёт CursorBench v3.2 (69.9% против 67.2%), а GPT-5.6 Sol — DeepSWE v1.1 (73% против 65.9%) и Terminal-Bench v3.0 (34.6% против 26%). В нашем собственном тесте одностраничной физической сборки обе выдали корректную, стабильную симуляцию. Разница — в усилии: Sol завершил за 3 хода, Grok занял 14.
Сколько стоят Grok 4.6 и GPT-5.6 Sol?
У Grok 4.6 — $2 за 1M входных токенов и $6 за 1M выходных. У GPT-5.6 Sol — $4 за вход и $20 за выход. Чтение кэшированного входа — $0.50 у Grok и $0.40 у Sol. Множитель неравномерен: у Sol вход дороже в 2 раза, а выход — в 3,3 раза, так что разрыв растёт с каждым написанным моделью токеном. Обе также меняют цену за длинные подсказки: у Grok с 200 000 токенов (до $4 за вход и $12 за выход), у Sol — выше 272 000 входных токенов (2x вход, 1.5x выход), в обоих случаях по всему запросу.
Каковы ID моделей в API для Grok 4.6 и GPT-5.6 Sol?
Строки: grok-4.6 для SpaceXAI и gpt-5.6-sol для OpenAI. OpenAI также направляет алиас gpt-5.6 на Sol. Так как xAI API совместим с OpenAI, переключение между ними — это замена одной строки плюс смена базового URL на https://api.x.ai/v1.
У какой модели больше контекстное окно — у Grok 4.6 или GPT-5.6 Sol?
У GPT-5.6 Sol — 1 050 000 токенов против 500 000 у Grok 4.6, с потолком вывода в 128 000 токенов, тогда как SpaceXAI не публикует текстовый лимит вывода. Обе модели берут наценку за длинные подсказки, и порог у Grok наступает раньше — при 200 000 токенов против 272 000 у Sol. Между этими двумя числами у Grok действует наценка, а у Sol — нет, из‑за чего их входные ставки выравниваются на уровне $4 за 1M.
Как получить доступ к Grok 4.6 и GPT-5.6 Sol?
Получите доступ к Grok 4.6 через xAI API или Grok Build, а к GPT‑5.6 Sol — через OpenAI API или Codex. Обе модели также доступны через Cursor и OpenRouter, а также через AI‑шлюзы вроде Vercel или Cloudflare.