Перейти к основному контенту

Claude Sonnet 5.5: возможности, бенчмарки, цены и другое

Новая модель среднего уровня от Anthropic чуть обходит Opus 5.5 в терминальном кодировании, отстаёт всего на несколько пунктов в остальных тестах и сохраняет цены Sonnet 5 — $2/$10.
Обновлено 28 сент. 2026 г.  · 12 мин читать

Изучить с помощью AI

ChatGPTClaudePerplexity

Через шесть дней после того, как Anthropic поставила Claude Opus 5.5 во главе линейки, модель среднего уровня почти ликвидировала разрыв за половину цены. Claude Sonnet 5.5 обходит Opus 5.5 в одном бенчмарке и отстаёт всего на пару пунктов в остальных, при этом сохраняя цены Sonnet 5.

Мы уже видели такой сценарий. Claude Sonnet 5 вышел и приблизился к агентным бенчмаркам Opus 4.8 за долю стоимости. До этого Sonnet 4.6 подошёл вплотную к Opus 4.6 на тех же условиях. Каждый раз модель среднего уровня появляется через дни или недели после флагмана и закрывает большую часть разрыва за половину цены.

Так выглядит логарифмическая кривая масштабирования снаружи. Производительность растёт примерно как логарифм от вычислительных ресурсов, поэтому стоимость растёт примерно экспоненциально от производительности. Флагманская модель находится наверху этой кривой, где приходятся большие затраты на последние несколько пунктов. Более доступная модель, построенная несколькими неделями позже и использующая те же фундаментальные наработки, должна достичь более низкой точки на кривой, чтобы выглядеть почти так же хорошо. Иными словами, большая часть ценности на кривой всё ещё дёшево достижима, и только финальный отрезок дорог.

Стоит это проговорить, потому что лидирующие компании слегка «колдуют» с PR и брендингом.

Итоги вкратце

  • Sonnet 5.5 — новая модель среднего уровня от Anthropic, заменяет Sonnet 5 по той же цене.
  • Главный прирост — агентное кодирование в терминале: здесь она даже чуть обгоняет Opus 5.5.
  • В задачах по работе с информацией и использованием компьютера она лишь немного уступает Opus 5.5 — при цене за токен вдвое ниже.
  • Сделайте её моделью Claude по умолчанию и оставьте Opus 5.5 для открытых задач, где важны суждения.

Что такое Claude Sonnet 5.5?

Документация модели Anthropic описывает Claude Sonnet 5.5 как «лучшее сочетание скорости и интеллекта» в текущей линейке. Это модель среднего уровня в семействе Claude 5.5 от Anthropic, между флагманом Claude Opus 5.5 и грядущей Claude Haiku 5.5. (Мы будем держать вас в курсе по Haiku 5.5, хотя Haiku 5 так и не вышла.)

По сравнению с Sonnet 5 скачок больше, чем намекает «половинный» номер версии. Это не удивляет после того, как мы увидели, что разница между Opus 5.5 и Opus 5 оказалась больше ожидаемой.

Что касается анонса, Anthropic сообщает приросты по всем опубликованным бенчмаркам, с наибольшими скачками в терминальном кодировании, чтении графиков и оценках работы с информацией.

Интересно, что Anthropic заявляет: эта модель Sonnet — первая, которая прошла Pokémon Red, работая только со скриншотами. Звучит необычно, но это тест, который Anthropic использует как прокси для задач с длинным горизонтом и понимания изображений.

Итак, Opus 5.5, по словам компании, остаётся явно сильнее в сложной, открытой работе, требующей устойчивых суждений. Но Sonnet 5.5 — это модель для задач, где вы точно знаете, как выглядит «готово», что полезно как эвристика.

Ключевые возможности Claude Sonnet 5.5

Большинство нововведений в Sonnet 5.5 — про то, чтобы делать ту же работу быстрее и с меньшим числом токенов, плюс несколько изменений, к которым пользователям API стоит подготовиться. 

Результаты, близкие к Opus, в повседневных задачах на скорости Sonnet

Можно передавать Sonnet 5.5 работу, которая раньше просила Opus, и получать результат быстрее. Anthropic говорит, что генерация вывода более чем на 30% быстрее, чем у Sonnet 5, и что модель использует меньше токенов на задачу — «до 30% меньше на задачу» — такова их формулировка. 

Ранние тестировщики, процитированные в анонсе, подтверждают это своими цифрами:

  • Base44 сообщает о 3,6 итерации на сборку приложения с Sonnet 5.5 против 7,7 с Opus 5.
  • Box увидела, что её нагрузки выполняются в 2,4 раза быстрее при общем числе токенов на 12% меньше.
  • Zendesk измерила обработку тикетов на 20% быстрее.
  • Slack отмечает примерно на 14% меньше выходных токенов.

Это отобранные вендором отзывы клиентов. Тем не менее есть закономерность: меньше итераций и меньше токенов, что влияет на счёт, помимо тарифа за токен.

Запускайте кодирующих агентов в терминале и на рабочем столе

Sonnet 5.5 создавался как агент: выполняет команды в шелле, чинит баги по репозиторию и управляет рабочим столом по скриншотам. Он доступен в Claude Code с запуска, и Anthropic описывает его компьютерное использование как близкое к Opus 5.5.

Практический вывод для многих: Sonnet 5.5 теперь — вполне надёжный вариант по умолчанию для сессий Claude Code и для агентных циклов, которые вы строите сами по нашему руководству по Claude API. 

Готовые документы, слайды и интерфейсы

Anthropic выделяет «острый глаз на дизайн» как сильную сторону Sonnet 5.5. На практике это должно означать более аккуратные интерфейсы, когда вы просите улучшить фронтенд-код, и более «доведённый до ума» результат, когда нужны слайды, таблицы или длинные документы. 

Именно это утверждение о дизайне больше всего нуждается в независимой проверке. Его труднее всего бенчмаркать, а в анонсе оно подкреплено лишь отзывами клиентов.

Ожидайте защитные меры для безопасности и биологии

Sonnet 5.5 — первая модель Sonnet, вышедшая с кибербезопасными ограничителями, аналогичными Opus 5.5. Когда запрос классифицируется как работа с повышенным риском в области безопасности, он откатывается на Sonnet 5. Ограничители по биологии такие же, как в Sonnet 5; Anthropic говорит, что на большинство задач в разработке ПО и в бионауках это не повлияет.

Это также первый Sonnet с классификаторами, блокирующими извлечение рассуждений, а блоки «thinking» теперь привязаны к аккаунту и разговору, в которых они были созданы. Если вы запускаете инструменты безопасности, протестируйте подсказки перед переключением конвейера.

Миграция с Sonnet 5 с минимальными правками кода

Просто поменять ID модели недостаточно. В документации Anthropic перечислены пять критичных изменений для кода, уже работающего на Sonnet 5:

  • Адаптивное мышление включено по умолчанию, и самый низкий уровень — between_tools, который отключает предварительное рассуждение.

  • Принудительное использование инструмента возвращает ошибку.

  • Блоки «thinking» привязаны к модели и разговору, где они были созданы.

  • Старый инструмент для компьютерного использования computer_20251124 отклоняется в Claude API и на Google Cloud.

  • Инструмент advisor больше не принимает Opus 4.8, Opus 4.7 или Sonnet 5 в роли советников.

Есть и более тихое изменение: текст между вызовами инструментов теперь возвращается в блоках thinking. Приложение, которое стримит текст пользователям, замолкнет между вызовами инструментов, пока вы не обновите настройку display. Установка для temperature, top_p или top_k незначений по умолчанию также приводит к ошибке 400. Эти моменты легко обнаружить на практике.

Как Claude Sonnet 5.5 показывает себя в бенчмарках?

Claude Sonnet 5.5 обходит Sonnet 5 во всех бенчмарках Anthropic, опережает Opus 5.5 в терминальном кодировании и отстаёт от него лишь на несколько пунктов в остальных тестах. В сравнении с GPT-6 Sol от OpenAI он лидирует в оценках по работе с информацией и чтению графиков, но уступает на FrontierCode. Все цифры ниже — из анонса Anthropic.

Бенчмарк Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0 70.6% 10.3% 66.4% Не сообщалось
CursorBench 4.0 55.5% 34.1% 57.8% Не сообщалось
FrontierCode 1.1 (Main) 46.2% (max effort) 42.4% 54.4% 49.3% (52.1% на xhigh)
GDPval-AA v2.1 (Elo) 1844 1449 1846 1487
AA-Briefcase v1.1 (Elo) 1811 1359 1822 1483
Humanity's Last Exam (with tools) 64.5% 54.9% 67.7% Не сообщалось
OSWorld 2.1 80.1% 57.0% 81.8% Не сообщалось
Chartography (no tools) 61.6% 15.6% 64.4% 53.6%

Таблица рассказывает простую историю: крупный шаг вперёд относительно Sonnet 5 и почти паритет с Opus 5.5. Посмотрим, что это значит для вашей работы по направлениям.

Агентное кодирование

Terminal-Bench 4.0 — место, где Sonnet 5.5 выделяется. 70.6% против 10.3% у Sonnet 5 и 66.4% у Opus 5.5. Этот тест измеряет, может ли модель выполнять реальные задачи в командной строке, например многошаговые shell-пайплайны, поэтому он близко отражает использование Claude Code.

Скачок на 60 пунктов за один релиз — редкость. Остальная картина по коду менее драматична.

Работа с информацией

В GDPval-AA v2.1, который оценивает результаты модели на экономически ценных задачах из реальных профессий по шкале Elo, Sonnet 5.5 набирает 1844. Это на 2 пункта меньше Opus 5.5 и почти на 400 больше Sonnet 5. 

Для команд, использующих Claude для отчётов, анализа и деловых документов, это самый полезный результат в таблице. В таких задачах доплата за Opus 5.5 даёт лишь небольшой выигрыш.

Рассуждение и понимание визуализаций

Chartography — тест чтения и рассуждения по графикам без инструментов — показывает наибольший относительный прирост: Sonnet 5.5 набирает 61.6% против 15.6% у Sonnet 5. Это согласуется с заявлениями Anthropic о лучшем понимании изображений. 

Использование компьютера

В OSWorld 2.1, измеряющем способность модели выполнять задачи, управляя реальной настольной ОС, Sonnet 5.5 достигает 80.1% против 57.0% у Sonnet 5 и в пределах 2 пунктов от Opus 5.5. 

Какой уровень модели выбрать?

Для большинства разработчиков Sonnet 5.5 теперь должна быть моделью Claude по умолчанию. Opus 5.5 оправдывает более высокую цену лишь тогда, когда задача настолько открытая, что узким местом становятся суждения, а не скорость.

Текущая линейка, по сравнительной таблице моделей Anthropic, выглядит так. У всех четырёх моделей, кроме Haiku 4.5, общее контекстное окно на 1 млн токенов и максимум вывода 128K.

Модель Цена (ввод / вывод за 1 млн токенов) Задержка Лучше всего подходит для
Claude Fable 5.1 $10 / $50 Медленнее Задачи верхнего уровня, где важнее возможности, чем стоимость
Claude Opus 5.5 $4 / $20 Умеренная Сложная, открытая работа, требующая устойчивых суждений
Claude Sonnet 5.5 $2 / $10 Быстрая Чётко очерченные задачи по коду, агенты и документы
Claude Haiku 4.5 $1 / $5 Самая быстрая Большие объёмы при чувствительности к стоимости

Внутри Sonnet 5.5 второй рычаг — установка усилия. Anthropic перекалибровала пять уровней: low, medium, high, xhigh и max. Низкие уровни отдают приоритет скорости и цене, высокие позволяют модели дольше рассуждать и проверять свою работу. По умолчанию — medium в приложениях Claude и Claude Code и high в API.

Одна деталь из анонса меняет подход к использованию: на низком или среднем усилии Sonnet 5.5 обходит лучшие результаты Sonnet 5 в нескольких бенчмарках примерно за десятую часть стоимости на задачу. В итоге:

  • Исправления багов, рефакторинг и сессии Claude Code: Sonnet 5.5 с усилием по умолчанию.

  • Высокопоточные агентные циклы и конвейеры: Sonnet 5.5 на low или medium, повышайте усилие только при сбоях.

  • Сложные задачи по коду с чётким ТЗ: Sonnet 5.5 на xhigh или max перед тем, как платить за Opus.

  • Неопределённые, многодневные проекты: Opus 5.5.

Тестируем Claude Sonnet 5.5: примеры на практике

Приведённые выше бенчмарки — от самой Anthropic, поэтому мы прогнали одну сборочную задачу через Claude Sonnet 5.5 и Claude Sonnet 5 с одинаковым промптом и одинаковыми инструментами.

Задача: превратить датасет FiveThirtyEight для недавних выпускников колледжей (173 специальности в США, CC BY 4.0) в одностраничную HTML-панель, которая помогает будущему студенту сравнивать категории по доходам и занятости и находить самые высоко- и низкооплачиваемые специальности. 

Главная проверка — в данных, у которых есть несколько особенностей, о которых промпт не упоминает:

  • Лидер по доходу, Petroleum Engineering, имеет всего 36 респондентов, и у 76 из 173 специальностей менее 100
  • Доходы асимметричны, поэтому один столбец с медианой скрывает сильный разброс
  • В одной специальности, Food Science, пустые поля по численности
  • Столбцы по типам работы не суммируются до общего числа занятых

Замечать эти моменты — цель теста. Он проверяет заявления Anthropic о «остром глазе на дизайн».

Основные выводы:

  • Только Sonnet 5.5 выдала рабочую панель. Sonnet 5 сослалась на файл Chart.js, которого нет на cdnjs (URL возвращает 404), поэтому библиотека не загрузилась, и все панели, включая простые таблицы, остались пустыми. Sonnet 5.5 также проверяет, загрузилась ли библиотека графиков, и сохраняет работоспособность таблиц, если нет.
  • Sonnet 5.5 заметила ловушку с маленькой выборкой, но не везде. Она помечает специальности с менее чем 30 респондентами как «с осторожностью» и добавляет фильтр по минимуму респондентов. В представлении по умолчанию Petroleum Engineering остаётся №1 без предупреждения.
  • Sonnet 5 всё равно бы это пропустила. Её код читает столбцы с размером выборки и диапазоном зарплат, но затем их не использует, ранжируя специальности только по медиане.
  • Мелкие ловушки никого не сбили. Обе модели явно обработали пустую строку Food Science, а Sonnet 5.5 посчитала долю «колледжских» работ без намёка, что столбцы по типам работ суммируются до занятости в целом.

Вот панель Sonnet 5.5 с фильтром по специальностям с как минимум 100 респондентами.

Мы оценили панель Sonnet 5.5 на 4 из 5 за честную работу с данными, 5 за аналитическую полезность и 4 за качество графиков и вёрстки. Пустую страницу Sonnet 5 приводим ниже. 

Почему же Sonnet 5 провалилась? Проблема в том, что панели требовалась библиотека графиков. Sonnet 5 запросила у cdnjs версию, которой там нет. В ответ пришла «404». Без библиотеки код Sonnet 5 рухнул: «Chart is not defined». Похоже, страница была устроена так, что всё, даже простые текстовые таблицы, выполнялось после этого шага, и ошибка не была перехвачена.

Стоимость на запуск оказалась практически одинаковой: $0.56 для Sonnet 5.5 и $0.57 для Sonnet 5. Кроме того, Sonnet 5.5 справилась быстрее.

Итак, это реальный шаг вперёд? На этой задаче — да. Sonnet 5.5 выдала рабочую панель и предупредила о «тонких» данных, а Sonnet 5 — пустую страницу.

Цены и доступность Claude Sonnet 5.5

Claude Sonnet 5.5 стоит $2 за миллион входных токенов и $10 за миллион выходных токенов в API, без изменений относительно Sonnet 5 и вдвое дешевле Opus 5.5. Anthropic сообщает о меньшем числе токенов на задачу, что снижает эффективную стоимость задания, хотя тариф фиксирован. В нашем практическом тесте обе модели стоили примерно одинаково для завершения задачи.

Тип токенов Цена за 1 млн токенов
Ввод $2
Вывод $10
Запись кэша (5 минут) $2.50
Запись кэша (1 час) $4
Чтение кэша $0.20

Batch API снижает цену на 50% и для ввода, и для вывода. Минимальный объём запроса для кэширования — 512 токенов, а в Batch API модель может вернуть до 300K выходных токенов с бета-заголовком output-300k-2026-03-24.

Sonnet 5.5 доступна в общем доступе, не превью, с опцией нулевого хранения данных. Anthropic обязуется не выводить её из эксплуатации до 28 сентября 2027 года. 

Как получить доступ к Claude Sonnet 5.5?

Вы можете использовать Claude Sonnet 5.5 уже сегодня в приложениях Claude, в Claude Code и через API с ID модели claude-sonnet-5-5. Она также доступна в Amazon Bedrock как anthropic.claude-sonnet-5-5, а также в Google Cloud, Microsoft Foundry и Claude Platform на AWS под claude-sonnet-5-5.

Вот минимальный вызов на Python. Адаптивное мышление включено по умолчанию, поэтому ответ может содержать блоки «thinking» перед текстом:

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=2048,
    messages=[{"role": "user", "content": "Find the off-by-one bug in this loop: ..."}],
)
for block in response.content:
    if block.type == "text":
        print(block.text)

Для подробного разбора ключей, стоимости и первого проекта см. наше полное руководство по Claude API. Если вы создаёте агентов, следующий шаг — наш туториал по созданию Claude Managed Agents. В ближайшее время мы опубликуем туториал по API Claude Sonnet 5.5.

Заключение

Anthropic делает ставку на то, что большая часть оплачиваемой работы, включая работу кодирующих агентов, пойдёт на этой новой модели среднего уровня. Это также создаёт прямое давление на GPT-6 Sol от OpenAI, который уступает ей по показателям Anthropic в задачах по работе с информацией.

Если вы на Sonnet 5, стоит переключиться уже сейчас, но заранее изучите изменения в API. Оставьте Opus 5.5 для проектов, где модели нужно решать, что именно строить.

Если хотите глубже разобраться в работе с моделями Anthropic, рекомендуем наш курс Introduction to Claude Models.

Частые вопросы

Как Claude Sonnet 5.5 сравнивается с Claude Opus 5.5?

Claude Sonnet 5.5 набирает больше баллов, чем Opus 5.5, в Terminal-Bench 4.0 (70.6% против 66.4%) и отстаёт от него всего на несколько пунктов в GDPval-AA, OSWorld 2.1 и Humanity's Last Exam. Opus 5.5 стоит вдвое дороже за токен и остаётся сильнее в сложной, открытой работе, требующей устойчивых суждений.

Сколько стоит Claude Sonnet 5.5?

Claude Sonnet 5.5 стоит $2 за миллион входных токенов и $10 за миллион выходных токенов — столько же, сколько Sonnet 5. Чтение кэша стоит $0.20 за миллион токенов, а Batch API даёт скидку 50%. По словам Anthropic, он обходится до 30% дешевле за задачу, чем Sonnet 5, поскольку использует меньше токенов.

Где получить доступ к Claude Sonnet 5.5?

Claude Sonnet 5.5 доступна в приложениях Claude, в Claude Code и в Claude API под ID модели claude-sonnet-5-5. Также доступна в Amazon Bedrock (anthropic.claude-sonnet-5-5), Google Cloud, Microsoft Foundry и Claude Platform на AWS.

Какое контекстное окно у Claude Sonnet 5.5?

У Claude Sonnet 5.5 контекстное окно на 1 млн токенов и максимум вывода 128K токенов в Messages API. В Message Batches API модель может вернуть до 300K выходных токенов с бета-заголовком output-300k-2026-03-24.

Что изменилось в API Claude Sonnet 5.5 по сравнению с Sonnet 5?

Anthropic перечисляет пять критичных изменений: адаптивное мышление включено по умолчанию (используйте between_tools, чтобы отключить предварительное рассуждение), принудительное использование инструмента возвращает ошибку, блоки «thinking» привязаны к модели и разговору, инструмент computer_20251124 отклоняется в Claude API и на Google Cloud, а инструмент advisor отклоняет старые модели в роли советников. Значения temperature, top_p или top_k не по умолчанию также приводят к ошибке 400.

Темы
Искусственный интеллект