Anthropic не публиковала прямого сравнения Opus 5 и Sonnet 5. В каждом релизе модель сопоставляют с её предшественником и с Opus 4.8. Поэтому цифры ниже рассказывают лишь часть истории. Остальное — тот же взвешенный выбор, который вы делаете в любой паре Opus vs Sonnet: какой потолок вам действительно нужен и сколько вы готовы за него платить.
Что такое Claude Opus 5?
Opus 5 — флагманская модель Anthropic, выпущенная 24 июля 2026 года, по цене $5 за миллион входных токенов и $25 за миллион выходных токенов. Anthropic называет её передовой на Frontier-Bench и GDPval-AA и близкой к более крупной Fable 5 при вдвое меньшей цене. Это модель по умолчанию в Claude Max и самая сильная модель в Claude Pro.
Её ключевая особенность — самопроверка: проверяет собственную работу, строит тестовые стенды при отсутствии потока данных, возражает на некорректные инструкции вместо безусловного выполнения.
Что такое Claude Sonnet 5?
Sonnet 5 — модель среднего уровня Anthropic, выпущенная 30 июня 2026 года. Anthropic описывает её как самый «агентный» Sonnet, с производительностью, близкой к Opus 4.8, но по более низкой цене. Это модель по умолчанию в тарифах Free и Pro; также доступна в Max, Team, Enterprise и через API.
Цены: $2 за миллион входных токенов и $10 за миллион выходных токенов до 31 августа 2026 года, затем стандартно $3/$15.
Разница классов на практике
Эту часть релизы не проговаривают, потому что так в целом устроена линейка моделей Anthropic, а не специфика этой пары.
Opus — модель с максимальным потолком
Её выбирают, когда цена ошибки высока, когда задача длительная и автономная без промежуточных проверок, или когда проблема действительно новая, а не вариация на тему того, что модель видела тысячи раз. Глубокие рефакторинги из нескольких файлов, неоднозначные исследовательские вопросы, длинные агентные прогоны, где ошибки накапливаются, — это территория Opus. Вы платите за то, чтобы модель ловила собственные ошибки до того, как они станут вашей проблемой.
Sonnet — рабочая лошадка
Он создан, чтобы работать быстро и дёшево практически постоянно: чат-ассистенты, массовая классификация, итеративное кодирование, где вы и так проверяете каждые несколько шагов, приложения с жёсткими требованиями по задержке. Потолок «суждения» ниже, но в значительной части реальных задач вы до него не дотягиваетесь. В повседневной работе большинство команд должно чаще использовать Sonnet, а Opus подключать выборочно — там, где он действительно нужен.
Конкретно Sonnet 5 — попытка Anthropic поднять этот потолок выше обычного для среднего класса — отсюда «самый агентный Sonnet» и заявление, что он приближается к Opus 4.8 в ряде задач. В этом контексте и стоит читать бенчмарки ниже: Sonnet 5 не просто дешёвый, он дешёвый и ближе к уровню Opus, чем предыдущие версии Sonnet.
Что показывают цифры из релизов
Цена
Самое очевидное и однозначное различие. Sonnet 5 стоит $2/$10 (до 31 августа) или $3/$15 (стандарт) против фиксированных $5/$25 у Opus 5 — Sonnet 5 обходится в 40–60% от стоимости Opus 5 в зависимости от периода ценообразования.
Выравнивание
Единственное место, где в двух постах релизов модели упомянуты напрямую друг относительно друга. Автоматизированный аудит Anthropic показал, что Opus 5 «лучше соблюдает Конституцию Claude, чем Opus 4.8, Sonnet 5 или Fable 5» — это прямой результат, а не вывод. Opus 5 получает 2.3 по этому аудиту — его самый безопасный показатель на сегодня. Sonnet 5 улучшил результаты по сравнению с предшественником (меньше галлюцинаций, меньше угодничества, лучшая устойчивость к захвату подсказок), но Anthropic отмечает, что уровень несоответствующего поведения у него всё ещё выше, чем у Opus 4.8.
Кибербезопасность
Обе модели не проходили целенаправленное «кибер»-обучение, но пришли к разным результатам.
Opus 5 близка к Mythos 5 в поиске уязвимостей, хотя отстаёт в превращении их в эксплойты. Sonnet 5 заметно дальше: Anthropic прямо говорит, что у Sonnet 5 «существенно более слабые кибер-возможности, чем у Opus 4.8 и Mythos 5», и на оценке разработки эксплойтов для Firefox он ни разу не выдал полностью рабочий эксплойт (0,0% успеха, лишь небольшое преимущество над Sonnet 4.6 по частичным попыткам).
Если ваш кейс хотя бы частично связан с кибертематикой, разрыв реален и явно в пользу Opus 5.
Код и интеллектуальная работа
Здесь посты используют разные наборы бенчмарков, поэтому чистой сводной оценки нет.
Opus 5 более чем вдвое обгоняет Opus 4.8 на Frontier-Bench v0.1 и отстаёт от Fable 5 всего на 0,5% на CursorBench 3.2 при вдвое меньшей цене. Sonnet 5 описывается как приближающийся к Opus 4.8 на BrowseComp и OSWorld-Verified при высоком уровне усилий.
С учётом логики классов выше: Sonnet 5 подбирается близко в тех конкретных задачах, которые Anthropic выбрала для демонстрации, но преимущества Opus 5 выглядят более крупными и широкими. Воспринимайте это как направление, а не точные измерения.
Когда что выбирать
Выбирайте Opus 5, если
задача высокорисковая, длительная или действительно новая; вы работаете в области наук о жизни, химии или со сложными многошаговыми агентными процессами; вам нужна максимально выровненная модель; в зоне задач есть всё, что связано с кибербезопасностью.
Выбирайте Sonnet 5, если
у вас высокий объём, критична задержка, или задача достаточно хорошо очерчена, чтобы вам не нужен потолок «суждения» Opus; вы на тарифах Free или Pro, где он уже стоит по умолчанию; стоимость за токен — главный ограничитель.
Ни тот ни другой, если
вам нужна работа по кибербезопасности с ослабленными ограничениями. Opus 5 автоматически откатывается к Opus 4.8, а Sonnet 5 и вовсе стоит позади Opus 4.8.
Итоги
Главный фактор выбора здесь тот же, что и в любом вопросе Opus против Sonnet: этой задаче нужен максимальный потолок или её нужно просто надёжно делать в масштабе? Sonnet 5 поднял этот потолок выше, чем у прошлых версий Sonnet — в этом и состоит главная новость релиза. Но там, где Anthropic дала совместную цифру для двух моделей — аудит выравнивания — Opus 5 вышел вперёд, и история с кибербезопасностью указывает в ту же сторону. По умолчанию используйте Sonnet 5 для объёмных задач, а к Opus 5 обращайтесь, когда ошибка недопустима.