Anthropic не публиковала прямое сравнение Opus 5 и Sonnet 5. В каждом анонсе модель сопоставляется с собственным предшественником и с Opus 4.8. Так что приведённые ниже цифры показывают лишь часть картины. Остальное — тот же выбор, что и в любой паре Opus vs. Sonnet: насколько высокий потолок вам действительно нужен и сколько вы готовы за это заплатить.
Что такое Claude Opus 5?
Opus 5 — флагманская модель Anthropic, выпущенная 24 июля 2026 года, по цене $5 за миллион входных токенов и $25 за миллион выходных токенов. Anthropic называет её передовой на Frontier-Bench и GDPval-AA и близкой к более крупной модели Fable 5 при вдвое меньшей цене. Это модель по умолчанию в Claude Max и самая мощная модель в Claude Pro.
Её ключевая черта — самопроверка: проверка собственной работы, построение тестовых контуров при отсутствии дата-фида, возражение на некорректные инструкции вместо простого выполнения.
Что такое Claude Sonnet 5?
Sonnet 5 — модель среднего уровня Anthropic, выпущенная 30 июня 2026 года. Anthropic описывает её как самый «агентный» Sonnet на сегодня, с производительностью, близкой к Opus 4.8, но по более низкой цене. Это модель по умолчанию в планах Free и Pro, также доступна в Max, Team, Enterprise и через API.
Цены: $2 за миллион входных токенов и $10 за миллион выходных токенов до 31 августа 2026 года, затем стандартно $3/$15.
Разница уровней на практике
В анонсах этот момент не проговаривается напрямую, потому что так в целом устроена линейка моделей Anthropic, а не именно эта пара.
Opus — модель-потолок
Её выбирают, когда цена ошибки высока, когда задача длительная и автономная, без промежуточных проверок, или когда проблема действительно новая, а не вариация на тему из того, что модель видела тысячи раз. Глубокие рефакторинги по многим файлам, неоднозначные исследовательские вопросы, длинные агентные прогоны, где ошибки накапливаются, — это территория Opus. Вы платите за то, чтобы модель ловила собственные промахи, прежде чем они станут вашей проблемой.
Sonnet — рабочая лошадка
Он создан, чтобы быть достаточно быстрым и недорогим для постоянного использования: чат-ассистенты, массовая классификация, итеративная разработка кода, где вы и так проверяете каждые пару шагов, приложения с жёсткими требованиями к задержке. Потолок по суждению ниже, но для большой доли реальной работы вы до него не дотягиваетесь. В повседневной работе большинство команд должны опираться на Sonnet, избирательно привлекая Opus для задач, где он действительно нужен.
Конкретно Sonnet 5 — попытка Anthropic поднять этот потолок выше обычного для среднего уровня, отсюда «самый агентный Sonnet на сегодня» и тезис, что на некоторых задачах он приближается к Opus 4.8. Это контекст для чтения бенчмарков ниже: Sonnet 5 не просто дешевле, он дешевле и ближе к уровню Opus, чем ранние версии Sonnet.
Что показывают цифры из релизов
Цена
Самое очевидное и однозначное различие. Sonnet 5 стоит $2/$10 (до 31 августа) или $3/$15 (стандарт) против фиксированных $5/$25 у Opus 5 — Sonnet 5 обходится в 40–60% от стоимости Opus 5 в зависимости от периода цен.
Согласованность
Единственное место, где в двух анонсах модели упоминаются напрямую друг относительно друга. Автоматизированный аудит Anthropic показал, что Opus 5 «лучше следует Конституции Claude, чем Opus 4.8, Sonnet 5 или Fable 5» — это прямой, заявленный результат, а не вывод. Opus 5 набрал 2.3 по этому аудиту, его самый безопасный показатель на сегодня. Sonnet 5 улучшил показатели относительно предшественника (меньше галлюцинаций, меньше угодничества, лучшая стойкость к захватам через prompt-injection), но Anthropic отмечает, что он всё ещё демонстрирует более высокий уровень несогласованного поведения, чем Opus 4.8.
Кибербезопасность
Обе модели не обучались на преднамеренных киберданных, но в итоге показывают разный уровень.
Opus 5 близок к Mythos 5 в поиске уязвимостей, хотя отстаёт в превращении их в эксплойты. Sonnet 5 отстаёт сильнее: Anthropic прямо говорит, что Sonnet 5 имеет «значительно более слабые кибервозможности, чем Opus 4.8 и Mythos 5», и на оценке разработки эксплойтов для Firefox он ни разу не выдал полностью рабочий эксплойт (успех 0,0%, лишь небольшое преимущество над Sonnet 4.6 по частичным попыткам).
Если ваш кейс затрагивает всё, что рядом с кибербезопасностью, этот разрыв реален и явно в пользу Opus 5.
Программирование и когнитивная работа
Здесь в двух постах используются разные наборы бенчмарков, поэтому прямой линии сравнения нет.
Opus 5 более чем вдвое превосходит Opus 4.8 на Frontier-Bench v0.1 и находится в пределах 0,5% от Fable 5 на CursorBench 3.2 при вдвое меньшей стоимости. Sonnet 5 описывается как приближающийся к Opus 4.8 на BrowseComp и OSWorld-Verified при высоких усилиях.
Вместе с логикой уровней выше: Sonnet 5 близок на отдельных задачах, которые Anthropic выделила, но победы Opus 5 выглядят более крупными и широкими. Воспринимайте это как направление, а не точный замер.
Когда что выбирать
Выберите Opus 5, если
задача высокорисковая, длительная или действительно новая; вы работаете в области наук о жизни, химии или со сложной многошаговой агентной работой; вам нужна максимально согласованная модель; в зоне охвата есть всё, что рядом с кибербезопасностью.
Выберите Sonnet 5, если
у вас большой объём, важна задержка, или задача достаточно чётко очерчена, чтобы вам не нужен был потолок суждения Opus; вы на тарифах Free или Pro, где он уже по умолчанию; стоимость за токен — ключевое ограничение.
Ни то ни другое, если
вам нужны задачи по кибербезопасности с ослабленными ограничителями. Opus 5 автоматически откатывается к Opus 4.8, а Sonnet 5 находится позади Opus 4.8 напрямую.
Итоги
Основной фактор выбора здесь тот же, что и в любом вопросе Opus против Sonnet: этой задаче нужен потолок или достаточно просто надёжно выполнять её в масштабе? Sonnet 5 поднял этот потолок выше, чем прежние версии Sonnet, и это главная новость его запуска. Но там, где Anthropic дала общую цифру для двух моделей — аудит согласованности — Opus 5 вышел вперёд, и история с кибербезопасностью указывает в ту же сторону. По умолчанию берите Sonnet 5 для объёма, а к Opus 5 обращайтесь, когда цена ошибки недопустима.