Anthropic n'a pas publié de benchmark direct entre Opus 5 et Sonnet 5. Chaque billet de lancement compare son modèle à son propre prédécesseur et à Opus 4.8. Les chiffres ci-dessous ne racontent donc qu'une partie de l'histoire. Le reste relève du même jugement que pour n'importe quel duo Opus vs Sonnet : de quel niveau maximal avez-vous vraiment besoin, et quel prix êtes-vous prêt à payer pour l'obtenir ?
\nQu'est-ce que Claude Opus 5 ?
\nOpus 5 est le modèle haut de gamme d'Anthropic, lancé le 24 juillet 2026, facturé 5 $ par million de tokens en entrée et 25 $ par million de tokens en sortie. Anthropic le présente comme à l'état de l'art sur Frontier-Bench et GDPval-AA, et proche du modèle Fable 5 plus volumineux pour un coût divisé par deux. C'est le modèle par défaut sur Claude Max et le plus performant sur Claude Pro.
\nSon trait distinctif est l'auto-vérification : vérifier son propre travail, construire des harnais de tests en l'absence de flux de données, contester des instructions inadéquates plutôt que de s'y conformer.
\nQu'est-ce que Claude Sonnet 5 ?
\nSonnet 5 est le modèle milieu de gamme d'Anthropic, lancé le 30 juin 2026. Anthropic le décrit comme son Sonnet le plus agentique à ce jour, avec des performances proches d'Opus 4.8 à un prix inférieur. C'est le modèle par défaut sur les offres Free et Pro, et il est disponible sur Max, Team, Enterprise et l'API.
\nTarification : 2 $ par million de tokens en entrée et 10 $ par million en sortie jusqu'au 31 août 2026, puis 3 $/15 $ en standard.
\nLa différence de gamme, concrètement
\nC'est le point que les billets de lancement ne détaillent pas, car il reflète le fonctionnement général de la gamme Anthropic, et pas spécifiquement ce duo.
\nOpus est le modèle plafond
\nOn y recourt lorsque l'erreur coûte cher, quand une tâche s'exécute longtemps et en autonomie sans contrôle intermédiaire, ou lorsque le problème est véritablement nouveau plutôt qu'une variante d'un cas déjà vu des milliers de fois par le modèle. De grands refactorings multi-fichiers, des questions de recherche ambiguës, de longues exécutions agentiques où les erreurs se cumulent : c'est le terrain d'Opus. Vous payez pour que le modèle détecte ses propres erreurs avant qu'elles ne deviennent votre problème.
\nSonnet est le cheval de bataille
\nConçu pour être suffisamment rapide et économique pour tourner en continu : assistants de chat, classification à grand volume, itération de code avec vous dans la boucle pour revoir tous les quelques pas, applications sensibles à la latence. Le plafond de jugement est plus bas, mais pour une large part du travail réel, on ne l'atteint jamais. Au quotidien, la plupart des équipes devraient privilégier Sonnet, en sollicitant Opus de manière sélective pour les tâches qui l'exigent vraiment.
\nSonnet 5, en particulier, vise à relever ce plafond plus haut que d'ordinaire pour un modèle milieu de gamme — d'où « le Sonnet le plus agentique à ce jour » et la promesse de se rapprocher d'Opus 4.8 sur certaines tâches. C'est le contexte pour lire les benchmarks ci-dessous : Sonnet 5 n'est pas seulement économique, il est économique et plus proche de la gamme Opus que les Sonnet précédents.
\nCe que montrent vraiment les chiffres de lancement
\nPrix
\nLa différence la plus nette et la moins ambigüe. Sonnet 5 est à 2 $/10 $ (jusqu'au 31 août) ou 3 $/15 $ (standard) contre 5 $/25 $ fixes pour Opus 5 : Sonnet 5 coûte 40–60 % du prix d'Opus 5 selon la période tarifaire.
\nAlignement
\nLe seul endroit où les deux billets se nomment directement. L'audit automatisé d'Anthropic conclut qu'Opus 5 « adhère mieux à la Constitution de Claude qu'Opus 4.8, Sonnet 5 ou Fable 5 » — un résultat explicite, pas une déduction. Opus 5 obtient 2,3 à cet audit, son meilleur score de sécurité à ce jour. Sonnet 5 s'améliore face à son prédécesseur (moins d'hallucinations, moins de servilité, meilleure résistance aux prises de contrôle par injection de prompt), mais Anthropic note qu'il présente encore un taux de comportements désalignés plus élevé qu'Opus 4.8.
\nCybersécurité
\nLes deux modèles n'ont pas reçu d'entraînement cyber spécifique, mais ils n'atterrissent pas au même niveau.
\nOpus 5 se rapproche de Mythos 5 pour la découverte de vulnérabilités, même s'il est en retrait pour les transformer en exploits. Sonnet 5 est plus en arrière : Anthropic indique clairement que Sonnet 5 a des capacités cyber nettement inférieures à celles d'Opus 4.8 et de Mythos 5, et sur une évaluation de développement d'exploit sur Firefox, il n'a jamais produit d'exploit pleinement fonctionnel (0,0 % de réussite, légère avance seulement sur Sonnet 4.6 pour les tentatives partielles).
\nSi votre cas d'usage touche de près ou de loin au cyber, l'écart est réel et joue clairement en faveur d'Opus 5.
\nCodage et travail de connaissance
\nIci, les deux billets s'appuient sur des jeux de benchmarks différents, il n'y a donc pas de score comparatif net.
\nOpus 5 fait plus que doubler Opus 4.8 sur Frontier-Bench v0.1 et se place à 0,5 % de Fable 5 sur CursorBench 3.2 pour un coût divisé par deux. Sonnet 5 est décrit comme se rapprochant d'Opus 4.8 sur BrowseComp et OSWorld-Verified en configuration « effort élevé ».
\nÀ lire à la lumière de la logique de gamme ci-dessus : Sonnet 5 s'approche sur les tâches mises en avant par Anthropic, mais les gains d'Opus 5 paraissent plus larges et plus généraux. Considérez cela comme indicatif, pas mesuré.
\nQuand choisir quoi
\nChoisissez Opus 5 si
\nla tâche est critique, longue ou véritablement nouvelle ; vous travaillez en sciences de la vie, en chimie ou sur des enchaînements agentiques complexes ; vous avez besoin du modèle le plus aligné disponible ; tout ce qui touche à la cybersécurité est au périmètre.
\nChoisissez Sonnet 5 si
\nvous tournez à grand volume, la latence compte, ou la tâche est suffisamment cadrée pour ne pas exiger le plafond de jugement d'Opus ; vous êtes sur Free ou Pro où il est déjà le modèle par défaut ; le coût par token est votre contrainte principale.
\nNi l'un ni l'autre si
\nvous avez besoin de travaux en cybersécurité avec des garde-fous réduits. Opus 5 bascule automatiquement vers Opus 4.8, et Sonnet 5 reste derrière Opus 4.8 tout court.
\nEn bref
\nLe principal critère de choix est le même que pour tout arbitrage Opus vs Sonnet : cette tâche a-t-elle besoin du plafond, ou a-t-elle surtout besoin d'être exécutée de façon fiable à grande échelle ? Sonnet 5 repousse ce plafond plus haut que les précédents Sonnet, c'est l'essentiel de son annonce. Mais là où Anthropic a chiffré la comparaison — l'audit d'alignement — Opus 5 ressort devant, et l'histoire côté cybersécurité va dans le même sens. Par défaut, optez pour Sonnet 5 pour le volume, et passez à Opus 5 lorsque l'erreur n'est pas permise.


