Anthropic n’a pas publié de benchmark direct opposant Opus 5 à Sonnet 5. Chaque annonce compare le modèle à son propre prédécesseur et à Opus 4.8. Les chiffres ci-dessous ne racontent donc qu’une partie de l’histoire. Le reste relève du même arbitrage que pour tout duo Opus/Sonnet : de quelle marge de manœuvre avez-vous réellement besoin, et quel budget êtes-vous prêt à y consacrer.
\nQu’est-ce que Claude Opus 5 ?
\nOpus 5 est le modèle haut de gamme d’Anthropic, lancé le 24 juillet 2026, facturé 5 $ par million de tokens en entrée et 25 $ par million de tokens en sortie. Anthropic le présente comme à l’état de l’art sur Frontier-Bench et GDPval-AA, et proche du modèle Fable 5 plus volumineux pour moitié moins cher. C’est le modèle par défaut sur Claude Max et le plus performant sur Claude Pro.
\nSon trait distinctif est l’auto-vérification : il contrôle son propre travail, construit des bancs de test en l’absence de flux de données, et conteste des instructions inadaptées au lieu d’obéir aveuglément.
\nQu’est-ce que Claude Sonnet 5 ?
\nSonnet 5 est le modèle milieu de gamme d’Anthropic, lancé le 30 juin 2026. Anthropic le décrit comme son Sonnet le plus agentique à ce jour, avec des performances proches d’Opus 4.8 pour un prix inférieur. C’est le modèle par défaut sur les offres Free et Pro, et il est disponible sur Max, Team, Enterprise et via l’API.
\nTarification : 2 $ par million de tokens en entrée et 10 $ par million de tokens en sortie jusqu’au 31 août 2026, puis 3 $/15 $ en standard.
\nLa différence de gamme, concrètement
\nC’est l’élément que les billets de lancement n’explicitent pas, car il découle du positionnement général de la gamme Anthropic, pas seulement de ce duo précis.
\nOpus est le modèle plafond
\nOn le choisit lorsque l’erreur coûte cher, qu’une tâche doit tourner longtemps en autonomie sans supervision intermédiaire, ou que le problème est véritablement inédit plutôt qu’une variante d’un cas déjà vu mille fois par le modèle. Refactorisations profondes multi-fichiers, questions de recherche ambiguës, longues exécutions agentiques où les erreurs se cumulent — c’est le terrain d’Opus. Vous payez pour que le modèle détecte ses propres erreurs avant qu’elles ne deviennent les vôtres.
\nSonnet est l’outil de tous les jours
\nConçu pour être suffisamment rapide et économique pour tourner en continu : assistants de chat, classification à grand volume, itérations de code où vous validez tous les quelques pas, applications sensibles à la latence. Le plafond de jugement est plus bas, mais pour une large part du travail réel, vous ne l’atteignez jamais. Au quotidien, la plupart des équipes devraient privilégier Sonnet, en sollicitant Opus de manière ciblée pour les tâches qui l’exigent vraiment.
\nSonnet 5, en particulier, est la tentative d’Anthropic de relever ce plafond au-dessus de la norme pour un modèle milieu de gamme — d’où le \"Sonnet le plus agentique à ce jour\" et l’affirmation qu’il se rapproche d’Opus 4.8 sur certaines tâches. C’est le prisme à garder en tête pour lire les benchmarks ci-dessous : Sonnet 5 n’est pas seulement économique, il se situe plus près de la gamme Opus que les précédents Sonnets.
\nCe que montrent vraiment les chiffres
\nPrix
\nLa différence la plus claire et la moins ambiguë. Sonnet 5 est à 2 $/10 $ (jusqu’au 31 août) ou 3 $/15 $ (standard) contre 5 $/25 $ fixes pour Opus 5 — Sonnet 5 coûte 40 à 60 % du prix d’Opus 5 selon la période tarifaire.
\nAlignement
\nLe seul point où les deux billets se nomment directement. L’audit automatisé d’Anthropic conclut qu’Opus 5 \"adhère mieux à la Constitution de Claude qu’Opus 4.8, Sonnet 5 ou Fable 5\" — un résultat explicite, pas une inférence. Opus 5 obtient 2,3 à cet audit, son meilleur score de sûreté à ce jour. Sonnet 5 progresse par rapport à son prédécesseur (moins d’hallucinations, moins de complaisance, meilleure résistance aux détournements par injection de prompt), mais Anthropic précise qu’il présente encore un taux de comportements mal alignés supérieur à celui d’Opus 4.8.
\nCybersécurité
\nLes deux modèles n’ont pas reçu d’entraînement cyber délibéré, mais ils se situent à des niveaux différents.
\nOpus 5 s’approche de Mythos 5 pour la découverte de vulnérabilités, même s’il est moins performant pour les transformer en exploits. Sonnet 5 est plus en retrait : Anthropic affirme clairement que Sonnet 5 a \"des capacités cyber sensiblement inférieures à Opus 4.8 et Mythos 5\", et sur une évaluation de développement d’exploit Firefox, il n’a jamais produit d’exploit pleinement fonctionnel (0,0 % de réussite, seulement un léger mieux que Sonnet 4.6 sur les tentatives partielles).
\nSi votre cas d’usage touche de près ou de loin au cyber, l’écart est réel et tourne clairement à l’avantage d’Opus 5.
\nCode et travail de connaissance
\nIci, les deux billets s’appuient sur des jeux de benchmarks différents, donc pas de score comparatif net.
\nOpus 5 fait plus que doubler Opus 4.8 sur Frontier-Bench v0.1 et se place à 0,5 % de Fable 5 sur CursorBench 3.2 pour deux fois moins cher. Sonnet 5 est décrit comme se rapprochant d’Opus 4.8 sur BrowseComp et OSWorld-Verified avec un effort élevé.
\nÀ lire à la lumière de la logique de gamme ci-dessus : Sonnet 5 s’approche sur les tâches que met en avant Anthropic, mais les victoires d’Opus 5 paraissent plus larges et plus nettes. À prendre comme une indication de tendance, pas une mesure exhaustive.
\nQuand choisir l’un ou l’autre
\nChoisissez Opus 5 si
\nla tâche est à fort enjeu, longue ou véritablement nouvelle ; vous travaillez en sciences de la vie, chimie ou sur des agents complexes à étapes multiples ; vous avez besoin du modèle le plus aligné disponible ; tout ce qui touche à la cybersécurité est dans le périmètre.
\nChoisissez Sonnet 5 si
\nvous traitez de gros volumes, la latence compte, ou la tâche est suffisamment cadrée pour ne pas nécessiter le plafond de jugement d’Opus ; vous êtes sur Free ou Pro où il est déjà par défaut ; le coût par token est votre contrainte principale.
\nNi l’un ni l’autre si
\nvous avez besoin de travaux de cybersécurité avec des garde-fous réduits. Opus 5 rétrograde automatiquement vers Opus 4.8, et Sonnet 5 reste derrière Opus 4.8 de façon explicite.
\nEn conclusion
\nL’essentiel de l’arbitrage ici est le même que pour toute comparaison Opus/Sonnet : cette tâche a-t-elle besoin du plafond, ou doit-elle surtout être réalisée de façon fiable à grande échelle ? Sonnet 5 relève ce plafond davantage que les précédents Sonnets, ce qui constitue la vraie nouveauté de son lancement. Mais là où Anthropic a chiffré la comparaison — l’audit d’alignement — Opus 5 sort devant, et la partie cybersécurité va dans le même sens. Par défaut, optez pour Sonnet 5 sur le volume ; passez à Opus 5 lorsque l’erreur n’est pas permise.


