Accéder au contenu principal

Claude Sonnet 5 vs GPT-5.6 : benchmarks, tarifs et accès

Sonnet 5 est disponible dès maintenant à prix réduit. GPT-5.6 affiche de meilleurs résultats sur Terminal-Bench 2.1 mais n’est pas encore accessible au grand public. Voici l’analyse complète.
Actualisé 23 sept. 2026  · 7 min lire

Explorer avec l’IA

ChatGPTClaudePerplexity

Anthropic et OpenAI ont tous deux des nouveautés cette semaine, mais ces lancements n’en sont pas au même stade.

\n

GPT-5.6 a été dévoilé, mais reste cantonné à un aperçu limité. Et tandis que GPT-5.6 n’est pas encore disponible pour le grand public, Claude Sonnet 5 est sorti aujourd’hui et est actif sur tous les forfaits Claude — avec un tarif API d’introduction qui, pour l’instant, est même inférieur à celui du modèle intermédiaire de GPT-5.6, Terra.

\n

Voici ce que l’on sait sur chaque modèle, comment ils se comparent et où les chiffres se recoupent.

\n

Qu’est-ce que Claude Sonnet 5 ?

\n

Claude Sonnet 5 est le dernier modèle milieu de gamme d’Anthropic, présenté comme le Sonnet le plus agentique à ce jour. L’idée : combler une bonne partie de l’écart avec les modèles de classe Opus en planification et usage d’outils, tout en restant sensiblement plus abordable.

\n

Anthropic annonce un net gain par rapport à Sonnet 4.6 en raisonnement, en code et en utilisation d’outils, avec des performances désormais proches d’Opus 4.8 sur plusieurs évaluations agentiques, notamment BrowseComp (recherche agentique) et OSWorld-Verified (utilisation de l’ordinateur).

\n

Opus 4.8 garde l’avantage en précision brute, surtout aux niveaux d’effort élevés ou maximum, mais Sonnet 5 offre aux développeurs un meilleur ratio performance/prix. Les modèles milieu de gamme d’Anthropic ont l’habitude de surperformer leur catégorie lorsqu’une nouvelle génération arrive, avant que la prochaine mise à jour d’Opus ne rattrape son retard. Cela paraît loin, mais Claude Sonnet 3.5 avait en fait dépassé l’ancien Claude Opus 3 sur plusieurs benchmarks en 2024.

\n

Sonnet 5 utilise aussi un tokenizer mis à jour : le même texte en entrée peut se convertir en davantage de tokens qu’auparavant (environ 1,0 à 1,35× selon le contenu).

\n

Qu’est-ce que GPT-5.6 ?

\n

GPT-5.6 n’est pas un modèle unique. C’est une famille de trois modèles, organisée sous une nouvelle nomenclature où le chiffre indique la génération et le nom, le niveau de capacités :

\n
    \n
  • \n

    Sol est le modèle phare. C’est le seul niveau donnant accès à deux nouveaux contrôles : un paramètre d’effort de raisonnement max et l’ultra mode, qui répartit une tâche entre un ensemble de sous-agents.

    \n
  • \n
  • \n

    Terra est le modèle polyvalent du quotidien — globalement comparable à GPT-5.5 en qualité générale, pour environ la moitié du prix.

    \n
  • \n
  • \n

    Luna est l’offre à bas coût, pensée pour les charges sensibles à la latence.

    \n
  • \n
\n

OpenAI met en avant des progrès en code, biologie et cybersécurité. Le point fort côté benchmarks est sa performance sur plusieurs évaluations intéressantes, notamment Terminal-Bench 2.1, mais aussi GeneBench v1 (benchmark de génomique sur longue durée) et deux benchmarks de développement d’exploits (ExploitBench et ExploitGym).

\n

Comparatif des benchmarks de Claude Sonnet 5 et GPT-5.6

\n

D’après les annonces respectives, Sonnet 5 et GPT-5.6 ne partagent aucun benchmark commun avec des chiffres publiés par les deux côtés.

\n

Bien qu’Anthropic ait publié des chiffres pour Sonnet 5 dans son billet de lancement et sa system card, OpenAI n’a pour l’instant confirmé qu’un seul score pour GPT-5.6 : Terminal-Bench 2.1. Voici, côte à côte, ce qui est réellement public de part et d’autre :

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
BenchmarkClaude Sonnet 5GPT-5.6 SolGPT-5.6 Sol UltraGPT-5.6 TerraGPT-5.6 Luna
Terminal-Bench 2.1Non publié88,8%91,9%82,5%84,3%
SWE-bench Pro63,2%Non publié—Non publiéNon publié
OSWorld-Verified (utilisation de l’ordinateur)81,2%Non publié—Non publiéNon publié
Humanity's Last Exam (avec outils)57,4%Non publié—Non publiéNon publié
\n
\n

Terminal-Bench 2.1 est la seule ligne où GPT-5.6 a publié des résultats, et Sonnet 5 n’a aucun score public à y mettre. C’est peut-être stratégique, étant donné la bonne performance de GPT-5.6.

\n

Sur les benchmarks où Sonnet 5 fournit des chiffres — SWE-bench Pro, OSWorld-Verified, Humanity’s Last Exam — GPT-5.6 n’a simplement pas encore montré ses cartes, donc pas de comparaison possible.

\n

Conclusion honnête : une comparaison complète Sonnet 5 vs GPT-5.6 n’existe pas encore. Chaque éditeur a publié un jeu d’évals différent.

\n

Vue d’ensemble : la place de chaque modèle sur le marché

\n

Puisque Sonnet 5 et GPT-5.6 ne se recoupent pas directement, il vaut la peine d’observer comment leurs scores publiés se positionnent face au reste du paysage — Opus 4.8, le Fable 5 suspendu, GPT-5.5 et Gemini 3.1 Pro. Cela ne tranchera pas Sonnet 5 vs GPT-5.6, mais situe chacun par rapport aux mêmes concurrents :

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
BenchmarkClaude Opus 4.8Claude Fable 5 (avant suspension)GPT-5.5Gemini 3.1 ProGPT-5.6 Sol Ultra
Terminal-Bench 2.178,9%83,4%88,0%70,7%91,9%
SWE-bench Pro69,2%80,3%58,6%—Non publié
Humanity's Last Exam (sans outils)49,8%59,0%—44,4%Non publié
\n
\n

Deux points à retenir : sur Terminal-Bench 2.1, le 91,9% de GPT-5.6 Sol Ultra dépasse tous les modèles Claude connus, y compris Opus 4.8 à 78,9%. OpenAI ne surestimait donc pas la performance de GPT-5.6 sur ce benchmark.

\n

Fable 5 reste devant Opus 4.8 et GPT-5.5 sur SWE-bench Pro et Humanity’s Last Exam, même suspendu. Ses scores n’ont tout simplement pas été battus, y compris par GPT-5.6 (qui n’a pas publié de résultats SWE-bench ni HLE à comparer). Le 63,2% de Sonnet 5 sur SWE-bench Pro (tableau ci-dessus) se situerait au-dessus des 58,6% de GPT-5.5, mais en dessous d’Opus 4.8 et Fable 5 — un proxy très approximatif, puisqu’on lit des générations différentes au travers de deux tableaux séparés.

\n

Tarifs de Claude Sonnet 5 et GPT-5.6

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
ModèleEntrée (pour 1 M de tokens)Sortie (pour 1 M de tokens)
Claude Sonnet 5 (intro, jusqu’au 31 août 2026)$2.00$10.00
Claude Sonnet 5 (standard)$3.00$15.00
GPT-5.6 Sol$5.00$30.00
GPT-5.6 Terra$2.50$15.00
GPT-5.6 Luna$1.00$6.00
\n
\n

Au tarif catalogue, le prix d’introduction de Sonnet 5 se situe entre GPT-5.6 Terra et Luna, et bien en dessous de Sol. Mais c’est surtout ce tarif d’introduction qui retient l’attention : à $2/$10, Sonnet 5 passe sous les $2.50/$15 de GPT-5.6 Terra, au moins jusqu’à l’été avant une hausse.

\n

Précision importante : la comparaison tarifaire ne se résume pas à un calcul rapide. Anthropic précise que le tarif d’introduction de Sonnet 5 est calibré pour rester globalement neutre face au nombre de tokens plus élevé du nouveau tokenizer. De son côté, OpenAI introduit un système de mise en cache des prompts plus prévisible pour GPT-5.6 et les modèles ultérieurs, avec l’écriture en cache facturée à 1,25× du tarif d’entrée hors cache et la lecture en cache conservant une remise de 90%.

\n

Pourquoi lancer avec un tarif d’introduction remisé plutôt que de fixer dès le premier jour le tarif standard ? Le tokenizer explique en partie ce choix, mais le calendrier colle aussi à la réalité du moment : un marché dense et qui bouge vite. Ces dernières semaines, Sakana AI a lancé Fugu, un orchestrateur qui achemine vers un pool de modèles de pointe et annonce se rapprocher des systèmes de classe Mythos d’Anthropic pour une fraction du coût. Proposer Sonnet 5 à $2/$10 jusqu’à fin août donne à Anthropic un modèle agentique réellement abordable et largement disponible, tandis que GPT-5.6 reste en aperçu. Être le modèle que l’on peut effectivement utiliser, à bas prix, est un vrai avantage concurrentiel.

\n

Disponibilité de Claude Sonnet 5 et GPT-5.6

\n

Claude Sonnet 5 est disponible dès aujourd’hui, partout. C’est le modèle par défaut sur les forfaits Free et Pro, accessible sur Max, Team et Enterprise, et actif dans Claude Code ainsi que sur Claude Platform via l’API (identifiant de modèle claude-sonnet-5). Vous avez peut-être vu apparaître Claude Sonnet 5 dans la fenêtre de chat avant même l’annonce.

\n

\"claude

\n

GPT-5.6 n’est pas disponible de manière générale. Pendant la phase d’aperçu, il est accessible uniquement via l’API et Codex pour un groupe restreint de partenaires. OpenAI annonce une ouverture plus large, sans donner de date.

\n

Derniers points à retenir

\n

Sur l’unique benchmark commun, le niveau phare de GPT-5.6 affiche de meilleurs scores que l’actuel modèle phare de Claude, Opus 4.8, ce qui laisse penser qu’OpenAI pourrait disposer d’un vrai avantage de capacité une fois GPT-5.6 largement disponible. Mais Sonnet 5 n’est pas vraiment le concurrent direct de Sol ou Terra en termes de capacité — c’est un modèle milieu de gamme qui joue la carte du rapport performance agentique/prix et, sur ce terrain, il est disponible, agressif sur le tarif et opérationnel dès aujourd’hui.


Josef Waples's photo
Author
Josef Waples

Je suis rédacteur et éditeur dans le domaine de la science des données. Je suis particulièrement intéressé par l'algèbre linéaire, les statistiques, R, etc. Je joue également beaucoup aux échecs ! 

Sujets
Intelligence artificielle

Apprenez avec DataCamp

Cours

Introduction aux modèles Claude

3 h
14.6K
Découvrez comment utiliser Claude avec l'API Anthropic pour résoudre des problèmes concrets et créer des applications basées sur l'IA.
Afficher les détailsRight Arrow
Commencer Le Cours
Voir plusRight Arrow
Contenus associés

blog

Comprendre les TPU et les GPU dans l'IA : Un guide complet

L'essor du développement de l'intelligence artificielle (IA) a entraîné une augmentation notable de la demande en matière de calcul, d'où la nécessité de disposer de solutions matérielles robustes. Les unités de traitement graphique (GPU) et les unités de traitement tensoriel (TPU) sont devenues des technologies essentielles pour répondre à ces demandes.
Kurtis Pykes 's photo

Kurtis Pykes

9 min

blog

ROI de l'IA en 2026 : pourquoi les compétences des équipes déterminent le retour sur investissement

Seuls 21 % des dirigeants font état d'un retour sur investissement « significatif » de leurs investissements dans l'IA.
Lynn Heidmann's photo

Lynn Heidmann

blog

Plus de 50 questions/réponses d’entretien AWS pour 2026

Un guide complet des questions d’entretien AWS de base, intermédiaires et avancées, avec des mises en situation inspirées de cas réels.
Zoumana Keita 's photo

Zoumana Keita

15 min

blog

Architecture de l'entrepôt de données : Tendances, outils et techniques

Apprenez l'essentiel de l'architecture d'un entrepôt de données, des composants clés aux meilleures pratiques, pour construire un système de données évolutif et efficace !
Kurtis Pykes 's photo

Kurtis Pykes

15 min

cursor ai code editor

Tutoriel

Cursor AI : Un guide avec 10 exemples pratiques

Apprenez à installer Cursor AI sur Windows, macOS et Linux, et découvrez comment l'utiliser à travers 10 cas d'utilisation différents.

Tutoriel

Python Switch Case Statement : Guide du débutant

Découvrez le match-case de Python : un guide sur sa syntaxe, ses applications en data science, ML, et une analyse comparative avec le switch-case traditionnel.
Matt Crabtree's photo

Matt Crabtree

5 min

Voir PlusVoir Plus