Cours
Note : OpenAI a lancé GPT-6 Astra le 3 septembre 2026, puis GPT-6 Sol et Luna le 23 septembre 2026.
GPT-5.6 est une série de trois modèles lancée aujourd’hui en aperçu limité, en coordination avec le gouvernement américain.
Elle n’est pas encore disponible à grande échelle, mais les avancées sont nombreuses, notamment en code, biologie et cybersécurité, que nous détaillons ci‑dessous.
Pour remonter le fil des annonces d’OpenAI, nous avons documenté chaque sortie : GPT-5.5 Instant, GPT-5.3 Instant et GPT-5.2.
Et pour comparer GPT-5.6 aux modèles récents disponibles, consultez aussi : Gemini 3.1 Pro, Claude Opus 5, Claude Mythos 5, Claude Fable 5.
Qu’est-ce que GPT-5.6 ?
GPT-5.6 est la toute dernière génération de modèles d’OpenAI. Il s’agit en réalité d’une famille de trois modèles avec, enfin, une nouvelle convention de nommage.
Dans ce système, le numéro indique la génération (5.6) et le nom correspond au niveau de capacités (Sol, Terra, Luna). Un atout de cette convention est que chaque niveau peut évoluer à son propre rythme, avec moins d’ambiguïtés. « Instant » n’était pas le meilleur terme pour désigner le dernier modèle sous‑jacent.
Qu’est-ce que GPT-5.6 Sol ?
Sol est le modèle phare, le plus puissant et le plus capable de la série. C’est le niveau mis en avant par OpenAI sur tous les benchmarks et c’est le seul qui débloque le réglage d’effort de raisonnement max et le mode ultra (voir plus bas).
C’est aussi avec Sol que les gains en cybersécurité et en biologie sont les plus marqués. Choisissez Sol si vous visez le plafond de performance sur des problèmes difficiles et multi‑étapes, et que le coût par token n’est pas votre premier critère.
Nous l’avons comparé aux nouveaux modèles phares d’Anthropic et de SpaceXAI, Claude Opus 5 et Grok 4.6.
Qu’est-ce que GPT-5.6 Terra ?
Terra est le modèle équilibré pour le quotidien : pensez‑y comme au défaut. Ses performances rivalisent avec GPT‑5.5 tout en coûtant environ deux fois moins cher. On pourrait bien voir se généraliser ce schéma : une qualité proche du modèle phare de la génération précédente, à un prix de milieu de gamme.
Qu’est-ce que GPT-5.6 Luna ?
Luna est le niveau rapide et économique. Il vise les charges à grand volume, sensibles à la latence, ou à fortes contraintes budgétaires. Comme le montre le tableau de benchmarks ci‑dessous, « le moins cher » ne signifie pas « le plus faible » sur toutes les tâches. À garder en tête pour ne pas l’écarter trop vite.
En résumé :
- Sol est le modèle le plus puissant avec l’empilement de garde‑fous le plus complet
- Terra est proche de GPT‑5.5 mais moins cher
- Luna est le plus économique.
Quoi d’autre de nouveau avec GPT-5.6 ?
Cette mise à jour introduit aussi de nouveaux moyens d’accentuer le raisonnement, plus des gains étendus dans quelques domaines ciblés.
Deux nouvelles façons de pousser le modèle
GPT-5.6 propose deux nouveaux contrôles :
-
Effort de raisonnement
max: un nouveau réglage qui laisse à Sol davantage de temps pour réfléchir au problème. -
Mode
ultra: plus intéressant encore. Au lieu d’un seul agent sur la tâche,ultraorchestre des sous‑agents.
Dans les benchmarks ci‑dessous, vous verrez que ultra figure comme une ligne dédiée (« GPT-5.6 Sol Ultra ») et signe le meilleur score.
De meilleurs résultats en code
GPT-5.6 Sol établit un nouvel état de l’art sur Terminal‑Bench 2.1, paru il y a environ six semaines. La dernière version évalue des workflows en ligne de commande nécessitant itération et coordination d’outils. Nous entrerons dans les chiffres concrets plus bas.
Des progrès en biologie
Benchmark moins connu : GeneBench v1. Il évalue des analyses de génomique et de biologie quantitative sur long terme. Selon la sortie, GPT-5.6 Sol fait mieux que GPT‑5.5 tout en consommant moins de tokens.
Cybersécurité renforcée (et mieux encadrée)
OpenAI présente GPT-5.6 Sol comme son modèle le plus performant à ce jour en cybersécurité, et y consacre une large part de l’annonce. Sol repousse le front performance‑efficience sur des tâches de sécurité à long horizon, dont la recherche de vulnérabilités et l’exploitation. L’annonce cite aussi des succès sur des jeux d’évaluation moins connus :
- Sur ExploitBench, OpenAI indique que GPT-5.6 Sol rivalise avec le modèle (non publié) Mythos Preview tout en n’utilisant qu’environ un tiers des tokens de sortie.
- Sur ExploitGym, benchmark conçu par des chercheurs de l’UC Berkeley, les trois modèles montrent de fortes améliorations cyber à mesure que le raisonnement augmente.


Résultats de benchmarks GPT-5.6
La performance phare est celle sur Terminal‑Bench 2.1, mentionnée plus haut. Voici le classement, du meilleur au moins bon :
| Modèle | Terminal‑Bench 2.1 |
|---|---|
| GPT-5.6 Sol Ultra | 91,9 % |
| GPT-5.6 Sol | 88,8 % |
| GPT-5.5 | 88,0 % |
| GPT-5.6 Luna | 84,3 % |
| Claude Mythos 5 | 84,3 % |
| Claude Fable 5 | 83,4 % |
| GPT-5.6 Terra | 82,5 % |
| Claude Opus 4.8 | 78,9 % |
| Gemini 3.1 Pro Preview | 70,7 % |
Quelques points saillants :
-
Le mode
ultrachange la donne. GPT-5.6 Sol Ultra (91,9 %) se place nettement au‑dessus de Sol standard (88,8 %), ce qui illustre clairement l’intérêt des sous‑agents, au moins ici. -
L’ordre des niveaux n’est pas parfaitement reflété par ce benchmark unique. Remarquez que GPT-5.6 Luna dépasse GPT-5.6 Terra, alors que Terra est positionné au‑dessus. Et Terra finit derrière GPT‑5.5 (88,0 %) sur ce test, malgré la description d’OpenAI le disant « compétitif avec GPT‑5.5 » globalement. À retenir : les niveaux reflètent un équilibre intelligence/vitesse/coût sur un large éventail de tâches, pas une garantie sur un test isolé.
La pile de sécurité et l’aperçu limité
C’est ici que GPT‑5.6 s’écarte d’un lancement de modèle classique. Plutôt que de le tester nous‑mêmes (voir plus bas pourquoi), l’information la plus marquante concerne la façon dont il est déployé.
Une pile de garde‑fous en couches
OpenAI soutient qu’aucun garde‑fou isolé ne résiste à un usage malveillant déterminé ou adaptatif ; il faut donc en empiler plusieurs. Dans l’aperçu GPT‑5.6, ces couches incluent :
- Un entraînement au niveau du modèle pour refuser l’assistance cyber prohibée, y compris face aux tentatives de dissimulation d’intention ou de jailbreak.
- Des classifieurs en temps réel pour détecter les mésusages en cyber et biologie, qui évaluent la sortie à mesure qu’elle est générée. Pour les cas à risque élevé, la génération peut être suspendue pendant qu’un modèle de raisonnement plus grand révise toute la conversation, et la sortie peut être retenue avant même de vous parvenir.
- Un examen au niveau du compte capable d’analyser l’ensemble des conversations et signaux de risque d’un utilisateur pour distinguer comportements malveillants persistants et travaux de sécurité dual‑use légitimes.
- Un accès différencié, avec supervision, application des règles et tests continus.
OpenAI précise que, surtout durant l’aperçu, certaines requêtes pourront être bloquées ou refusées, et d’autres simplement plus lentes car mises en pause pour examen. L’entreprise reconnaît aussi que les garde‑fous peuvent parfois se déclencher à tort sur des travaux dual‑use légitimes, où les activités défensives et offensives se ressemblent au premier abord.
Des tests de red teaming à grande échelle
Pour renforcer l’ensemble, OpenAI indique avoir alloué une quantité inédite de calcul à la sécurité : plus de 700 000 heures GPU équivalent A100 de red teaming automatisé visant des jailbreaks universels, c’est‑à‑dire se généralisant à de nombreux prompts et contextes plutôt que limités à un cas étroit. Cela a été complété par du red teaming humain tiers, toujours en cours pendant l’aperçu, ainsi qu’un processus de réponse rapide pour reproduire et corriger les nouveaux jailbreaks, puis les intégrer aux tests futurs.
Pourquoi un déploiement si prudent
OpenAI affirme avoir présenté ses plans et capacités pour GPT‑5.6 au gouvernement américain avant le lancement et, à sa demande, commencer par un aperçu limité pour un petit groupe de partenaires de confiance.
C’est la deuxième fois en un mois que le gouvernement américain intervient sur le lancement d’un modèle de pointe : il y a deux semaines, une directive de contrôle des exportations a contraint Anthropic à retirer Claude Fable 5 et Mythos 5 pour tous les clients dans le monde.
Mon analyse : OpenAI a observé ce qui est arrivé à Anthropic et a préféré remettre les clés en amont plutôt que de voir un modèle retiré après sa mise en ligne.
Note sur les tests
D’ordinaire, c’est ici que nous mettrions le nouveau modèle à l’épreuve, en main, sur le raisonnement, la recherche web et quelques prompts sensibles. Impossible pour l’instant : GPT‑5.6 est en aperçu limité auprès d’un petit cercle de partenaires, il n’est donc pas accessible pour des tests ouverts.
Comment accéder à GPT-5.6 ?
Pendant l’aperçu, les modèles GPT‑5.6 sont disponibles via l’API et Codex pour un groupe restreint de partenaires et d’organisations de confiance. OpenAI prévoit de les proposer plus largement dans ChatGPT, Codex et l’API prochainement.
Tarifs
GPT‑5.6 est facturé par 1 million de tokens selon les trois niveaux :
| Modèle | Entrée (par 1 M tokens) | Sortie (par 1 M tokens) |
|---|---|---|
| GPT-5.6 Sol | 5,00 $ | 30,00 $ |
| GPT-5.6 Terra | 2,50 $ | 15,00 $ |
| GPT-5.6 Luna | 1,00 $ | 6,00 $ |
Quelques précisions utiles sur la tarification :
- Mise en cache des prompts plus prévisible, avec prise en charge de points de rupture explicites et durée minimale de cache de 30 minutes.
- Pour GPT‑5.6 et ultérieurs, les écritures en cache sont facturées 1,25× le tarif d’entrée hors cache du modèle, tandis que les lectures en cache conservent la remise de 90 % sur l’entrée mise en cache.
Vitesse via Cerebras
OpenAI annonce aussi le lancement de GPT‑5.6 Sol sur Cerebras jusqu’à 750 tokens par seconde en juillet, avec un accès initial réservé à certains clients, le temps d’augmenter la capacité. C’est clairement pensé pour les usages sensibles à la latence, où l’attente d’un modèle de pointe crée le goulot d’étranglement.
En conclusion
GPT‑5.6 apporte de bonnes choses : une famille en trois niveaux plus lisible, deux nouveaux leviers de raisonnement (max et ultra), et des gains en code, biologie et cybersécurité.
Reste que le modèle est pour l’instant en aperçu fermé ; aucune validation indépendante n’est encore possible. Le récit d’OpenAI, selon lequel GPT‑5.6 est « tellement capable qu’il a fallu se coordonner avec le gouvernement », sonne comme le marketing le plus flatteur. Cela ne le rend pas faux pour autant, et la prudence en cybersécurité est à saluer.
Pour l’heure, l’essentiel est : des chiffres prometteurs, un accès très restreint, et l’épreuve du feu viendra lorsque les modèles seront largement disponibles. Abonnez‑vous à notre newsletter : nous vous tiendrons informés.

Je suis rédacteur et éditeur dans le domaine de la science des données. Je suis particulièrement intéressé par l'algèbre linéaire, les statistiques, R, etc. Je joue également beaucoup aux échecs !
FAQ
Qu’est-ce que GPT-5.6 ?
GPT‑5.6 est la nouvelle génération de modèles d’OpenAI. Plutôt qu’un unique modèle, il se décline en une famille de trois : Sol (le vaisseau amiral), Terra (un modèle équilibré pour le quotidien) et Luna (un modèle rapide et économique).
Quelle est la différence entre Sol, Terra et Luna ?
Ce sont des niveaux de capacité. Sol est le plus puissant et le plus capable. Terra occupe le milieu de gamme, présenté comme compétitif avec GPT‑5.5 tout en coûtant environ 2× moins cher. Luna est le niveau économique, conçu pour offrir de bonnes capacités au plus bas coût. Dans le nouveau système de nommage d’OpenAI, le numéro (5.6) correspond à la génération et le nom (Sol/Terra/Luna) au niveau durable ; chaque niveau peut donc évoluer à son propre rythme.
Puis-je utiliser GPT-5.6 dès maintenant ?
Pas encore, de manière générale. Au lancement, GPT‑5.6 est en aperçu limité via l’API et Codex pour un petit groupe de partenaires et d’organisations de confiance. OpenAI prévoit une disponibilité plus large dans ChatGPT, Codex et l’API prochainement.
Pourquoi le déploiement de GPT-5.6 est-il si restreint ?
OpenAI explique avoir présenté les plans et capacités des modèles au gouvernement américain avant le lancement et, à sa demande, démarrer par un aperçu limité pour des partenaires dont la participation a été partagée avec le gouvernement. OpenAI précise ne pas souhaiter que ce type d’accès devienne la norme à long terme, et le présente comme une étape transitoire vers une disponibilité plus large, tout en travaillant avec l’Administration sur un cadre d’Executive Order cyber.
Combien coûte GPT-5.6 ?
Par 1 M de tokens : Sol = 5 $ en entrée / 30 $ en sortie, Terra = 2,50 $ en entrée / 15 $ en sortie, et Luna = 1 $ en entrée / 6 $ en sortie. GPT‑5.6 apporte aussi une mise en cache des prompts plus prévisible : écritures facturées 1,25× le tarif d’entrée hors cache, lectures conservant la remise de 90 % sur l’entrée en cache.
Qu’est-ce que les modes max et ultra ?
Ce sont deux nouveaux moyens de pousser le modèle plus loin. max est un réglage d’effort de raisonnement qui laisse à Sol un temps maximal pour approfondir. ultra va plus loin en mobilisant des sous‑agents pour accélérer des travaux complexes au‑delà de ce qu’un seul agent peut faire. Dans l’annonce, « GPT‑5.6 Sol Ultra » obtient le meilleur score sur Terminal‑Bench.
Quels sont les résultats de GPT-5.6 aux benchmarks ?
Sur Terminal‑Bench 2.1 (workflows ligne de commande / code), GPT‑5.6 Sol Ultra mène avec 91,9 %, devant Sol standard (88,8 %), GPT‑5.5 (88,0 %) et des concurrents comme Claude Mythos 5 (84,3 %), Claude Fable 5 (83,4 %), Claude Opus 4.8 (78,9 %) et Gemini 3.1 Pro Preview (70,7 %). OpenAI annonce aussi des gains en biologie sur GeneBench v1 et en cybersécurité sur ExploitBench et ExploitGym, avec une évaluation plus complète prévue au déploiement large.
En quoi GPT-5.6 diffère-t-il de GPT-5.5 ?
GPT‑5.6 est une nouvelle génération avec une famille en trois niveaux et de nouveaux contrôles de raisonnement max/ultra, ainsi que des gains en code, biologie et cybersécurité. Il arrive aussi avec une pile de sécurité renforcée et un déploiement plus prudent, coordonné avec le gouvernement. À titre de comparaison, GPT‑5.5 était une mise à jour largement disponible du modèle par défaut, axée sur la qualité de conversation, la réduction des hallucinations et la personnalisation.
Quand GPT-5.6 arrivera-t-il dans ChatGPT ?
OpenAI n’a pas donné de date ferme ; l’entreprise indique simplement vouloir proposer les modèles dans ChatGPT, Codex et l’API « bientôt », et étendre l’accès « dans les prochaines semaines ». Une version de Sol hébergée sur Cerebras (jusqu’à 750 tokens/seconde) est aussi prévue pour juillet, d’abord pour des clients sélectionnés.

