Google a annoncé Gemini 4 Argon tout à la fin septembre. Argon est le premier modèle Gemini 4 de Google et ouvre une nouvelle frontière. Il arrive quatre semaines après GPT-6 Astra d'OpenAI, le nouveau fer de lance d'OpenAI depuis début septembre.
Dans son tableau de lancement, Google place Argon devant Astra sur la plupart des lignes, pour une fraction du prix d'Astra. Mais il y a un point crucial, plus important que n'importe quel benchmark : Argon n'est pas encore généralement disponible. Google le déploie d'abord auprès d'équipes cybersécurité triées sur le volet, sans date annoncée pour les développeurs ou le grand public.
En bref
- Sur le tableau de benchmarks de Google, Gemini 4 Argon devance GPT-6 Astra sur la plupart des critères, notamment en droit, finance et automatisation des processus métier.
- GPT-6 Astra garde l'avantage sur les tâches d'ingénierie logicielle les plus ardues, le travail scientifique en terminal et l'utilisation de l'ordinateur.
- Le prix de lancement d'Argon est à un cinquième de celui d'Astra, et son tarif standard reste à moins de la moitié.
- Mais vous ne pouvez pas encore utiliser Argon : l'accès est réservé aux défenseurs cyber de confiance de Google ; les clients API payants et les abonnés à AI Ultra suivront.
- Donc, choisissez GPT-6 Astra si vous avez besoin d'un modèle de pointe en production dès aujourd'hui.
Qu'est-ce que Gemini 4 Argon ?
Gemini 4 Argon est le nouveau modèle de frontière de Google DeepMind, annoncé fin septembre. C'est le premier modèle de la génération Gemini 4.
Google a conçu Argon pour soutenir un raisonnement profond sur des travaux longs et à plusieurs étapes. Cela s'appuie sur une limite de sortie portée à 1 million de tokens afin que le modèle puisse raisonner sur un problème complexe en un seul passage.
Qu'est-ce que GPT-6 Astra ?
GPT-6 Astra est le modèle phare d'OpenAI, sorti début septembre. Il se situe au sommet de la famille GPT-6, au-dessus de GPT-6.1 Sol et GPT-6 Luna.
OpenAI le positionne comme son modèle le plus performant pour les travaux les plus exigeants, du raisonnement complexe et du codage à l'utilisation de l'ordinateur et à la recherche.
Gemini 4 Argon vs GPT-6 Astra : comparatif direct
Sur les 19 benchmarks du tableau de lancement de Google, Argon obtient un meilleur score qu'Astra sur 14, Astra en remporte 4 et un est à égalité. Tous proviennent du tableau de Google ; considérez-les donc comme l'argumentaire de Google pour Argon plutôt qu'un classement indépendant. J'ai réduit ce tableau pour ne garder que les tests les plus connus, intéressants et pertinents pour cette sortie.
| Critère | Gemini 4 Argon | GPT-6 Astra |
|---|---|---|
| Vals Index | 68,9 % | 63,1 % |
| AutomationBench | 51,3 % | 41,4 % |
| Vals Finance Agent v2 | 65,4 % | 53,5 % |
| Harvey's Legal Agent Benchmark | 19,6 % | 5,4 % |
| DeepSWE v1.1 | 77,9 % | 74,1 % |
| FrontierSWE v2 | 55,0 % | 65,5 % |
| Terminal-bench 4.0 | 57,4 % | 58,2 % |
| Terminal-Bench Science 0.1 | 57,6 % | 68,1 % |
| OSWorld-2.0 (sous-ensemble hors ligne) | 69,2 % | 72,6 % |
| Nombre maximal de tokens en sortie | 1 million | 128 K |
| Disponibilité | Réservé aux défenseurs cyber de confiance | Généralement disponible |
Chaque thème ci-dessous détaille le reste du tableau.
Travaux de connaissance : juridique, finance et workflows métier
C'est là qu'Argon creuse l'écart, et c'est là-dessus que Google a axé son lancement.
Sur Harvey's Legal Agent Benchmark, qui évalue la recherche et la rédaction juridiques, Argon obtient 19,6 % contre 5,4 % pour Astra. Les scores restent faibles des deux côtés, mais tripler le nombre de tâches réussies constitue l'écart relatif le plus marqué du tableau.
La tendance se retrouve en finance et en automatisation métier, où Argon devance d'environ 10 à 12 points. Si ces résultats se confirment lorsqu'il sera accessible, Argon sera le meilleur choix pour les activités juridiques et financières riches en documents.
Codage et ingénierie logicielle
Pour le code, c'est partagé, et tout dépend du type d'ingénierie.
Argon mène sur DeepSWE v1.1, qui teste des tâches de longue portée dans de vrais dépôts de code, et devance légèrement Astra sur Vibe Code Bench, qui évalue la création d'applications fonctionnelles.

Astra l'emporte nettement sur FrontierSWE v2, et les deux se tiennent à moins d'un point sur Terminal-bench 4.0.
Les exemples de Google mettent l'accent sur de grandes migrations, notamment de C et C++ vers Rust à l'échelle des codebases de Google.
Mais pour le benchmark d'ingénierie le plus exigeant du tableau, Astra reste devant.
Long contexte et compréhension visuelle
Argon prend l'avantage à mesure que les entrées s'allongent.
Sur GraphWalks, qui teste le raisonnement sur des structures de graphe réparties dans un long contexte, les deux sont proches jusqu'à 128 K tokens, mais entre 256 K et 1 million de tokens, Argon fait mieux.
Argon mène aussi sur LVBench pour la compréhension de vidéos longues, tandis que la lecture de graphiques sur Chartography est quasiment à égalité.
Pour quiconque injecte des contrats entiers, des codebases complètes ou des enregistrements, c'est la différence la plus concrète après la disponibilité.
Science, maths et utilisation de l'ordinateur
Astra tient bon sur le travail scientifique en terminal, avec plus de 10 points d'avance sur Terminal-Bench Science 0.1. Argon mène LABBench 2, un benchmark de recherche en biologie, et RiemannBench en mathématiques. Côté usage de l'ordinateur, Astra mène OSWorld-2.0 tandis qu'Argon l'emporte sur Agent's Last Exam ; aucun ne domine donc totalement cette catégorie.
Disponibilité et sécurité
Astra est celui que vous pouvez déployer aujourd'hui. Argon est actuellement limité au programme Fairwind de Google pour les défenseurs cyber de confiance, ainsi qu'aux équipes internes de Google. Google indique que les clients API payants et les abonnés à Google AI Ultra suivront, sans donner de date.
Le positionnement d'Argon en cybersécurité a deux facettes. Google le met entre les mains de défenseurs vérifiés sans garde-fous cyber, et il égale Astra à la première place sur CWE-bench v1, qui évalue la correction de vulnérabilités réelles.
Pour tous les autres, Google indique qu'Argon refusera les demandes cyber et CBRN nuisibles et exécutera des contrôles capables d'interrompre l'exécution si le modèle dépasse l'intention de l'utilisateur.
Tarifs : ce que vous payez vraiment
Argon coûte un cinquième d'Astra en prix de lancement et moins de la moitié en prix standard, mais Google n'a pas précisé la durée du tarif de lancement.
Tarification par token, côté à côté
| Type | Gemini 4 Argon (lancement) | Gemini 4 Argon (standard) | GPT-6 Astra |
|---|---|---|---|
| Entrée, par 1 M de tokens | $2,00 | $4,00 | $10,00 |
| Sortie, par 1 M de tokens | $10,00 | $20,00 | $50,00 |
| Lecture d'entrée en cache, par 1 M de tokens | $0,10 (95 % de remise sur l'entrée) | Non publié | $1,00 |
| Surcoût long contexte | Non publié | Non publié | Au-delà de 272 K tokens en entrée : 2× sur entrée et cache, 1,5× sur sortie pour toute la requête |
Le multiple est uniforme sur l'entrée et la sortie : 0,2× d'Astra au tarif de lancement et 0,4× au tarif standard. Les deux fournisseurs facturent le raisonnement en sortie, ce qui pèse davantage pour Argon, puisque Google a porté sa limite de sortie à 1 million de tokens justement pour lui permettre de raisonner plus longtemps.
Même aux tarifs standards, Argon reste bien en dessous de la moitié du coût d'Astra. La question ouverte concerne les longues invites, pour lesquelles seul Astra a publié ses prix.
Coût d'une charge de travail réaliste
| Charge | Gemini 4 Argon (lancement) | Gemini 4 Argon (standard) | GPT-6 Astra |
|---|---|---|---|
| Assistant équilibré : 1 M entrée / 250 K sortie | $4,50 | $9,00 | $22,50 |
| Retrieval, chaque requête sous 272 K : 10 M entrée / 1 M sortie | $30 | $60 | $150 |
| Retrieval, chaque requête au-delà de 272 K : 10 M entrée / 1 M sortie | Non publié | Non publié | $275 |
Chaque total correspond à : (volume ÷ 1 M) × tarif, additionné entre entrée et sortie, aux tarifs standards.
- Assistant équilibré : Argon économise $18 par mois (80 %) au tarif de lancement et $13,50 (60 %) au tarif standard.
- Retrieval sous 272 K : les mêmes économies de 80 % et 60 %, à une échelle où cela commence à compter : $120 ou $90 par mois.
- Retrieval au-delà de 272 K : le surcoût d'Astra porte son coût à $275. Google n'a pas indiqué si Argon prévoit un palier long contexte ; c'est la ligne à vérifier quand la page de tarifs d'Argon sera en ligne.
Les deux fournisseurs utilisent des tokenizers différents et aucun n'a publié de comptages sur une charge commune ; considérez donc ces totaux comme une comparaison de tarifs, pas une facture.
Quand choisir Gemini 4 Argon vs GPT-6 Astra
Pour l'instant, le vrai critère est la disponibilité, pas les benchmarks : Astra est généralement disponible, Argon est réservé à des défenseurs cyber vérifiés. Une fois Argon ouvert, son multiple de prix à 0,2× à 0,4× en fera le choix par défaut à tester pour les travaux de connaissance.
Choisissez Gemini 4 Argon si ...
- Votre activité concerne la recherche juridique, l'analyse financière ou l'automatisation métier. Ce sont ses plus grands avantages dans le tableau de Google, et l'écart en droit est le plus marqué.
- Vous lui fournissez des entrées très longues. Il tient bien mieux qu'Astra pour raisonner entre 256 K et 1 million de tokens, et mène sur la vidéo longue.
- Le prix compte au niveau de qualité de pointe. Même aux tarifs standards, il coûte nettement moins de la moitié d'Astra par token.
Choisissez GPT-6 Astra si ...
- Vous en avez besoin maintenant. Astra est disponible dans ChatGPT, l'API OpenAI, Azure, Bedrock, GitHub Copilot et OpenRouter, tandis qu'Argon n'a pas encore d'API publique.
- Vos travaux les plus exigeants sont en ingénierie logicielle ou calcul scientifique. Il devance Argon sur FrontierSWE v2 et Terminal-Bench Science de plus de 10 points chacun.
- Vous exécutez des agents d'usage de l'ordinateur sur des applications de bureau. Il mène OSWorld-2.0, même si Argon gagne Agent's Last Exam ; testez donc sur vos tâches.
Conclusion
Si vous avez besoin d'un modèle de pointe cette semaine, GPT-6 Astra est l'option. Si votre travail porte sur le juridique, la finance ou l'analyse de documents longs et que vous pouvez attendre, prévoyez de tester Gemini 4 Argon dès son ouverture. Nous vous tiendrons informé de la date exacte si vous vous inscrivez à The Median, notre newsletter hebdomadaire :
Ce duel, Argon contre Astra, est intéressant. Google lance Argon avec un tableau de benchmarks montrant qu'il devance OpenAI sur la plupart des lignes, à un prix inférieur à celui d'Astra. Mais la plupart des utilisateurs ne peuvent tout simplement pas encore l'essayer.
Google parie que son avantage tiendra jusqu'à l'ouverture de l'accès.
FAQ
Gemini 4 Argon est-il meilleur que GPT-6 Astra ?
Sur le tableau de Google, Gemini 4 Argon obtient un meilleur score que GPT-6 Astra sur 14 des 19 benchmarks, avec ses plus grands avantages en juridique, finance, automatisation métier et travail en long contexte. GPT-6 Astra mène sur FrontierSWE v2, Terminal-Bench Science 0.1, OSWorld-2.0 et Terminal-bench 4.0. Tous les scores proviennent de Google, donc des tests indépendants restent nécessaires.
Puis-je déjà utiliser Gemini 4 Argon ?
Pas à moins de faire partie du programme Fairwind de Google pour les défenseurs cyber de confiance. Google indique que les clients API payants et les abonnés à Google AI Ultra auront accès ensuite, mais aucune date ni ID de modèle API n'ont été publiés.
Combien coûte Gemini 4 Argon par rapport à GPT-6 Astra ?
Gemini 4 Argon est lancé à $2 par million de tokens en entrée et $10 par million de tokens en sortie, puis passera à $4 et $20. GPT-6 Astra coûte $10 et $50, donc Argon est à un cinquième du prix d'Astra au lancement et à 40 % aux tarifs standards. Google n'a pas précisé la durée de la période de lancement.
Quel est le meilleur pour coder, Gemini 4 Argon ou GPT-6 Astra ?
C'est partagé. Gemini 4 Argon mène sur DeepSWE v1.1 et Vibe Code Bench dans le tableau de Google, tandis que GPT-6 Astra mène sur FrontierSWE v2 d'environ 10 points et devance légèrement Argon sur Terminal-bench 4.0. Pour les tâches d'ingénierie les plus difficiles, Astra affiche aujourd'hui le meilleur résultat publié.
Quelle est la limite de sortie de Gemini 4 Argon ?
Google a relevé la limite de sortie de Gemini 4 Argon à 1 million de tokens, contre 64 K sur les anciens modèles Gemini, afin qu'il puisse raisonner sur des problèmes longs en un seul passage. La sortie maximale de GPT-6 Astra est de 128 K tokens.