Hoppa till huvudinnehållet

Gemini 4 Argon vs. GPT-6 Astra: Benchmarktester, prissättning och vilken du ska använda

Googles tabell placerar Gemini 4 Argon före GPT-6 Astra inom juridik, finans och arbete med lång kontext till en femtedel av priset. Astra leder fortfarande svår kodning och är den du kan använda.
Uppdaterad 2 okt. 2026  · 8 min läs

Utforska med AI

ChatGPTClaudePerplexity

Google tillkännagav Gemini 4 Argon allra sista dagarna i september. Argon är Googles första Gemini 4-modell och den nya frontlinjen. Den kommer fyra veckor efter OpenAI:s GPT-6 Astra, OpenAI:s nya flaggskepp sedan början av september.

Googles lanseringstabell placerar Argon före Astra på de flesta rader, till en bråkdel av Astras pris. Det finns dock en hake som betyder mer än alla benchmarktester: Argon är ännu inte allmänt tillgänglig. Google rullar först ut den till granskade cybersäkerhetsteam, utan datum för utvecklare eller konsumenter.

Sammanfattning

  • I Googles egen benchmarktabell slår Gemini 4 Argon GPT-6 Astra på de flesta rader, med fokus på juridik, finans och affärsarbetsflöden.
  • GPT-6 Astra behåller övertaget på de mest avancerade mjukvaruingenjörsuppgifterna, vetenskapligt terminalarbete och datoranvändning.
  • Argons introduktionspris är en femtedel av Astras, och dess ordinarie pris är fortfarande mindre än hälften.
  • Men du kan inte använda Argon än: åtkomsten är begränsad till Googles betrodda cyberförsvarare, med betalande API-kunder och AI Ultra-prenumeranter härnäst.
  • Alltså: välj GPT-6 Astra om du behöver en frontlinjemodell i produktion idag.

Vad är Gemini 4 Argon?

Gemini 4 Argon är Google DeepMinds nya frontlinjemodell, presenterad i slutet av september. Det är den första modellen i Gemini 4-generationen.

Google byggde Argon för att klara djup förmåga till resonemang över långa, flerstegsuppgifter. Det stöds av en höjd utdata­gräns till 1M tokens så att modellen kan resonera igenom ett svårt problem i ett enda körningstillfälle.

Vad är GPT-6 Astra?

GPT-6 Astra är OpenAI:s flaggskeppsmodell, släppt i början av september. Den ligger överst i GPT-6-familjen ovanför GPT-6.1 Sol och GPT-6 Luna.

OpenAI positionerar den som sin mest kapabla modell för de mest krävande uppgifterna, från komplext resonemang och kodning till datoranvändning och forskning.

Gemini 4 Argon vs GPT-6 Astra: Direkt jämförelse

Av de 19 benchmarktester i Googles lanseringstabell får Argon högre poäng än Astra på 14, Astra vinner 4 och ett är oavgjort. Alla kommer från Googles egen tabell, så läs dem som Googles argument för Argon snarare än en oberoende ranking. Jag har bantat ned tabellen något för att visa de enligt mig mest välkända, intressanta och relevanta benchmarktesterna för den här lanseringen.

Funktion Gemini 4 Argon GPT-6 Astra
Vals Index 68.9% 63.1%
AutomationBench 51.3% 41.4%
Vals Finance Agent v2 65.4% 53.5%
Harvey's Legal Agent Benchmark 19.6% 5.4%
DeepSWE v1.1 77.9% 74.1%
FrontierSWE v2 55.0% 65.5%
Terminal-bench 4.0 57.4% 58.2%
Terminal-Bench Science 0.1 57.6% 68.1%
OSWorld-2.0 (offline-delmängd) 69.2% 72.6%
Max antal utdata-tokens 1M 128K
Tillgänglighet Endast betrodda cyberförsvarare Allmänt tillgänglig

Varje dimension nedan bär upp resten av tabellen.

Kvalificerat arbete: juridik, finans och affärsarbetsflöden

Här är Argons försprång som störst, och här siktade Google sin lansering.

På Harvey's Legal Agent Benchmark, som testar juridisk research och upprättande av dokument, får Argon 19,6% mot Astras 5,4%. Det är en låg poäng för båda, men mer än tre gånger så många slutförda uppgifter är den största relativa skillnaden i hela tabellen.

Mönstret håller i sig inom finansresearch och affärsautomatisering, där Argon leder med ungefär 10 till 12 poäng. Om påståendena håller när folk kan använda den är Argon den starkare modellen för dokumenttungt juridiskt och finansiellt arbete.

Kodning och mjukvaruingenjörskap

Kodning är delat, och det beror på vilken typ av ingenjörsarbete du menar.

Argon leder DeepSWE v1.1, som testar långsiktiga uppgifter i verkliga kodbaser, och den går om Astra på Vibe Code Bench, som bedömer byggande av fungerande appar.

Astra vinner tydligt på FrontierSWE v2, och de två ligger inom en poäng på Terminal-bench 4.0.

Googles egna exempel lutar åt stora migreringar, inklusive C och C++ till Rust över Googles kodbaser.

För det svåraste ingenjörsbenchmarktestet i tabellen ligger dock Astra fortfarande före.

Lång kontext och visuell förståelse

Argon drar ifrån när indata blir längre.

På GraphWalks, som testar resonemang över grafstrukturer utspridda över en lång kontext, ligger de två nära upp till 128K tokens, men från 256K till 1M tokens får Argon högre poäng.

Argon leder också på LVBench för förståelse av långa videor, medan diagramtolkning på Chartography är nära oavgjort.

För alla som matar in hela avtal, kodbaser eller inspelningar i en modell är detta den mest praktiska skillnaden efter tillgänglighet.

Vetenskap, matematik och datoranvändning

Astra står starkt i vetenskapligt terminalarbete och leder Terminal-Bench Science 0.1 med mer än 10 poäng. Argon leder LABBench 2, ett biologiskt forskningsbenchmark, och RiemannBench i matematik. När det gäller datoranvändning leder Astra OSWorld-2.0 medan Argon leder Agent's Last Exam, så ingen äger den här kategorin.

Tillgänglighet och säkerhet

Astra är den du kan driftsätta idag. Argon är för närvarande begränsad till Googles Fairwind-program för betrodda cyberförsvarare samt Googles interna team, och Google säger att betalande API-kunder och Google AI Ultra-prenumeranter kommer härnäst utan att ange datum.

Argons cyberhistoria skär också åt båda håll. Google släpper den till granskade försvarare utan cyberräcken, och den delar förstaplatsen med Astra på CWE-bench v1, som testar åtgärdande av verkliga säkerhetssårbarheter.

För alla andra säger Google att Argon kommer att neka skadliga cyber- och CBRN-förfrågningar och kör monitorer som kan stoppa exekvering när modellen överskrider användarens avsikt.

Prissättning: vad du faktiskt betalar

Argon kostar en femtedel av Astra till introduktionspriset och mindre än hälften till ordinarie pris, men Google har inte sagt hur länge introduktionspriset gäller.

Tokenpriser sida vid sida

Pris Gemini 4 Argon (introduktion) Gemini 4 Argon (ordinarie) GPT-6 Astra
Indata, per 1M tokens $2.00 $4.00 $10.00
Utdata, per 1M tokens $10.00 $20.00 $50.00
Läsning av cachad indata, per 1M tokens $0.10 (95% rabatt på indata) Ej publicerat $1.00
Tillägg för lång kontext Ej publicerat Ej publicerat Över 272K indata-tokens: 2x indata och cache, 1,5x utdata för hela förfrågan

Multipeln är densamma på in- och utdata: 0,2x Astra till introduktionspriser och 0,4x till ordinarie priser. Båda leverantörerna debiterar resonemang som utdata, vilket spelar större roll för Argon, eftersom Google höjde dess utdata­gräns till 1M tokens just för att den ska kunna tänka längre.

Även till ordinarie priser landar Argon klart under hälften av Astras kostnad. Den öppna frågan är långa promptar, där endast Astra har publicerat sin prissättning.

Vad en verklig arbetsbelastning kostar

Arbetsbelastning Gemini 4 Argon (intro) Gemini 4 Argon (ordinarie) GPT-6 Astra
Balanserad assistent: 1M in / 250K ut $4.50 $9.00 $22.50
Återhämtning, varje förfrågan under 272K: 10M in / 1M ut $30 $60 $150
Återhämtning, varje förfrågan över 272K: 10M in / 1M ut Ej publicerat Ej publicerat $275

Varje summa är (volym ÷ 1M) × pris, summerat över in- och utdata, till ordinarie priser.

  • Balanserad assistent: Argon sparar $18 per månad (80%) till introduktionspriser och $13,50 (60%) till ordinarie priser.
  • Återhämtning under 272K: samma 80% och 60% besparingar, i en skala där de börjar märkas: $120 eller $90 per månad.
  • Återhämtning över 272K: Astras tillägg höjer kostnaden till $275. Google har inte sagt om Argon har ett nivåpris för lång kontext, så detta är raden att kolla när Argons prissida går live.

De två leverantörerna använder olika tokenizers och ingen har publicerat tokenantal för en gemensam arbetsbelastning, så betrakta dessa summor som en prisjämförelse snarare än en faktura.

När ska du välja Gemini 4 Argon vs GPT-6 Astra

För tillfället avgörs valet av tillgänglighet, inte benchmarktester: Astra är allmänt tillgänglig och Argon är begränsad till granskade cyberförsvarare. När Argon öppnar upp kommer dess prisfaktor på 0,2x till 0,4x göra den till standardvalet att testa för kunskapsarbete.

Välj Gemini 4 Argon om...

  • Ditt arbete är juridisk research, finansiell analys eller affärsautomatisering. Det är där den har störst försprång i Googles tabell, och gapet inom juridik är störst av alla.
  • Du matar in väldigt långa indata. Den håller upp betydligt bättre än Astra för resonemang över 256K till 1M tokens och leder på långa videor.
  • Priset spelar roll på frontkvalitet. Även till ordinarie priser kostar den klart under hälften av Astra per token.

Välj GPT-6 Astra om...

  • Du behöver den idag. Astra finns i ChatGPT, OpenAI API, Azure, Bedrock, GitHub Copilot och OpenRouter, medan Argon ännu inte har något publikt API.
  • Ditt svåraste arbete är mjukvaruingenjörskap eller vetenskaplig databehandling. Den leder Argon på FrontierSWE v2 och Terminal-Bench Science med mer än 10 poäng vardera.
  • Du kör datoranvändningsagenter i skrivbordsappar. Den leder OSWorld-2.0, även om Argon vinner Agent's Last Exam, så testa på dina egna uppgifter.

Avslutande tankar

Om du behöver en frontlinjemodell den här veckan är GPT-6 Astra alternativet. Om ditt arbete handlar om juridik, finans eller analys av långa dokument, och du kan vänta, planera att testa Gemini 4 Argon samma dag den öppnar upp. Vi håller dig uppdaterad exakt när det blir, om du prenumererar på The Median, vårt veckobrev:

Den här jämförelsen, Argon mot Astra, är intressant. Google har lanserat Argon, tillsammans med en benchmarktabell som visar att den slår OpenAI på de flesta rader, med ett pris som underbjuder Astra. Men det finns också inget sätt för de flesta att använda den.

Google satsar på att försprånget håller tills åtkomst kommer.

Vanliga frågor

Är Gemini 4 Argon bättre än GPT-6 Astra?

I Googles egen benchmarktabell får Gemini 4 Argon högre poäng än GPT-6 Astra på 14 av 19 tester, med de största försprången inom juridik, finans, affärsautomatisering och arbete med lång kontext. GPT-6 Astra leder på FrontierSWE v2, Terminal-Bench Science 0.1, OSWorld-2.0 och Terminal-bench 4.0. Alla poäng kommer från Google, så oberoende tester behövs fortfarande.

Kan jag använda Gemini 4 Argon redan nu?

Inte om du inte är med i Googles Fairwind-program för betrodda cyberförsvarare. Google säger att betalande API-kunder och Google AI Ultra-prenumeranter får åtkomst härnäst, men de har inte gett något datum eller publicerat ett API-modell-ID.

Hur mycket kostar Gemini 4 Argon jämfört med GPT-6 Astra?

Gemini 4 Argon lanseras till ett introduktionspris på $2 per miljon indata-tokens och $10 per miljon utdata-tokens, som därefter stiger till $4 respektive $20. GPT-6 Astra kostar $10 och $50, så Argon är en femtedel av Astras pris till introduktionspriser och 40% till ordinarie priser. Google har inte sagt hur länge introduktionsperioden varar.

Vilken är bättre för kodning, Gemini 4 Argon eller GPT-6 Astra?

Det är delat. Gemini 4 Argon leder DeepSWE v1.1 och Vibe Code Bench i Googles tabell, medan GPT-6 Astra leder FrontierSWE v2 med cirka 10 poäng och går om Argon på Terminal-bench 4.0. För de svåraste ingenjörsuppgifterna har Astra för närvarande det starkare publicerade resultatet.

Vad är utdata­gränsen för Gemini 4 Argon?

Google höjde Gemini 4 Argons utdata­gräns till 1M tokens, upp från 64K på tidigare Gemini-modeller, så att den kan resonera igenom långa problem i ett enda körningstillfälle. GPT-6 Astras maximala utdata är 128K tokens.

Ämnen