ข้ามไปยังเนื้อหาหลัก

Gemini 4 Argon vs. GPT-6 Astra: เกณฑ์วัดผล ราคา และวิธีเลือกใช้

ตารางของ Google ชี้ว่า Gemini 4 Argon นำหน้า GPT-6 Astra ในงานกฎหมาย การเงิน และบริบทยาว ด้วยราคาเพียงหนึ่งในห้า ขณะเดียวกัน Astra ยังนำในงานโค้ดระดับยาก และเป็นตัวที่ใช้งานได้ทันที
อัปเดตแล้ว 2 ต.ค. 2569  · 8 นาที อ่าน

สำรวจด้วย AI

ChatGPTClaudePerplexity

Google ประกาศเปิดตัว Gemini 4 Argon ช่วงปลายเดือนกันยายน Argon เป็นโมเดล Gemini 4 ตัวแรกของ Google และเป็นแนวหน้ารุ่นใหม่ เปิดตัวถัดจาก GPT-6 Astra ของ OpenAI เพียงสี่สัปดาห์ ซึ่งเป็นเรือธงรุ่นใหม่ของ OpenAI ตั้งแต่ต้นกันยายน

ตารางเปิดตัวของ Google จัดให้ Argon นำหน้า Astra ในหลายหัวข้อ ด้วยราคาเพียงเสี้ยวเดียวของ Astra แต่มีข้อแม้สำคัญยิ่งกว่าเกณฑ์วัดผลใด ๆ: ตอนนี้ Argon ยังไม่เปิดให้ใช้งานทั่วไป Google เริ่มปล่อยให้ทีมความปลอดภัยไซเบอร์ที่ผ่านการคัดกรองก่อน โดยยังไม่มีกำหนดสำหรับนักพัฒนาและผู้ใช้ทั่วไป

สรุปสั้น ๆ

  • ในตารางเกณฑ์วัดผลของ Google เอง Gemini 4 Argon ชนะ GPT-6 Astra ในหลายหัวข้อ โดดเด่นด้านงานกฎหมาย การเงิน และเวิร์กโฟลว์ธุรกิจ
  • GPT-6 Astra ยังได้เปรียบในงานวิศวกรรมซอฟต์แวร์ที่ยากมาก งานเชิงวิทยาศาสตร์บนเทอร์มินัล และการใช้งานคอมพิวเตอร์
  • ราคาเปิดตัวของ Argon อยู่ที่หนึ่งในห้าของ Astra และราคาแบบมาตรฐานก็ยังต่ำกว่าครึ่ง
  • แต่อีกฝ่ายคือ ยังใช้ Argon ไม่ได้: จำกัดเฉพาะผู้ปกป้องไซเบอร์ที่ Google เชื่อถือ โดยลูกค้า API แบบชำระเงินและผู้สมัครใช้ AI Ultra จะตามมา
  • ดังนั้น หากต้องใช้โมเดลแนวหน้าพร้อมใช้งานในโปรดักชันวันนี้ ให้เลือก GPT-6 Astra

Gemini 4 Argon คืออะไร?

Gemini 4 Argon คือโมเดลแนวหน้าตัวใหม่ของ Google DeepMind ที่ประกาศช่วงปลายเดือนกันยายน เป็นโมเดลตัวแรกในเจเนอเรชัน Gemini 4

Google พัฒนา Argon เพื่อรองรับการให้เหตุผลเชิงลึกบนงานหลายขั้นตอนที่ยาวนาน โดยเพิ่มขีดจำกัดเอาต์พุตเป็น 1M โทเค็น เพื่อให้โมเดลสามารถไล่แก้ปัญหายาก ๆ ได้ครบในครั้งเดียว

GPT-6 Astra คืออะไร?

GPT-6 Astra คือโมเดลเรือธงของ OpenAI เปิดตัวช่วงต้นเดือนกันยายน อยู่บนสุดของตระกูล GPT-6 เหนือ GPT-6.1 Sol และ GPT-6 Luna

OpenAI วางตำแหน่งให้เป็นโมเดลที่ทรงความสามารถที่สุดสำหรับงานที่โหดที่สุด ตั้งแต่การให้เหตุผลและการเขียนโค้ดเชิงซับซ้อน ไปจนถึงการใช้คอมพิวเตอร์และงานวิจัย

Gemini 4 Argon vs GPT-6 Astra: เปรียบเทียบแบบตัวต่อตัว

จาก 19 เกณฑ์วัดผลในตารางเปิดตัวของ Google Argon ได้คะแนนสูงกว่า Astra 14 รายการ Astra ชนะ 4 รายการ และเสมอ 1 รายการ ทั้งหมดมาจากตารางของ Google เอง จึงควรอ่านในฐานะข้อเสนอของ Google เพื่อสนับสนุน Argon มากกว่าการจัดอันดับอิสระ ที่นี่คัดลงมาเหลือชุดที่คุ้นหู น่าสนใจ และเกี่ยวข้องที่สุดกับรุ่นนี้

คุณสมบัติ Gemini 4 Argon GPT-6 Astra
Vals Index 68.9% 63.1%
AutomationBench 51.3% 41.4%
Vals Finance Agent v2 65.4% 53.5%
Harvey's Legal Agent Benchmark 19.6% 5.4%
DeepSWE v1.1 77.9% 74.1%
FrontierSWE v2 55.0% 65.5%
Terminal-bench 4.0 57.4% 58.2%
Terminal-Bench Science 0.1 57.6% 68.1%
OSWorld-2.0 (offline subset) 69.2% 72.6%
จำนวนโทเค็นเอาต์พุตสูงสุด 1M 128K
การเปิดให้ใช้งาน เฉพาะผู้ปกป้องไซเบอร์ที่เชื่อถือได้ เปิดให้ใช้งานทั่วไป

รายละเอียดในแต่ละมิติด้านล่างสรุปสาระจากตารางที่เหลือ

งานความรู้: กฎหมาย การเงิน และเวิร์กโฟลว์ธุรกิจ

นี่คือตำแหน่งที่ Argon นำห่างที่สุด และเป็นจุดที่ Google โฟกัสในการเปิดตัว

บน Harvey's Legal Agent Benchmark ซึ่งทดสอบการค้นคว้ากฎหมายและการร่างเอกสาร Argon ได้ 19.6% เทียบกับ Astra ที่ 5.4% แม้จะเป็นคะแนนต่ำทั้งคู่ แต่การทำงานสำเร็จมากกว่าสามเท่าเป็นช่องว่างสัมพัทธ์ที่ใหญ่ที่สุดในทั้งตาราง

รูปแบบนี้ปรากฏชัดในงานวิจัยการเงินและระบบอัตโนมัติธุรกิจ ซึ่ง Argon นำหน้าโดยประมาณ 10–12 แต้ม หากข้ออ้างนี้ยังยืนเมื่อมีคนได้ใช้งานจริง Argon จะเป็นโมเดลที่แข็งแรงกว่าในงานเอกสารหนาแน่นด้านกฎหมายและการเงิน

การเขียนโค้ดและวิศวกรรมซอฟต์แวร์

งานโค้ดเป็นภาพผสม และขึ้นกับว่างานวิศวกรรมแบบไหน

Argon นำใน DeepSWE v1.1 ที่ทดสอบงานระยะยาวในโค้ดเบสจริง และเฉือนนำ Astra บน Vibe Code Bench ที่ให้คะแนนการสร้างแอปที่ใช้งานได้

Astra ชนะชัดเจนใน FrontierSWE v2 และทั้งคู่ห่างกันไม่ถึงหนึ่งแต้มบน Terminal-bench 4.0

ตัวอย่างของ Google เองเอนเอียงไปที่งานย้ายระบบขนาดใหญ่ รวมถึงการแปลง C และ C++ เป็น Rust ทั่วโค้ดเบสของ Google

แต่สำหรับเกณฑ์วิศวกรรมที่ยากที่สุดในตาราง Astra ยังนำอยู่

บริบทยาวและความเข้าใจเชิงภาพ

Argon ทิ้งห่างเมื่ออินพุตยาวขึ้น

บน GraphWalks ซึ่งทดสอบการให้เหตุผลบนโครงสร้างกราฟที่กระจายอยู่ในบริบทยาว ทั้งสองใกล้เคียงกันถึง 128K โทเค็น แต่ตั้งแต่ 256K ถึง 1M โทเค็น Argon ได้คะแนนสูงกว่า

Argon ยังนำใน LVBench สำหรับความเข้าใจวิดีโอยาว ขณะที่การอ่านกราฟบน Chartography ใกล้เคียงกับผลเสมอ

สำหรับใครที่ป้อนสัญญาทั้งฉบับ โค้ดเบสทั้งชุด หรือไฟล์บันทึกยาว ๆ เข้าสู่โมเดล นี่คือความต่างเชิงปฏิบัติที่สำคัญที่สุดรองจากการเปิดให้ใช้งาน

วิทยาศาสตร์ คณิตศาสตร์ และการใช้งานคอมพิวเตอร์

Astra รักษาความเหนือชั้นในงานเชิงวิทยาศาสตร์บนเทอร์มินัล นำหน้า Terminal-Bench Science 0.1 มากกว่า 10 แต้ม Argon นำใน LABBench 2 ซึ่งเป็นเกณฑ์วัดผลวิจัยชีววิทยา และ RiemannBench ในคณิตศาสตร์ ส่วนการใช้งานคอมพิวเตอร์ Astra นำ OSWorld-2.0 ขณะที่ Argon นำ Agent's Last Exam จึงยังไม่มีใครครองหมวดนี้

การเปิดให้ใช้งานและความปลอดภัย

Astra เป็นตัวเลือกที่นำไปใช้งานได้วันนี้ ส่วน Argon ยังจำกัดอยู่ใน Fairwind Program ของ Google สำหรับผู้ปกป้องไซเบอร์ที่เชื่อถือได้ รวมถึงทีมภายในของ Google โดย Google ระบุว่าลูกค้า API แบบชำระเงินและผู้สมัครใช้ Google AI Ultra จะเป็นกลุ่มถัดไป แต่ไม่ระบุวัน

ด้านไซเบอร์ของ Argon ก็มีสองด้าน Google ปล่อยให้ผู้ปกป้องที่ผ่านการคัดกรองใช้งานโดยไม่มีราวกั้นไซเบอร์ และทำคะแนนเทียบเท่า Astra เป็นอันดับหนึ่งใน CWE-bench v1 ซึ่งทดสอบการแก้ช่องโหว่ความปลอดภัยจริง

สำหรับผู้ใช้ทั่วไป Google ระบุว่า Argon จะปฏิเสธคำขอที่เป็นอันตรายด้านไซเบอร์และ CBRN และมีระบบเฝ้าระวังที่สามารถหยุดการทำงานเมื่อโมเดลเกินเจตนาของผู้ใช้

ราคา: สิ่งที่ต้องจ่ายจริง

Argon มีราคาเพียงหนึ่งในห้าของ Astra ในช่วงราคาเปิดตัว และต่ำกว่าครึ่งในราคาแบบมาตรฐาน แต่ Google ยังไม่ระบุว่าราคาเปิดตัวจะนานเท่าใด

อัตราโทเค็นแบบเคียงข้าง

อัตรา Gemini 4 Argon (ช่วงเปิดตัว) Gemini 4 Argon (มาตรฐาน) GPT-6 Astra
อินพุต ต่อ 1M โทเค็น $2.00 $4.00 $10.00
เอาต์พุต ต่อ 1M โทเค็น $10.00 $20.00 $50.00
อ่านอินพุตจากแคช ต่อ 1M โทเค็น $0.10 (ลด 95% จากอินพุต) ไม่เปิดเผย $1.00
ค่าบริการบริบทยาว ไม่เปิดเผย ไม่เปิดเผย เกิน 272K โทเค็นอินพุต: คิด 2x อินพุตและแคช และ 1.5x เอาต์พุตทั้งคำขอ

ตัวคูณอัตราเหมือนกันทั้งอินพุตและเอาต์พุต: 0.2x เทียบกับ Astra ในช่วงเปิดตัว และ 0.4x ในอัตรามาตรฐาน ผู้ให้บริการทั้งสองคิดค่าการให้เหตุผลเป็นเอาต์พุต ซึ่งสำคัญกับ Argon มากกว่า เพราะ Google เพิ่มขีดจำกัดเอาต์พุตเป็น 1M โทเค็นเพื่อให้คิดได้นานขึ้น

แม้ในอัตรามาตรฐาน Argon ก็ยังมีต้นทุนต่ำกว่าครึ่งของ Astra คำถามปลายเปิดคือพรอมต์ยาว ๆ ซึ่งขณะนี้มีเพียง Astra ที่เปิดเผยราคา

ต้นทุนงานจริงเป็นเท่าใด

เวิร์กโหลด Gemini 4 Argon (เปิดตัว) Gemini 4 Argon (มาตรฐาน) GPT-6 Astra
ผู้ช่วยสมดุล: อินพุต 1M / เอาต์พุต 250K $4.50 $9.00 $22.50
ดึงค้นข้อมูล คำข้อต่ำกว่า 272K: อินพุต 10M / เอาต์พุต 1M $30 $60 $150
ดึงค้นข้อมูล คำข้อเกิน 272K: อินพุต 10M / เอาต์พุต 1M ไม่เปิดเผย ไม่เปิดเผย $275

ยอดรวมคำนวณจาก (ปริมาณ ÷ 1M) × อัตรา แล้วรวมอินพุตและเอาต์พุต ที่อัตรามาตรฐาน

  • ผู้ช่วยสมดุล: Argon ประหยัด $18 ต่อเดือน (80%) ในราคาเปิดตัว และ $13.50 (60%) ในอัตรามาตรฐาน
  • ดึงค้นต่ำกว่า 272K: อัตราประหยัด 80% และ 60% เช่นกัน ในสเกลที่เริ่มเห็นผล: $120 หรือ $90 ต่อเดือน
  • ดึงค้นเกิน 272K: ค่าบริการส่วนเกินของ Astra ดันต้นทุนเป็น $275 Google ยังไม่บอกว่า Argon มีชั้นราคาบริบทยาวหรือไม่ จึงเป็นแถวที่ควรกลับมาตรวจเมื่อหน้าอัปเดตราคา Argon เปิด

ทั้งสองผู้ให้บริการใช้ตัวนับโทเค็นต่างกัน และยังไม่มีการเปิดเผยจำนวนโทเค็นบนงานเดียวกัน จึงควรมองยอดเหล่านี้เป็นการเทียบอัตรามากกว่าบิลจริง

ควรเลือก Gemini 4 Argon หรือ GPT-6 Astra เมื่อใด

ตอนนี้ ประเด็นชี้ขาดคือการเปิดให้ใช้งาน ไม่ใช่เกณฑ์วัดผล: Astra เปิดให้ใช้งานทั่วไป ขณะที่ Argon จำกัดเฉพาะผู้ปกป้องไซเบอร์ที่ผ่านการคัดกรอง เมื่อ Argon เปิดกว้าง ตัวคูณราคา 0.2x ถึง 0.4x จะทำให้เป็นตัวตั้งต้นสำหรับงานความรู้

เลือก Gemini 4 Argon หาก...

  • งานหลักคือวิจัยกฎหมาย วิเคราะห์การเงิน หรือระบบอัตโนมัติธุรกิจ นี่คือหัวข้อที่นำห่างที่สุดในตารางของ Google และช่องว่างด้านกฎหมายก็กว้างที่สุด
  • ต้องป้อนอินพุตที่ยาวมาก ให้เหตุผลข้าม 256K ถึง 1M โทเค็นได้ดีกว่า Astra อย่างชัดเจน และนำหน้าในวิดีโอยาว
  • ต้องการคุณภาพระดับแนวหน้าที่ราคามีผล แม้ในอัตรามาตรฐาน ราคาต่อโทเค็นยังต่ำกว่าครึ่งของ Astra

เลือก GPT-6 Astra หาก...

  • ต้องใช้งานวันนี้ Astra มีใน ChatGPT, OpenAI API, Azure, Bedrock, GitHub Copilot และ OpenRouter ขณะที่ Argon ยังไม่มี API สาธารณะ
  • งานที่ยากที่สุดคือวิศวกรรมซอฟต์แวร์หรือคอมพิวติ้งเชิงวิทยาศาสตร์ นำหน้า Argon ใน FrontierSWE v2 และ Terminal-Bench Science มากกว่า 10 แต้มทั้งคู่
  • ต้องใช้งานเอเจนต์ที่ควบคุมแอปบนเดสก์ท็อป นำหน้าใน OSWorld-2.0 แม้ Argon จะชนะ Agent's Last Exam ดังนั้นควรทดสอบกับงานของตนเอง

ข้อคิดทิ้งท้าย

หากต้องใช้โมเดลแนวหน้าในสัปดาห์นี้ GPT-6 Astra คือทางเลือก หากงานเป็นกฎหมาย การเงิน หรือวิเคราะห์เอกสารยาว และสามารถรอได้ ควรเตรียมทดสอบ Gemini 4 Argon ทันทีที่เปิดใช้งาน สมัครรับ The Median จดหมายข่าวรายสัปดาห์เพื่ออัปเดต:

การเปรียบเทียบครั้งนี้ Argon ปะทะ Astra น่าสนใจ Google เปิดตัว Argon พร้อมตารางเกณฑ์วัดผลที่ชี้ว่าชนะ OpenAI ในหลายหัวข้อ ด้วยราคาที่ต่ำกว่า Astra อย่างมาก แต่ในอีกด้าน คนส่วนใหญ่ก็ยังไม่มีทางได้ใช้

Google กำลังเดิมพันว่าความได้เปรียบนี้จะอยู่จนกว่าจะเปิดให้เข้าถึง

คำถามที่พบบ่อย

Gemini 4 Argon ดีกว่า GPT-6 Astra หรือไม่?

ในตารางเกณฑ์วัดผลของ Google เอง Gemini 4 Argon ได้คะแนนสูงกว่า GPT-6 Astra ใน 14 จาก 19 เกณฑ์ นำหน้ามากที่สุดในงานกฎหมาย การเงิน ระบบอัตโนมัติธุรกิจ และงานบริบทยาว GPT-6 Astra นำใน FrontierSWE v2, Terminal-Bench Science 0.1, OSWorld-2.0 และ Terminal-bench 4.0 คะแนนทั้งหมดมาจาก Google จึงยังต้องการการทดสอบอิสระเพิ่มเติม

ตอนนี้ใช้ Gemini 4 Argon ได้หรือยัง?

ยังไม่ได้ เว้นแต่จะอยู่ใน Fairwind Program ของ Google สำหรับผู้ปกป้องไซเบอร์ที่เชื่อถือได้ Google ระบุว่าลูกค้า API แบบชำระเงินและผู้สมัครใช้ Google AI Ultra จะได้สิทธิต่อไป แต่ยังไม่มีกำหนดหรือเผยแพร่รหัสโมเดล API

Gemini 4 Argon มีราคาเทียบกับ GPT-6 Astra อย่างไร?

Gemini 4 Argon เปิดตัวที่ $2 ต่อหนึ่งล้านโทเค็นอินพุต และ $10 ต่อหนึ่งล้านโทเค็นเอาต์พุต และจะปรับเป็น $4 และ $20 ภายหลัง ส่วน GPT-6 Astra มีราคา $10 และ $50 ดังนั้น Argon มีราคาเพียงหนึ่งในห้าของ Astra ในช่วงเปิดตัว และ 40% ในอัตรามาตรฐาน Google ยังไม่ระบุระยะเวลาช่วงราคาเปิดตัว

ตัวไหนดีกว่าสำหรับการเขียนโค้ด ระหว่าง Gemini 4 Argon กับ GPT-6 Astra?

เป็นภาพผสม Gemini 4 Argon นำใน DeepSWE v1.1 และ Vibe Code Bench ในตารางของ Google ขณะที่ GPT-6 Astra นำใน FrontierSWE v2 ราว 10 แต้ม และเฉือน Argon ใน Terminal-bench 4.0 สำหรับงานวิศวกรรมที่ยากที่สุด ตอนนี้ Astra มีผลลัพธ์ที่แข็งแรงกว่า

ขีดจำกัดเอาต์พุตของ Gemini 4 Argon คือเท่าใด?

Google เพิ่มขีดจำกัดเอาต์พุตของ Gemini 4 Argon เป็น 1M โทเค็น จาก 64K ในรุ่น Gemini ก่อนหน้า จึงสามารถให้เหตุผลกับปัญหายาว ๆ ได้ในการรันครั้งเดียว ส่วนขีดจำกัดเอาต์พุตสูงสุดของ GPT-6 Astra คือ 128K โทเค็น

หัวข้อ