ข้ามไปยังเนื้อหาหลัก

Grok 4.6 เทียบกับ GPT-5.6 Sol: เกณฑ์ชี้วัด ราคา และการทดสอบลงมือทำ

Grok 4.6 และ GPT-5.6 Sol ทำคะแนน 61 เท่ากันบน Artificial Analysis Intelligence Index ดังนั้นการตัดสินใจจริงอยู่ที่รูปทรงต้นทุน ขนาดบริบท และจำนวนเทิร์นต่อภารกิจ
อัปเดตแล้ว 27 ส.ค. 2569  · 11 นาที อ่าน

สำรวจด้วย AI

ChatGPTClaudePerplexity

SpaceXAI เปิดตัว Grok 4.6 เมื่อวันที่ 12 สิงหาคม 2026 ราวหนึ่งเดือนหลัง OpenAI ปล่อยตระกูล GPT-5.6 ให้ใช้งานทั่วไปเมื่อ 9 กรกฎาคม ทั้งสองเปิดตัวด้วยแนวคิดคล้ายกัน: เอเจนต์ที่ทำงานยาวต่อเนื่องหลายขั้น และร่างงานเชิงโต้ตอบได้ดีขึ้นตั้งแต่รอบแรก Grok 4.6 มากับคำกล่าวอ้างว่าเสมอกับ GPT-5.6 Sol บน Artificial Analysis Intelligence Index ซึ่งเทียบรุ่นเอาต์พุต $6 กับรุ่น $20 แล้วท้าให้มองหาความต่าง

ในบทความนี้ จะเปรียบเทียบ Grok 4.6 และ GPT-5.6 Sol ด้านการโค้ดเชิงเอเจนต์ งานความรู้ระยะยาว การรับมือบริบท ตัวควบคุมการให้เหตุผล และราคา จากนั้นทดสอบงานสร้างที่ยากหนึ่งงานในเอเจนต์โค้ดตัวเดียวกัน สำหรับบทความเชิงลึกของแต่ละรุ่น ดูได้ที่ คู่มือ Grok 4.6 และ คู่มือ GPT-5.6 Sol, Terra และ Luna.

สรุปสั้น (TL;DR)

  • ความสามารถใกล้เคียงกัน: ทั้งคู่ทำได้ 61 บน Artificial Analysis Intelligence Index และผลัดกันนำครึ่งต่อครึ่งในเกณฑ์โค้ดที่เผยแพร่
  • ราคาคือจุดต่าง และไม่ได้ต่างแบบคูณคงที่: Sol แพงกว่า 2 เท่าบนอินพุต แต่แพงกว่า 3.3 เท่าบนเอาต์พุต
  • ทั้งสองรุ่นคิดเพิ่มสำหรับพรอมป์ตยาว โดย Grok มีเกณฑ์ถึงก่อนที่ 200,000 โทเค็น เทียบกับของ Sol ที่ 272,000
  • ในการทดสอบสร้างจริง ทั้งสองส่งมอบซิมูเลชันที่ถูกต้องและเสถียร Sol ใช้ 3 เทิร์น; Grok ใช้ 14
  • เลือก Grok 4.6 หากโหลดงานเน้นการให้เหตุผลและการสร้างเอาต์พุตมาก; เลือก GPT-5.6 Sol หากต้องการหน้าต่างบริบท 1,050,000 โทเค็น วิศวกรรมที่เน้นเทอร์มินัล หรือจำนวนเทิร์นน้อยสุดจนได้ชิ้นงาน

Grok 4.6 คืออะไร?

Grok 4.6 คือรุ่นแนวหน้าของ SpaceXAI สำหรับการโค้ด งานเชิงเอเจนต์ และงานความรู้ เปิดตัวเมื่อ 12 สิงหาคม 2026 ต่อจาก Grok 4.5 โดยเน้นเอเจนต์ที่ทำงานยาวต่อเนื่องและงานโต้ตอบ-งานภาพที่ทะเยอทะยานยิ่งขึ้น SpaceXAI ระบุว่าสามารถตามงานซับซ้อนหลายขั้นได้ เช่น การวิจัยหัวข้อ ทำงานข้ามโค้ดเบส หรือแปลงไอเดียเป็นแอปใช้งานได้ การฝึกสอนเพิ่มข้อมูลการให้เหตุผลที่คัดสรรโดยโมเดล และการเรียนรู้แบบเสริมกำลังเชิงเอเจนต์ในงานปรับแต่งเคอร์เนล เว็บดีเวลอปเมนต์ และการออกแบบด้วยคอมพิวเตอร์

จุดเด่นคือท่าทีด้านราคา Grok 4.6 คงอัตราหัวข้อของ Grok 4.5 ที่ $2 และ $6 ต่อโทเค็นอินพุตและเอาต์พุต 1M ขณะเดียวกันทำคะแนนเพิ่ม 5 จุดบน Artificial Analysis Intelligence Index ซึ่ง Artificial Analysis ชี้ว่าไม่ปกติในแนวหน้า ที่โดยทั่วไปความสามารถที่เพิ่มขึ้นมักมาพร้อมการขึ้นราคา

ดูการทำงานจริงได้ใน บทเรียน API ของ Grok 4.6 ที่สอนสร้างเอเจนต์ใช้เครื่องมือแบบทีละขั้น และ บทเรียน Grok Build ที่สร้างโปรเจกต์แมชชีนเลิร์นนิงในเอเจนต์โค้ด โดย 4.6 เป็นโมเดลดีฟอลต์แล้ว เรายังครอบคลุมเอเจนต์ผู้ช่วยของ SpaceXAI ใน บทความ Grok Bot.

GPT-5.6 Sol คืออะไร?

GPT-5.6 Sol เป็นรุ่นธงของตระกูล GPT-5.6 ของ OpenAI ใช้งานทั่วไปตั้งแต่ 9 กรกฎาคม 2026 พร้อมกับ Terra สำหรับงานประจำ และ Luna เป็นชั้นราคาคุ้มค่า OpenAI วางตำแหน่ง Sol ด้วยความมีประสิทธิภาพพอๆ กับความสามารถดิบ: ผลลัพธ์ระดับแนวหน้าด้านการโค้ด งานความรู้ ความปลอดภัยไซเบอร์ และวิทยาศาสตร์ โดยใช้โทเค็นน้อยลง ความสามารถใช้คอมพิวเตอร์ที่แข็งแรงขึ้นทำให้ตรวจสอบและปรับแต่งผลลัพธ์ที่เรนเดอร์แล้ว แทนการสร้างเฉพาะโค้ดเบื้องหลัง

มีปุ่มปรับความสามารถใหม่ 2 แบบ ค่า max ให้เวลาโมเดลมากกว่า xhigh ในการให้เหตุผลและแก้ไข และ ultra ประสานเอเจนต์ 4 ตัวขนานกันเป็นดีฟอลต์ แลกค่าโทเค็นกับคะแนนที่ดีกว่าในเวลาจริงที่สั้นลง บน Terminal-Bench 2.1 Sol Ultra ทำได้ 91.9% เทียบกับ Sol ปกติ 88.8%

สำหรับงานลงมือทำ ลองดู บทเรียน Cursor Agent Mode ที่สร้าง REST API ด้วย GPT-5.6 Sol และ คู่มือ ChatGPT Work ที่รันเวิร์กโฟลว์วิทยาการข้อมูลแบบปลายทางถึงปลายทางบน GPT-5.6 หากอยากจับคู่ต่างไป เรายังเทียบกับรุ่นธงของ Anthropic ใน Claude Opus 5 vs GPT-5.6 Sol.

Grok 4.6 เทียบกับ GPT-5.6 Sol: เปรียบเทียบตัวต่อตัว

โดยสรุป ทั้งสองเป็นคู่คี่กันด้านความสามารถ แต่ต่างกันชัดเจนด้านราคา

Grok 4.6 ทำคะแนนเทียบเท่า Sol ด้านความฉลาดที่ราคาเอาต์พุตเพียงหนึ่งในสาม

เสมอกันที่ 61 บน Intelligence Index แบ่งผลเกณฑ์โค้ดกันคนละครึ่ง และ Sol แพงกว่า 3.3 เท่าบนเอาต์พุต

ฟีเจอร์ Grok 4.6 GPT-5.6 Sol
วันที่เปิดตัว 12 สิงหาคม 2026 9 กรกฎาคม 2026
AA Intelligence Index 61 61
ราคาอินพุต / เอาต์พุต ต่อ 1M โทเค็น $2 / $6 $4 / $20
หน้าต่างบริบท 500,000 โทเค็น 1,050,000 โทเค็น
เกณฑ์บริบทยาว 200,000 โทเค็น 272,000 โทเค็น
อัตราเหนือเกณฑ์นั้น $4 / $12 อินพุต 2x เอาต์พุต 1.5x
การตั้งค่าการให้เหตุผล Low, medium, high, xhigh None ถึง max และ ultra
API model ID grok-4.6 gpt-5.6-sol
วันที่ตัดความรู้ 1 กุมภาพันธ์ 2026 16 กุมภาพันธ์ 2026

เวิร์กโฟลว์การโค้ดและเชิงเอเจนต์

ตารางของ Cursor เทียบ Grok 4.6 ที่ high กับ GPT-5.6 Sol ที่ max ยังไม่ฟันธงผู้ชนะ Grok นำ CursorBench v3.2 ที่ 69.9% เทียบ 67.2% และ GDPval-AA v2 ที่ 1753 Elo เทียบ 1728 Sol ชนะ DeepSWE v1.1 ที่ 73% ต่อ 65.9% และ Terminal-Bench v3.0 ที่ 34.6% ต่อ 26%

เกณฑ์ชี้วัด Grok 4.6 (high) GPT-5.6 Sol (max) หมายเหตุ
AA Intelligence Index 61 61 คอมโพสิตจาก 9 เกณฑ์; เสมอ
CursorBench v3.2 69.9% 67.2% ฮาร์เนสเอเจนต์ของ Cursor เอง
DeepSWE v1.1 65.9% 73% งานระยะยาวในโค้ดเบสจริง
Terminal-Bench v3.0 26% 34.6% ทั้งคู่ต่ำ; คนละเวอร์ชันกับตัวเลข 2.1 ของ OpenAI
FrontierCode v1.1 Extended 61.3% 60.6% ต่างกันในระดับสัญญาณรบกวน
APEX-Agents 57.5% 56.7% ต่างกันในระดับสัญญาณรบกวน

อ่านช่องว่างเหล่านี้พร้อมเกลือเล็กน้อย:

  • การตั้งค่าความพยายามไม่ตรงกัน: Grok ที่ high, Sol ที่ max
  • บรรทัดจากบุคคลที่สามคือค่าสาธารณะหรือที่รายงานเองที่ดีที่สุด ไม่ใช่ฮาร์เนสเดียวกัน
  • Terminal-Bench v3.0 ในตารางของ Cursor ไม่ใช่ Terminal-Bench 2.1 ในโพสต์ของ OpenAI (Sol ได้ 88.8%) เป็นคนละเวอร์ชัน

Grok แข็งแรงกว่าในลูปเอเจนต์ภายใน IDE ส่วน Sol แข็งแรงกว่างานโค้ดเบสระยะยาวและบนคอมมานด์ไลน์

งานความรู้เชิงเอเจนต์ระยะยาว

Grok 4.6 นำ AA-Briefcase ชุดทดสอบงานความรู้ระยะยาวแบบไพรเวตของ Artificial Analysis ที่ 1577 Elo เทียบ Sol ที่ 1502 บน Harvey LAB การประเมินงานกฎหมาย ตัวเลขที่เผยแพร่คือ 15.8% เทียบ 2.5% ช่องว่าง 6 เท่า แต่ทั้งคู่ทำได้ต่ำในเชิงสัมบูรณ์ จึงควรอ่านเป็นสัญญาณเตือนมากกว่าข้อสรุป

Grok ยังทำได้ 50.7% บนสาขาธนาคารของชุดทดสอบการใช้เครื่องมือของ Artificial Analysis คะแนน 88.4% บน Terminal-Bench v2.1 อยู่ระดับเดียวกับโมเดลแถวหน้า แต่เป็น v2.1 ไม่ใช่แถว v3.0 ด้านบน

หน้าต่างบริบทและงานบริบทยาว

Sol ถือหน้าต่างได้ราวสองเท่า: 1,050,000 โทเค็น เทียบกับ 500,000 ของ Grok 4.6 และมีเพดานเอาต์พุต 128,000 โทเค็น ซึ่ง SpaceXAI ไม่ได้ระบุในข้อความ เหนือ 500K แล้วไม่มีตัวเทียบของ Grok

ทั้งคู่ปรับราคาใหม่เมื่อพรอมป์ตยาวก่อนถึงเพดาน และเกณฑ์ของ Grok มาก่อน:

  • Grok 4.6: หลัง 200,000 โทเค็น คิด 2x อินพุตและ 2x เอาต์พุตกับคำขอทั้งชุด
  • GPT-5.6 Sol: หลัง 272,000 โทเค็น คิด 2x อินพุต และ 1.5x เอาต์พุตกับคำขอทั้งชุด

ระหว่าง 200,000 ถึง 272,000 อัตราอินพุตมาเจอกันที่ $4 ขณะที่ Grok ยังคงถูกกว่าในเอาต์พุต แต่ช่องว่างแคบกว่าหัวข้อหลักบอกไว้

ตัวควบคุมความพยายามในการให้เหตุผล

Sol มีปุ่มให้ปรับมากกว่า: none ถึง max และ ultra ที่รันเอเจนต์ 4 ตัวขนานกัน Grok 4.6 ให้ค่า low, medium, high เป็นดีฟอลต์ และ xhigh การลด Sol ลงเป็น none สำหรับงานจัดประเภทที่ถูกลงมีประโยชน์ การกระโดดของ Ultra บน Terminal-Bench 2.1 จาก 88.8% เป็น 91.9% เป็นเรื่องจริง แต่ทั้งสองสุดขั้วคิดบิลเอาต์พุตแพงกว่า Grok 3.3 เท่า

เครื่องมือในตัว

Grok 4.6 มี function calling, การค้นเว็บ, ค้นหา X และรันโค้ด GPT-5.6 Sol เพิ่มการค้นหาไฟล์ สร้างภาพ ตัวตีความโค้ด เชลล์โฮสต์ apply patch การใช้คอมพิวเตอร์ และค้นหาเครื่องมือบน Responses API

Sol ยังมี Programmatic Tool Calling: โมเดลเขียนและรันโปรแกรมขนาดเล็กเพื่อประสานเครื่องมือและกรองผลลัพธ์กลาง แทนการส่งผลของทุกเครื่องมือย้อนกลับเข้าผ่านโมเดล

ราคา: ที่ต้องจ่ายจริง

ราคาคือความต่างที่ชัด และรูปทรงไม่ได้เป็นตัวคูณคงที่

อัตราโทเค็นเทียบกันข้างๆ

อัตรา Grok 4.6 GPT-5.6 Sol
อินพุต ต่อ 1M โทเค็น $2.00 $4.00
เอาต์พุต ต่อ 1M โทเค็น $6.00 $20.00
อ่านอินพุตจากแคช ต่อ 1M โทเค็น $0.50 $0.40
เกณฑ์บริบทยาว 200,000 โทเค็นของพรอมป์ต 272,000 โทเค็นอินพุต
เหนือเกณฑ์ อินพุตและเอาต์พุต 2x อินพุต 2x เอาต์พุต 1.5x
รุ่นเร็ว อินพุต / เอาต์พุต $4.00 / $12.00 ไม่มี

Sol แพงกว่า 2 เท่าบนอินพุตและ 3.3 เท่าบนเอาต์พุต ช่องว่างจึงกว้างขึ้นตามทุกอย่างที่โมเดลเขียน โทเค็นให้เหตุผลคิดที่อัตราเอาต์พุตทั้งคู่ อัตราอ่านจากแคชใกล้กัน ($0.50 เทียบ $0.40) แต่ SpaceXAI เตือนว่าหากไม่มี prompt_cache_key บน Responses API มักต้องจ่ายอินพุตเต็มเมื่อเซิร์ฟเวอร์แคชเย็น อ่านเพิ่มเติมได้ใน บทเรียน API ของ Grok 4.6.

ต้นทุนงานจริงเป็นเท่าไร

สูตรคือ (ปริมาณ ÷ 1M) × อัตรา บวกระหว่างอินพุตและเอาต์พุต ที่อัตรามาตรฐาน

เวิร์กโหลด Grok 4.6 GPT-5.6 Sol ต่างกัน
เน้นการสร้าง: 1M in / 4M out $26 $84 +$58 (223%)
ดึงข้อมูล ใต้เกณฑ์: 10M in / 1M out $26 $60 +$34 (131%)
ดึงข้อมูล เหนือเกณฑ์: 10M in / 1M out $52 $110 +$58 (112%)

งานเน้นการสร้างคือจุดที่ช่องว่างอัตราเอาต์พุตส่งผล แถวดึงข้อมูลทั้งสองมี 10M in / 1M out เหมือนกัน ต่างกันเพียงว่าแต่ละคำขอเกินทั้งสองเกณฑ์หรือไม่ ดังนั้นผลต่างระหว่างสองแถวนั้นคือค่าบวก Grok บิลเพิ่มจาก $26 เป็น $52 ในแถวนั้น Sol จาก $60 เป็น $110 เบี้ยสัมพัทธ์แคบลงจาก 131% เหลือ 112% แม้ช่องว่างเป็นเงินจะกว้างขึ้น ทั้งสองรายยังไม่ได้เผยปริมาณโทเค็นสำหรับงานร่วมกัน จึงควรอ่านเป็นการเทียบอัตรามากกว่าบิลจริง

ประสิทธิภาพของ Grok 4.6 และ GPT-5.6 Sol

เราให้ทั้งสองทำงานสร้างที่ยากหนึ่งงานในเอเจนต์โค้ดตัวเดียวกัน

การทดสอบ

ทดสอบให้ทั้งคู่สร้างซิมูเลชันฟิสิกส์ไฟล์เดี่ยว เพราะทั้งสองผู้พัฒนาระบุว่าทำงานเชิงโต้ตอบและงานภาพได้แข็งแรง ใช้พรอมป์ตเดียวกัน แบบไบต์ต่อไบต์ วางลงในแชตใหม่ในเวิร์กสเปซว่าง ลองครั้งเดียว ไม่มีการลองซ้ำ ไม่มีการกำกับกลางคัน

Build a single-file HTML page (inline CSS and JS, canvas, no build step, no external libraries, no network) that simulates a few dozen balls of varying sizes bouncing inside a slowly rotating square container, under gravity. The balls should collide with each other and with the container walls, and lose a little energy on each collision so the system settles rather than gaining energy over time. The container keeps rotating throughout, so the balls should slosh and re-pile as it turns.

Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions, make reasonable assumptions and note them briefly in a comment at the top of the file.

ทั้งคู่รันใน Cursor วันที่ 25 สิงหาคม 2026: Grok 4.6 ที่การให้เหตุผลระดับสูง GPT-5.6 Sol ที่การให้เหตุผลระดับสูง ผลลัพธ์อธิบายพวกมันในฐานะเอเจนต์ ไม่ใช่โมเดลเปล่า เน็ตเวิร์กถูกปฏิเสธสำหรับทั้งคู่

สิ่งที่ Grok 4.6 สร้าง

Grok ส่งไฟล์ index.html ที่ทำงานได้จริง ผ่านการรัน: ไฟล์เดียว เริ่มแอนิเมตทันที ไม่มีข้อผิดพลาดคอนโซลที่ไม่ได้จับ และยังรันอยู่หลัง 30 วินาที การกักในกล่องระหว่างหมุนยังคงอยู่ การชนลูกบอลกันเองดูสมเหตุผล และระบบสูญเสียพลังงานจนสงบลง แทนจะเร่งความเร็ว

ทั้งหมดใช้ 14 เทิร์น มีหลายรอบแก้ไขตัวเอง และยังขอสิทธิ์เข้าบราวเซอร์เพื่อตรวจงานตัวเอง ซึ่งเราปฏิเสธตามกติกาการทดสอบ

สิ่งที่ GPT-5.6 Sol สร้าง

Sol ก็ผ่านการรัน และได้คะแนน 5 เท่ากันในความถูกต้องทางฟิสิกส์และเสถียรภาพ ความเร็วหมุนของคอนเทนเนอร์ช้ากว่าของ Grok ทำให้การกระเพื่อมและการกองใหม่ตามหมุนดูตามได้ง่ายขึ้น และนี่คือแกนเดียวที่มันเหนือกว่าด้านคุณภาพภาพ

มันทำได้ใน 3 เทิร์น และโดยรวมเร็วกว่ามากเมื่อเทียบกับ Grok

ผลลัพธ์

ให้คะแนน 1 ถึง 5 ต่อแกน ประเมินโดยดูแต่ละซิมูเลชัน 30 วินาทีตามรูบริกที่เขียนก่อนการรัน

ตัววัด Grok 4.6 (high) GPT-5.6 Sol (high)
จำนวนเทิร์น 14 3
การรันได้ ผ่าน ผ่าน
ความถูกต้องทางฟิสิกส์ 5 5
เสถียรภาพตามเวลา 5 5
คุณภาพภาพ 4 5
คะแนนรวม 3.5 5

ที่ตัวชิ้นงานถือว่าเกือบเสมอ: ทั้งคู่ทำฟิสิกส์ถูกและคงเสถียร ความต่างคือความพยายาม Sol ไปถึงผลเดียวกันใน 3 เทิร์น เทียบกับ 14 ของ Grok ซึ่งทำให้คะแนนรวมของ Grok ลดเหลือ 3.5

อย่างไรก็ดี นี่คือ n=1 บนงานสร้างเชิงภาพ จึงอ่านเป็นเพียงหนึ่งข้อมูล ไม่ใช่เกณฑ์ และไม่ได้บอกอะไรเกี่ยวกับโค้ดเบสขนาดใหญ่หรือสายโซ่ดึงข้อมูลยาว

ควรเลือก Grok 4.6 หรือ GPT-5.6 Sol เมื่อใด

เมื่อความสามารถใกล้กัน การตัดสินใจจึงขึ้นกับรูปทรงเวิร์กโหลด ขนาดบริบท และความสำคัญของจำนวนเทิร์นเทียบกับต้นทุนต่อโทเค็น เลือก Grok เมื่อเอาต์พุตถูกพอจะครองบิล เลือก Sol เมื่อจำเป็นต้องใช้หน้าต่างใหญ่กว่าหรือเทิร์นน้อยกว่า

เลือก Grok เมื่อต้องการเอาต์พุตถูก เลือก Sol เมื่อต้องการบริบทใหญ่และเทิร์นน้อย

เลือก Grok 4.6 หาก...

  • เวิร์กโหลดของคุณเขียนเอาต์พุตมาก ที่ $6 ต่อ 1M โทเค็นเอาต์พุต เทียบกับ $20 ของ Sol เดือนที่เน้นการสร้างจะอยู่ที่ $26 แทน $84 และโทเค็นให้เหตุผลคิดที่อัตราเอาต์พุตเดียวกัน
  • พรอมป์ตอยู่ใต้ 200,000 โทเค็น ตรงนี้อัตรา $2 และ $6 ของ Grok ใช้เต็มจำนวน
  • งานเอเจนต์อยู่ใน IDE Grok นำ CursorBench v3.2 ที่ 69.9% และเป็นโมเดลดีฟอลต์ใน Grok Build
  • ให้ความสำคัญกับต้นทุนต่อโทเค็นมากกว่าจำนวนเทิร์น

เลือก GPT-5.6 Sol หาก...

  • ต้องใช้บริบทมากกว่า 500K โทเค็น หน้าต่าง 1,050,000 โทเค็นของ Sol ไม่มีตัวเทียบใน Grok 4.6
  • เอเจนต์ทำงานระยะยาวในรีโพจริง Sol ได้ 73% บน DeepSWE v1.1 เทียบกับ 65.9% ของ Grok เป็นช่องว่างด้านโค้ดที่กว้างสุดในทิศทางใดทิศหนึ่ง
  • จำนวนเทิร์นสำคัญกว่าราคาโทเค็น Sol จบงานสร้างฟิสิกส์ใน 3 เทิร์น เทียบกับ 14 ของ Grok
  • ต้องการควบคุมความพยายามได้ละเอียดกว่า Sol ปรับได้ตั้งแต่ none ถึง max และมี ultra

เริ่มต้นใช้ Grok 4.6 และ GPT-5.6 Sol อย่างไร

หากเรียกเอนด์พอยต์ที่เข้ากันได้กับ OpenAI อยู่แล้ว ทั้งสองรุ่นสลับได้ด้วยสตริงเดียว สตริงคือ grok-4.6 และ gpt-5.6-sol OpenAI ยังแมปนามแฝง gpt-5.6 ไปที่ Sol ด้วย

ช่องทาง Grok 4.6 GPT-5.6 Sol
API เจ้าของ xAI API OpenAI API
แอปสำหรับผู้ใช้ทั่วไป แอป Grok และ Grok.com ChatGPT
เอเจนต์โค้ด Grok Build (โมเดลดีฟอลต์), Cursor (ทุกแพลน) Codex, Cursor
เกตเวย์โมเดล OpenRouter, Vercel, Cloudflare OpenRouter, Vercel, Cloudflare
API model ID grok-4.6 gpt-5.6-sol

การใช้ Grok 4.6 และ GPT-5.6 Sol ในเอเจนต์โค้ด

ใน Cursor ทั้งสองมีให้เลือกในตัวเลือกโมเดล ซึ่งเป็นวิธีที่เราใช้รันทดสอบการสร้าง การสลับทำได้ด้วยตัวเลือก ไม่ต้องแก้คอนฟิก

ผ่าน API การสลับคือสตริงเดียว xAI ให้บริการเอนด์พอยต์ที่เข้ากันได้กับ OpenAI:

import os

from openai import OpenAI

client = OpenAI(
    api_key=os.environ["XAI_API_KEY"],
    base_url="https://api.x.ai/v1",  # drop this line for gpt-5.6-sol
)
response = client.responses.create(
    model="grok-4.6",  # swap for "gpt-5.6-sol"
    input="Find and fix the bug: function median(a){a.sort();return a[a.length/2]}",
)
print(response.output_text)

สำหรับการตั้งค่าเต็ม ดู บทเรียน API ของ Grok 4.6 บทเรียน Cursor Agent Mode และ บทเรียน Grok Build.

ข้อคิดส่งท้าย

หากบิลถูกครอบงำโดยเอาต์พุตและโทเค็นให้เหตุผล ใช้ Grok 4.6 การเสมอกันบน Intelligence Index ที่ราคาเอาต์พุตต่ำกว่าหนึ่งในสามคือคำตอบที่ง่ายที่สุด หากต้องการหน้าต่างระดับล้านโทเค็นหรืองานรีโพระยะยาว ใช้ GPT-5.6 Sol และยอมรับราคาพรีเมียม ตรวจดูว่าพรอมป์ตอยู่ด้านไหนของเกณฑ์คิดเพิ่ม 200,000 โทเค็นของ Grok ก่อนสลับ

ในการทดสอบ คำกล่าวอ้างของทั้งสองรุ่นยืนได้: ผ่านและได้ผลดี อย่างไรก็ตาม Sol เร็วกว่า Grok มากและใช้เพียงราว 20% ของจำนวนเทิร์นของ Grok ซึ่งสะท้อนช่องว่างที่มีนัย หากอยากลงมือเก่งในการรันโมเดลเหล่านี้ในเอเจนต์แทนการอ่าน แนะนำคอร์ส Software Development with Cursor

Grok 4.6 เทียบกับ GPT-5.6 Sol คำถามที่พบบ่อย

Grok 4.6 ดีกว่า GPT-5.6 Sol หรือไม่?

ไม่มีรุ่นใดชนะขาด ทั้งคู่เสมอกันที่ 61 บน Artificial Analysis Intelligence Index และผลัดกันนำราวครึ่งต่อครึ่งในเกณฑ์โค้ดที่เผยแพร่: Grok 4.6 ชนะ CursorBench v3.2 (69.9% เทียบ 67.2%) ส่วน GPT-5.6 Sol ชนะ DeepSWE v1.1 (73% เทียบ 65.9%) และ Terminal-Bench v3.0 (34.6% เทียบ 26%) ในการทดสอบสร้างซิมูเลชันฟิสิกส์ไฟล์เดียวของเรา ทั้งคู่สร้างซิมูเลชันที่ถูกต้องและเสถียร ความต่างคือความพยายาม: Sol จบใน 3 เทิร์น ขณะที่ Grok ใช้ 14

Grok 4.6 และ GPT-5.6 Sol ราคาเท่าไร?

Grok 4.6 มีราคา $2 ต่อโทเค็นอินพุต 1M และ $6 ต่อโทเค็นเอาต์พุต 1M ส่วน GPT-5.6 Sol อยู่ที่ $4 อินพุต และ $20 เอาต์พุต การอ่านอินพุตจากแคชอยู่ที่ $0.50 สำหรับ Grok และ $0.40 สำหรับ Sol ตัวคูณไม่คงที่: Sol แพงกว่า 2 เท่าบนอินพุต แต่แพงกว่า 3.3 เท่าบนเอาต์พุต ทำให้ช่องว่างกว้างขึ้นตามปริมาณที่โมเดลเขียน ทั้งคู่ยังคิดเพิ่มสำหรับพรอมป์ตยาว โดย Grok เริ่มที่ 200,000 โทเค็น (อินพุต $4 และเอาต์พุต $12) และ Sol เหนือ 272,000 โทเค็นอินพุต (อินพุต 2x เอาต์พุต 1.5x) ซึ่งใช้กับคำขอทั้งชุดทั้งสองกรณี

API model ID ของ Grok 4.6 และ GPT-5.6 Sol คืออะไร?

สตริงคือ grok-4.6 สำหรับ SpaceXAI และ gpt-5.6-sol สำหรับ OpenAI OpenAI ยังแมปนามแฝง gpt-5.6 ไปยัง Sol ด้วย เนื่องจาก xAI API เข้ากันได้กับ OpenAI การสลับระหว่างกันจึงเปลี่ยนสตริงเดียวพร้อมสลับ base URL เป็น https://api.x.ai/v1

รุ่นไหนมีหน้าต่างบริบทใหญ่กว่า ระหว่าง Grok 4.6 กับ GPT-5.6 Sol?

GPT-5.6 Sol ถือได้ 1,050,000 โทเค็น เทียบกับ 500,000 ของ Grok 4.6 พร้อมเพดานเอาต์พุต 128,000 โทเค็น ขณะที่ SpaceXAI ไม่ได้เผยขีดจำกัดเอาต์พุตเป็นข้อความ ทั้งสองรุ่นคิดเพิ่มเมื่อพรอมป์ตยาว และเกณฑ์ของ Grok มาก่อนที่ 200,000 โทเค็น เทียบกับ 272,000 ของ Sol ระหว่างสองค่านี้ Grok ถูกคิดเพิ่ม ขณะที่ Sol ยังไม่ ซึ่งทำให้อัตราอินพุตมาเจอกันที่ $4 ต่อ 1M

เข้าถึง Grok 4.6 และ GPT-5.6 Sol ได้อย่างไร?

เข้าถึง Grok 4.6 ผ่าน xAI API หรือ Grok Build และเข้าถึง GPT‑5.6 Sol ผ่าน OpenAI API หรือ Codex ทั้งคู่ยังใช้งานได้ผ่าน Cursor และ OpenRouter หรือผ่านเกตเวย์ AI อย่าง Vercel หรือ Cloudflare

หัวข้อ

เรียนรู้ AI กับ DataCamp!

Tracks

พื้นฐาน AI

10 ชม.
ค้นพบพื้นฐานของ AI เรียนรู้วิธีใช้ AI อย่างมีประสิทธิภาพในการทำงาน และเจาะลึกโมเดลอย่าง ChatGPT เพื่อรับมือกับภูมิทัศน์ AI ที่เปลี่ยนแปลงอย่างรวดเร็ว
ดูรายละเอียดRight Arrow
เริ่มหลักสูตร
ดูเพิ่มเติมRight Arrow