Tracks
ใช้ Claude Opus 5 เมื่อต้องการคุณภาพเป็นตัวตัดสิน: นำใน Elo งานความรู้ (1,861 เทียบกับ 1,753 บน GDPval-AA v2) AA Index (63 เทียบกับ 61) และแถวตัวชี้วัดการโค้ดที่เผยแพร่อย่าง DeepSWE v1.1 (68.8% เทียบกับ 65.9%)
เมื่อวันที่ 12 สิงหาคม 2026 SpaceXAI เปิดตัว Grok 4.6 โดยเน้นตัวแทนที่ทำงานยาว (long-running agents) และงานเชิงโต้ตอบและภาพที่ทะเยอทะยานมากขึ้น รุ่นนี้ทำคะแนนเทียบเท่า GPT-5.6 Sol บน Artificial Analysis Intelligence Index และตั้งราคาที่ $2 ต่อหนึ่งล้านโทเค็นขาเข้า และ $6 ต่อหนึ่งล้านโทเค็นขาออก ส่วน Claude Opus 5 เป็นเรือธงใช้งานประจำวันของ Anthropic อยู่แล้ว: เป็นค่าเริ่มต้นบน Claude Max เป็นโมเดลที่แข็งแกร่งที่สุดบน Claude Pro และมีราคาเพียงครึ่งหนึ่งของ Claude Fable 5 ที่ $5 / $25 ต่อหนึ่งล้านโทเค็น
บทความนี้จะเปรียบเทียบ Grok 4.6 และ Claude Opus 5 ในมิติการโค้ด งานความรู้ งานภาพ/เชิงโต้ตอบ และราคา หากต้องการเจาะลึกแต่ละโมเดล แนะนำอ่าน คู่มือ Grok 4.6 และ คู่มือ Claude Opus 5
Grok 4.6 คือโมเดลแนวหน้าของ SpaceXAI เดือนสิงหาคม 2026 พัฒนาต่อจาก Grok 4.5 สำหรับเอเจนต์ที่ทำงานยาวและงานเชิงโต้ตอบ/ภาพที่ทะเยอทะยานยิ่งขึ้น API model ID คือ grok-4.6 หน้าต่างบริบท 500,000 โทเค็น โดยมีอัตรา 2 เท่าเมื่อพรอมป์ตเกิน 200,000 โทเค็น
บทความของ xAI เองเน้นการผ่านครั้งแรกที่แข็งแรงขึ้นบนงานภาพและเชิงโต้ตอบ บวกการทดสอบตัวเองมากขึ้นในเส้นทางยาว Artificial Analysis ให้คะแนน 61 บน Intelligence Index ใกล้เคียง GPT-5.6 Sol และตามหลัง Claude Opus 5 (สูงสุด 63) มีให้ใช้ใน Cursor และ Grok Build บน SpaceXAI API รวมทั้ง OpenRouter, Vercel และ Cloudflare
หากต้องการเรียกใช้งานเอง ดู บทช่วยสอน API ของ Grok 4.6 หากสนใจตัวห่อหุ้มเอเจนต์มากกว่าบัตรโมเดล เราได้ทดสอบ Grok Build เทียบกับ Claude Code บนชุดข้อมูล churn ที่วางกับดักไว้ และยังเปรียบเทียบกับโมเดลเรือธงปัจจุบันของ OpenAI ใน Grok 4.6 vs GPT-5.6 Sol
Claude Opus 5 คือโมเดลระดับ Opus ปัจจุบันของ Anthropic วางตำแหน่งเป็นตัวทำงานประจำวันอย่างรอบคอบ ที่เข้าใกล้ Claude Fable 5 ในราคาเพียงครึ่งเดียว API model ID คือ claude-opus-5 เป็นค่าเริ่มต้นบน Claude Max และเป็นโมเดลที่แข็งแกร่งที่สุดบน Claude Pro ที่ราคา $5 / $25 ต่อหนึ่งล้านโทเค็น เท่ากับ Opus 4.8
Anthropic รายงานสถิติล้ำหน้าบน Frontier-Bench v0.1 (43.3%) และ GDPval-AA v2 (1,861 Elo) แม้ยังตามหลัง Mythos 5 ในด้านการเจาะระบบไซเบอร์โครงสร้าง Fast mode ทำงานเร็วขึ้นราว 2.5 เท่าในราคา 2 เท่าของฐาน นักพัฒนาสามารถเริ่มจาก Claude API และยังมีใน Amazon Bedrock, Google Vertex AI และ Azure AI Foundry
สรุปเปิดตัวอยู่ใน คู่มือ Claude Opus 5 และเส้นทางคำขอใน บทช่วยสอน API ของ Opus 5 หากเลือกภายในสแตกของ Anthropic เอง ดูคู่เปรียบเทียบ Opus 5 vs Fable 5 และ Opus 5 vs Sonnet 5

บนชุดคะแนนรวมที่ทั้งสองค่ายเผยแพร่ Opus 5 นำเล็กน้อย: 63 เทียบกับ 61 บน Artificial Analysis Intelligence Index และ 1861 เทียบกับ 1753 Elo บน GDPval-AA v2 ส่วนอัตราค่าบริการแตกต่างชัดเจน: Grok 4.6 อยู่ที่ $2/$6 ต่อ 1M โทเค็น เทียบกับ Opus 5 ที่ $5/$25
| คุณสมบัติ | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| AA Intelligence Index | 61 | 63 (สูงสุด) |
| GDPval-AA v2 (Elo) | 1753 | 1861 |
| API ขาเข้า / ขาออก ต่อ 1M | $2 / $6 | $5 / $25 |
| หน้าต่างบริบท | 500k | 1M |
| ค่าบวกเพิ่มบริบทยาว | 2x ที่โทเค็นพรอมป์ต ≥200k | ไม่ประกาศ |
| API model ID | grok-4.6 |
claude-opus-5 |
Opus 5 นำบนแถวตัวชี้วัดการโค้ดที่ทั้งสองมีร่วมกัน โดยเฉพาะ DeepSWE v1.1 ที่ Opus 5 ทำได้ 68.8% เทียบกับ Cursor ที่ 65.9% สำหรับ Grok 4.6 High
สัญญาณอีกอย่างคือผลทดสอบ Grok Build เทียบ Claude Code: Grok 4.6 high เทียบ Claude Opus 5 high คนละหนึ่งบทสนทนา บนตาราง churn ที่ฝังช่องโหว่เอาไว้ Grok Build ให้คำตอบน้อยกว่าแต่พร้อมใช้ทันทีมากกว่า Claude Code ลงลึกกว่า แต่ก็ส่งบั๊กฟอร์แมตแดชบอร์ดมาด้วย
ถ้าจ่ายราคา Anthropic สำหรับงานระดับรีโพอยู่แล้ว Opus 5 คือไพ่ที่ปลอดภัยกว่า หากอยากได้โมเดลโค้ดแนวหน้าที่ไม่คิดราคาแบบแนวหน้า Grok 4.6 คือทางเลือกใน Cursor ที่น่าเปิดทิ้งไว้จริงๆ
Opus 5 นำในงานความรู้: GDPval-AA v2 คือ 1861 สำหรับ Opus 5 และ 1753 สำหรับ Grok 4.6 Artificial Analysis ยังจัดให้ Grok ตามหลังเพียง Opus 5 โดยมีช่วงความคลาดเคลื่อนซ้อนทับกับ Fable 5 และ Qwen3.8 Max
ช่องว่างด้านประสิทธิภาพยิ่งใหญ่กว่า บน AA-Briefcase Grok 4.6 ได้ 1577 ตามหลังตระกูล Opus 5 แต่จบงานในราว 53 เทิร์น และประมาณ 0.5 พันล้านโทเค็นขาเข้า Opus 5 (สูงสุด) ใช้ราว 103 เทิร์น และราว 2.0 พันล้านโทเค็นขาเข้า บทสรุปคือ Opus 5 ชนะบนสกอร์บอร์ด ขณะที่ Grok 4.6 ชนะบนงบโทเค็น
จุดขายของ SpaceXAI สำหรับ Grok 4.6 คือการผ่านครั้งแรกที่แข็งแรงขึ้นบนงานภาพและเชิงโต้ตอบ การเปิดตัว Opus 5 ของ Anthropic เงียบในมิตินี้และเน้นการตรวจสอบความถูกต้องมากกว่า พร้อมอ้างว่า “เอาต์พุตภาพแข็งแรงขึ้นมาก” โดยไม่มีตัวเลขสาธารณะเทียบกับ Grok
จึงเป็นเหตุให้เราทำภารกิจเชดเดอร์ร่วม ทั้งสองโมเดลเขียน GLSL จริง แต่ผลของ Opus 5 ตรงกับโจทย์มากกว่าเล็กน้อย และตอบสนองต่อการเคลื่อนเมาส์ได้ดีกว่า ผลของ Grok 4.6 ก็สวยและใช้เทิร์นน้อยกว่า

ป้ายราคาเป็นช่องว่างที่ชัดที่สุด Grok 4.6 คิด $2 ขาเข้า และ $6 ขาออก ต่อ 1M โทเค็น ขณะที่ Opus 5 คือ $5 และ $25 นั่นทำให้โมเดลของ Anthropic แพงกว่าขาเข้าราว 2.5 เท่า และแพงกว่าขาออกมากกว่า 4 เท่า ซึ่งต่างกันมาก ตัวอย่างเช่น เดือนที่เน้นการสร้างผลลัพธ์ที่ 1M ขาเข้า / 4M ขาออก คือ $26 บน Grok 4.6 และ $105 บน Opus 5 ส่วนผู้ช่วยที่สมดุลกว่า 1M ขาเข้า / 250K ขาออก คือ $3.50 เทียบกับ $11.25
ต่อไปนี้คืออัตรามาตรฐานที่เผยแพร่ รวมถึงส่วนเพิ่มเติมที่มีจริงสำหรับทั้งสองโมเดล
| อัตรา | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| ขาเข้า ต่อ 1M โทเค็น | $2.00 | $5.00 |
| ขาออก ต่อ 1M โทเค็น | $6.00 | $25.00 |
| อ่านจากแคช ต่อ 1M โทเค็น | $0.50 | $0.50 |
| เขียนลงแคช ต่อ 1M โทเค็น | $1.00 (แถว ≥200k) | $6.25 (5 นาที) / $10 (1 ชั่วโมง) |
| ตัวแปรเร็ว | $4 / $12 (2x) | $10 / $50 (2x; เร็วขึ้น ~2.5x) |
| ค่าบวกเพิ่มบริบทยาว | 2x ที่โทเค็นพรอมป์ต ≥200k ($4 / $1 / $12) | ไม่ประกาศ |
พรีเมียมฝั่งขาออกคือส่วนที่เจ็บ Fast mode เป็นโอเวอร์เลย์ 2 เท่าบนทั้งสอง ไม่ใช่รูปแบบที่สาม Opus 5 ยังประกาศส่วนลดแบบแบตช์ 50% ($2.50 / $12.50) ซึ่งปัจจุบัน Grok 4.6 ยังไม่มี
สูตรครั้งเดียว: (ปริมาณ ÷ 1M) × อัตรา บวกกันระหว่างขาเข้าและขาออก ที่อัตรามาตรฐาน ยกเว้นแถวเกินเกณฑ์ที่ใช้อัตราบวกเพิ่ม 2x ของ Grok ปัดตัวเลขถึงเซ็นต์เมื่อ <$10 มิฉะนั้นปัดเป็นดอลลาร์ถ้วน
| เวิร์กโหลด | Grok 4.6 | Claude Opus 5 | ส่วนต่าง |
|---|---|---|---|
| ผู้ช่วยสมดุล: 1M ขาเข้า / 250K ขาออก | $3.50 | $11.25 | Opus 5 +$7.75 (221%) |
| เน้นการสร้างผลลัพธ์: 1M ขาเข้า / 4M ขาออก | $26 | $105 | Opus 5 +$79 (304%) |
| ดึงข้อมูล ต่ำกว่าเกณฑ์: 10M ขาเข้า / 1M ขาออก | $26 | $75 | Opus 5 +$49 (188%) |
| ดึงข้อมูล เกินเกณฑ์: 10M ขาเข้า / 1M ขาออก | $52 | $75 | Opus 5 +$23 (44%) |
การดึงข้อมูลที่ต่ำกว่า 200k เป็นเรื่องอัตราขาเข้า ($26 เทียบกับ $75) อย่างไรก็ดี ค่าบวกเพิ่ม 200k ของ Grok ก็มีผล: หากข้ามเกณฑ์ เวิร์กโหลดรวม 10M / 1M เดียวกันจะกลายเป็นเพียง $52 เทียบกับ $75 ส่วนบวกเพิ่มทำให้ช่องว่างแคบลง แต่ก็ไม่ได้ทำให้ Opus 5 ถูกกว่า
ชาร์ตจากผู้ขายจะไม่บอกว่าโมเดลวาดฉากตามคำบรรยายได้หรือไม่ เราจึงรันทดสอบงานเอเจนต์โค้ดร่วมหนึ่งชุดจากธนาคารแบบทดสอบของเรา แล้วเก็บผลลัพธ์เป็นหน้า
เราทดสอบทั้งสองว่าทำกราฟิกเชดเดอร์เต็มหน้าต่างแสดงแสงเหนือเหนือเส้นขอบฟ้าภูเขา โฮสต์ด้วย p5.js และส่งเมาส์กับเวลาเข้าไปเป็น uniforms ได้ดีเพียงใด แบบทดสอบได้รับแรงบันดาลใจจาก พรอมป์ตเชดเดอร์ของ Ethan Mollick เราตั้งธีมเพื่อทำให้ผลเปรียบเทียบได้ยุติธรรม ทั้งสองโมเดลรันครั้งเดียว ไม่แก้มือ ภายใน Cursor ด้วยเครื่องมือเหมือนกัน ใช้ตัวแปรเหตุผลขั้นสูงทั้งคู่
พรอมป์ตแบบถ้อยคำตรงตัว:
Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.
Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.
Grok 4.6 ส่งไฟล์ index.html ที่ทำงานได้ใน 13 เทิร์น เอฟเฟกต์เป็น GLSL fragment shader จริง โดยให้ p5 โฮสต์แคนวาสเท่านั้น ผ้าม่านขยับแบบคล้ายแสงเหนือ มีการแยกสามสีที่ดูสวยกว่าผ้าสีเขียวเป็นหลักของ Opus 5 และมีดาวกระพริบพื้นหลัง
จุดพลาดคือภูมิประเทศ ภูเขาดูเป็นเงาการ์ตูน นี่จึงทำให้คะแนนความเข้ากับสุนทรียะได้ 4 ไม่ใช่ 5 การโต้ตอบกับเคอร์เซอร์อยู่ในระดับกลางๆ: ดังที่เห็นในวิดีโอด้านล่าง กราฟิกตอบสนองแกน x มาก แต่ไม่ค่อยตอบสนองแกน y
Opus 5 ก็ผ่าน และเป็น GLSL จริงเช่นกัน ความเข้ากับสุนทรียะตรงโจทย์: แนวภูเขาสามชั้นคนละเฉดเทา ผ้าม่านที่อ่านได้เป็นแสงเหนือ ดาวกระพริบ สีส่วนใหญ่เป็นเขียว ซึ่งเป็นสีที่แสงเหนือพบบ่อยที่สุด จึงถือว่าถูกต้องกว่า แม้สามสีของ Grok จะดูสวยกว่าในความเห็นของผู้เขียน การโต้ตอบกับเคอร์เซอร์ดีกว่าเชดเดอร์ของ Grok โดยผ้าม่านโค้งและสว่างขึ้นตามทั้งสองแกน
Opus ใช้เทิร์นมากกว่า Grok มาก รวม 46 เทิร์น อย่างไรก็ดี 19 เทิร์นเกี่ยวกับการขออนุญาตรันคำสั่งตรวจสอบ (ซึ่งไม่อนุญาตตามกติกาทดสอบ) จึงเหลือ 27 เทิร์นที่เกี่ยวกับการสร้างเชดเดอร์ล้วนๆ ถึงกระนั้น Grok ก็ใช้เทิร์นเพียงครึ่งหนึ่งของ Opus อยู่ดี
| ตัวชี้วัด | Grok 4.6 high | Claude Opus 5 high |
|---|---|---|
| จำนวนเทิร์น | 13 | 27 |
| รันได้จริง | ผ่าน | ผ่าน |
| ความเข้ากับสุนทรียะ | 4 | 5 |
| ความเชี่ยวชาญเชดเดอร์ | 5 | 5 |
| การโต้ตอบกับเคอร์เซอร์ | 3 | 5 |
| ทำตามเทคนิค | 5 | 5 |
Opus 5 ตรงโจทย์มากกว่า: ภูเขาแบบซ้อนชั้น และตอบสนองเมาส์ทั้งสองแกน Grok 4.6 มีผ้าม่านสีสันกว่าและผ่านเช่นกัน แต่ภูเขาถูกทำให้ง่ายเกินไป และเคอร์เซอร์ขับเคลื่อนแกน x เป็นหลัก
นี่คือ n=1 ไม่ใช่ตัวเลขโทเค็นหรือค่าใช้จ่าย และทดสอบเฉพาะเชดเดอร์ฉากตามคำบรรยายที่โต้ตอบกับเคอร์เซอร์ด้วย GLSL ไม่ได้ครอบคลุมการโค้ดระดับรีโพหรือ งานความรู้

ถ้าให้สกอร์บอร์ดเป็นคนตัดสิน เลือก Opus 5 ถ้าให้ใบแจ้งหนี้เป็นคนตัดสิน Grok 4.6 คือโมเดลแนวหน้าที่น่าเปิดใช้จริง
เลือก Grok 4.6 หาก...
เข้าถึงทั้งสองโมเดลได้หลายทาง สตริงโมเดลที่ใช้คือ grok-4.6 และ claude-opus-5
| ช่องทาง | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| แอปสำหรับผู้ใช้ | Grok Build; Cursor (เดสก์ท็อป เว็บ iOS CLI) | Claude Pro; ค่าเริ่มต้นบน Claude Max |
| API โดยผู้พัฒนา | มี (SpaceXAI API) | มี (Claude API) |
| แพลตฟอร์มคลาวด์ | Amazon Bedrock, Google Vertex AI, Azure AI Foundry | Amazon Bedrock, Google Vertex AI, Azure AI Foundry |
| เอเจนต์โค้ด | Cursor, Grok Build | Claude Code, Cursor |
| ตัวกลางของบุคคลที่สาม | OpenRouter, Vercel, Cloudflare | OpenRouter, Vercel, Cloudflare |
| API model ID | grok-4.6 |
claude-opus-5 |
ใน Cursor ทั้งสองเป็นตัวเลือกในตัวเลือกโมเดล Claude Code เป็นเนทีฟของ Anthropic; Grok Build อ่านโครง .claude/ ซึ่ง Claude Code จะไม่รองรับไฟล์ .grok/ การใช้ API ภายใน SDK ของแต่ละค่ายเป็นเพียงการสลับสตริงโมเดลเท่านั้น
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)
ขั้นตอนติดตั้งเต็มสำหรับแต่ละ API อยู่ที่ บทช่วยสอน API ของ Grok 4.6 และ บทช่วยสอน API ของ Claude Opus 5 หากต้องการใช้ผลิตภัณฑ์เอเจนต์มากกว่ารหัสโมเดล เริ่มที่ Claude Code 101
ถ้างานเป็นฉากภาพตามคำบรรยาย หรือเอเจนต์งานความรู้ที่ประเมินด้วย Elo ใช้ Claude Opus 5 หากงานเป็นเอเจนต์โค้ดแนวหน้าที่ต้องมองบิลด้วย ใช้ Grok 4.6
สิ่งที่สะดุดตาคือเกณฑ์มาตรฐานตัดสินอะไรได้น้อย ช่องว่างสองคะแนนบน AA Index หรือร้อย Elo บน GDPval-AA แคบกว่าช่องว่างบนป้ายราคา: $105 เทียบกับ $26 สำหรับเดือนที่เน้นการสร้างผลลัพธ์ โมเดลใกล้เคียงกัน แต่ใบแจ้งหนี้ไม่ใกล้เลย
หากอยากเข้าใจแนวคิดเบื้องหลังเอเจนต์เหล่านี้ แนะนำ เส้นทางทักษะ AI Fundamentals สำหรับเวิร์กโฟลว์แบบ Claude-native เริ่มที่ Claude Code 101 ที่เน้นปฏิบัติ
ใช้ Grok 4.6 เมื่อข้อจำกัดคือค่าใช้จ่าย API ตั้งราคาที่ $2/$6 ต่อ 1M โทเค็น เทียบกับ Opus 5 ที่ $5/$25 ดังนั้นเดือนที่เน้นการสร้างผลลัพธ์จึงเป็น $26 เทียบกับ $105 นอกจากนี้ Grok 4.6 ยังจบงานเชดเดอร์แสงเหนือด้วยจำนวนเทิร์นครึ่งหนึ่งของ Opus และได้ผลลัพธ์ที่ดี อีกทั้ง Artificial Analysis รายงานว่าใช้เทิร์นและโทเค็นขาเข้าน้อยกว่า Opus 5 สูงสุดบน AA-Briefcase
ใช้ Claude Opus 5 เมื่อต้องการคุณภาพเป็นตัวตัดสิน: นำใน Elo งานความรู้ (1,861 เทียบกับ 1,753 บน GDPval-AA v2) AA Index (63 เทียบกับ 61) และแถวตัวชี้วัดการโค้ดที่เผยแพร่อย่าง DeepSWE v1.1 (68.8% เทียบกับ 65.9%)
Grok 4.6 คิด $2 ขาเข้า และ $6 ขาออก ต่อ 1M โทเค็น Claude Opus 5 คิด $5 และ $25 เท่ากับ Opus 4.8 Grok 4.6 คิดบวกเพิ่ม 2 เท่าสำหรับพรอมป์ตที่ตั้งแต่ 200k โทเค็นขึ้นไป ส่วน Opus 5 ไม่ประกาศค่าบริบทยาว การอ่านจากแคชมาตรฐานอยู่ที่ $0.50 / 1M สำหรับทั้งคู่
Grok 4.6 คือ grok-4.6 บน SpaceXAI API ส่วน Claude Opus 5 คือ claude-opus-5 บน Claude API ทั้งสองไม่สามารถสลับใช้งานกันได้ข้าม SDK โดยตรง; แต่ละ ID เป็นของไคลเอนต์ของตนเอง
ได้ หากตัวเลือกเอเจนต์ของคุณมีทั้งคู่ Cursor แสดง Grok 4.6 และ Claude Opus 5 ให้เลือก และตัวกลาง/แค็ตตาล็อกคลาวด์ส่วนใหญ่ก็มีทั้งคู่ จึงไม่ค่อยติดข้อจำกัดที่ตัวเลือก ความไม่สมมาตรอยู่ที่เอเจนต์โดยผู้พัฒนา: Claude Code เป็นเนทีฟของ Anthropic และจะไม่รัน Grok ขณะที่ Grok Build อ่านโครง .claude/ ได้ ดังนั้นคอนฟิกทรง Claude จึงพกพาไปทิศนั้นได้ แต่ย้อนกลับไม่ได้
เรียนรู้ AI กับ DataCamp!
Tracks
Courses
Courses