Chuyển đến nội dung chính

Grok 4.6 vs Claude Opus 5: Lập trình, Giá, và Nên dùng mẫu nào

Grok 4.6 rẻ hơn Claude Opus 5 ở mức $2/$6 so với $5/$25, nhưng Opus 5 vẫn dẫn đầu Elo cho công việc tri thức và bài kiểm thử shader cực quang. Dưới đây là gợi ý chọn dùng.
Đã cập nhật 30 thg 8, 2026  · 12 phút đọc

Khám phá với AI

ChatGPTClaudePerplexity

Ngày 12 tháng 8 năm 2026, SpaceXAI ra mắt Grok 4.6 với trọng tâm vào tác tử chạy dài và các dự án tương tác, trực quan tham vọng hơn. Mẫu này ngang GPT-5.6 Sol trên Artificial Analysis Intelligence Index và niêm yết $2 cho mỗi triệu token đầu vào, $6 cho mỗi triệu token đầu ra. Claude Opus 5 vốn đã là mẫu chủ lực dùng hằng ngày của Anthropic: mặc định trên Claude Max, mạnh nhất trên Claude Pro, và bằng nửa giá của Claude Fable 5 ở mức $5 / $25 cho mỗi triệu token.

Trong bài viết này, tôi sẽ so sánh Grok 4.6 và Claude Opus 5 về lập trình, công việc tri thức, dự án trực quan, và giá. Để tìm hiểu sâu từng mẫu, hãy xem hướng dẫn Grok 4.6hướng dẫn Claude Opus 5 của chúng tôi.

Tóm tắt nhanh

  • Opus 5 dẫn đầu trên các thang tổng hợp đã công bố: 63 so với 61 trên AA Intelligence Index, 1.861 so với 1.753 Elo trên GDPval-AA v2.
  • Grok 4.6 đứng cùng biên hiệu năng nhưng với mức giá chỉ bằng 24–40% giá niêm yết của Opus.
  • Chọn Opus 5 nếu cần hiệu năng đỉnh cho tác tử công việc tri thức và lập trình theo kho mã.
  • Chọn Grok 4.6 khi chi phí hoặc số lượt là ràng buộc, nhưng bạn vẫn muốn hiệu năng tương đương.
  • Một tháng tạo sinh nặng ở mức 1M vào / 4M ra có giá $26 với Grok 4.6 so với $105 với Opus 5.

Grok 4.6 là gì?

Grok 4.6 là mẫu biên của SpaceXAI ra mắt tháng 8/2026, phát triển từ Grok 4.5 để phục vụ tác tử chạy dài và dự án tương tác, trực quan tham vọng hơn. ID mẫu API là grok-4.6. Cửa sổ ngữ cảnh là 500.000 token, với mức phí 2x khi prompt vượt 200.000 token.

Bài viết của xAI nhấn mạnh lượt thử đầu cho dự án trực quan và tương tác, cùng tự kiểm thử nhiều hơn trên quãng tác vụ dài. Artificial Analysis chấm 61 trên Intelligence Index, ngang GPT-5.6 Sol và sau Claude Opus 5 (tối đa, 63). Mẫu này có trong Cursor và Grok Build, và trên SpaceXAI API cũng như OpenRouter, Vercel, và Cloudflare.

Để tự gọi mẫu, hãy theo hướng dẫn API Grok 4.6 của chúng tôi. Nếu bạn quan tâm lớp tác tử hơn là thẻ mẫu, chúng tôi cũng đã chạy Grok Build so với Claude Code trên một bộ dữ liệu churn cài bẫy. Chúng tôi cũng so sánh với mẫu chủ lực hiện tại của OpenAI trong hướng dẫn Grok 4.6 vs GPT-5.6 Sol.

Claude Opus 5 là gì?

Claude Opus 5 là mẫu thuộc lớp Opus hiện tại của Anthropic, được định vị là công cụ suy xét dùng hằng ngày, tiệm cận Claude Fable 5 với nửa mức giá. ID mẫu API là claude-opus-5. Đây là mặc định trên Claude Max và là mẫu mạnh nhất trên Claude Pro, với mức $5 / $25 cho mỗi triệu token như Opus 4.8.

Anthropic báo cáo các con số dẫn đầu trên Frontier-Bench v0.1 (43,3%) và GDPval-AA v2 (1.861 Elo), trong khi vẫn sau Mythos 5 ở khai thác an ninh mạng. Chế độ nhanh chạy khoảng nhanh hơn 2,5x so với mặc định với mức giá gấp đôi. Nhà phát triển bắt đầu từ Claude API; các danh mục đám mây cũng liệt kê trên Amazon Bedrock, Google Vertex AI, và Azure AI Foundry.

Chúng tôi phân tích đợt ra mắt trong hướng dẫn Claude Opus 5 và tuyến yêu cầu trong hướng dẫn API Opus 5. Nếu bạn lựa chọn trong hệ sinh thái của Anthropic, hãy xem các so sánh Opus 5 vs Fable 5Opus 5 vs Sonnet 5.

Grok 4.6 vs Claude Opus 5: So sánh trực diện

Opus 5 dẫn về chất lượng; Grok 4.6 rẻ hơn

Trên các thang tổng hợp mà cả hai phòng lab công bố, Opus 5 nhỉnh hơn: 63 so với 61 trên Artificial Analysis Intelligence Index, và 1861 so với 1753 Elo trên GDPval-AA v2. Bảng giá thì cách biệt rõ: Grok 4.6 là $2/$6 cho mỗi 1M token so với Opus 5 là $5/$25.

Tính năng Grok 4.6 Claude Opus 5
AA Intelligence Index 61 63 (tối đa)
GDPval-AA v2 (Elo) 1753 1861
API đầu vào / đầu ra mỗi 1M $2 / $6 $5 / $25
Cửa sổ ngữ cảnh 500k 1M
Phụ phí ngữ cảnh dài 2x ở ≥200k token prompt Chưa công bố
ID mẫu API grok-4.6 claude-opus-5

Quy trình lập trình và tác tử

Opus 5 dẫn đầu trên các hàng lập trình đã công bố mà cả hai cùng có. Đáng chú ý nhất, trên DeepSWE v1.1, Opus 5 đạt 68,8% so với 65,9% của Grok 4.6 High trong Cursor.

Một tín hiệu khác là kết quả lần chạy Grok Build vs Claude Code của chúng tôi: Grok 4.6 high so với Claude Opus 5 high, mỗi bên một cuộc hội thoại, trên một bảng churn có gài rò rỉ. Grok Build đưa ra ít câu trả lời hơn nhưng dùng được ngay. Claude Code đi sâu hơn, nhưng cũng tạo ra một lỗi định dạng dashboard.

Nếu bạn đã trả mức giá Anthropic cho công việc theo kho mã, Opus 5 là lựa chọn an toàn hơn theo công bố. Nếu bạn muốn một mẫu lập trình biên mà không tốn như một mẫu biên, Grok 4.6 là lựa chọn trong Cursor mà tôi thực sự sẽ bật sẵn.

Công việc tri thức và tác tử đường dài

Opus 5 dẫn trong công việc tri thức: GDPval-AA v2 là 1861 cho Opus 5 và 1753 cho Grok 4.6. Artificial Analysis vẫn xếp Grok chỉ sau Opus 5 tại đó, với khoảng sai số chồng lấn so với Fable 5 và Qwen3.8 Max.

Khoảng cách hiệu suất lớn hơn. Trên AA-Briefcase, Grok 4.6 đạt 1577, sau gia đình Opus 5, nhưng hoàn thành khoảng 53 lượt và khoảng 0,5 tỷ token đầu vào. Opus 5 (tối đa) mất khoảng 103 lượt và khoảng 2,0 tỷ token đầu vào. Kết luận là Opus 5 thắng trên bảng điểm, còn Grok 4.6 thắng về ngân sách token.

Công việc trực quan và tương tác

Thông điệp của SpaceXAI cho Grok 4.6 là lượt thử đầu mạnh hơn cho các dự án trực quan và tương tác. Đợt ra mắt Opus 5 của Anthropic thì lặng hơn ở mảng này và nói nhiều hơn về kiểm chứng, kèm "đầu ra trực quan mạnh hơn nhiều" nhưng không có số công khai so với Grok.

Đó là lý do chúng tôi chạy một tác vụ shader chung. Cả hai mẫu đều viết GLSL thật, nhưng kết quả của Opus 5 khớp đề bài sát hơn một chút và phản ứng tốt hơn với chuyển động con trỏ. Kết quả của Grok 4.6 cũng rất đẹp mắt và làm được với ít lượt hơn.

Giá: bạn thực sự trả bao nhiêu

Công việc nặng về tạo sinh tốn $26 với Grok, $105 với Opus

Bảng giá niêm yết là khoảng cách rõ ràng nhất trong so sánh này. Grok 4.6 là $2 đầu vào và $6 đầu ra cho mỗi 1M token, còn Opus 5 là $5 và $25. Điều này khiến mẫu của Anthropic đắt hơn 2,5 lần ở đầu vào và hơn 4 lần ở đầu ra, một khác biệt lớn. Ví dụ, một tháng tạo sinh nặng ở 1M vào / 4M ra là $26 với Grok 4.6 và $105 với Opus 5. Một trợ lý cân bằng hơn ở 1M vào / 250K ra là $3,50 so với $11,25.

So kè mức giá theo token

Đây là các mức tiêu chuẩn đã công bố, kèm các phần bổ sung thực tế cho cả hai mẫu.

Mức giá Grok 4.6 Claude Opus 5
Đầu vào, mỗi 1M token $2,00 $5,00
Đầu ra, mỗi 1M token $6,00 $25,00
Đọc cache, mỗi 1M token $0,50 $0,50
Ghi cache, mỗi 1M token $1,00 (≥200k hàng) $6,25 (5 phút) / $10 (1 giờ)
Biến thể nhanh $4 / $12 (2x) $10 / $50 (2x; ~2,5x tốc độ)
Phụ phí ngữ cảnh dài 2x ở ≥200k token prompt ($4 / $1 / $12) Chưa công bố

Phần đội giá ở đầu ra là đau nhất. Chế độ nhanh là lớp phủ 2x cho cả hai, không phải một dạng giá thứ ba. Opus 5 cũng công bố giảm 50% cho lô ($2,50 / $12,50), điều mà Grok 4.6 hiện chưa có.

Chi phí một khối công việc thực tế

Công thức một lần: (khối lượng ÷ 1M) × mức giá, cộng đầu vào và đầu ra, ở mức chuẩn trừ hàng vượt ngưỡng dùng phụ phí 2x của Grok. Số được làm tròn đến cent dưới $10, còn lại làm tròn đến đô la gần nhất.

Khối công việc Grok 4.6 Claude Opus 5 Chênh lệch
Trợ lý cân bằng: 1M vào / 250K ra $3,50 $11,25 Opus 5 +$7,75 (221%)
Tạo sinh nặng: 1M vào / 4M ra $26 $105 Opus 5 +$79 (304%)
Truy xuất, dưới ngưỡng: 10M vào / 1M ra $26 $75 Opus 5 +$49 (188%)
Truy xuất, vượt ngưỡng: 10M vào / 1M ra $52 $75 Opus 5 +$23 (44%)

Truy xuất dưới 200k là câu chuyện của giá đầu vào ($26 so với $75). Dù vậy, phụ phí 200k của Grok cũng ảnh hưởng: Vượt ngưỡng, cùng tổng 10M / 1M chỉ còn $52 so với $75. Phụ phí thu hẹp khoảng cách, nhưng không khiến Opus 5 rẻ hơn.

Hiệu năng của Grok 4.6 và Claude Opus 5

Biểu đồ của nhà cung cấp sẽ không cho bạn biết mẫu có vẽ được cảnh bạn mô tả hay không. Chúng tôi chạy một tác vụ tác tử lập trình chung từ ngân hàng kiểm thử, rồi tổng hợp kết quả.

Bài kiểm thử

Chúng tôi kiểm thử cả hai về khả năng tạo một đồ họa shader toàn cửa sổ hiển thị cực quang trên đường chân trời núi, chạy trên p5.js, với chuột và thời gian được truyền vào dưới dạng uniform. Bài kiểm thử lấy cảm hứng từ prompt shader của Ethan Mollick. Chúng tôi định chủ đề để kết quả dễ so sánh hơn. Cả hai mẫu chạy một lần, không thử lại, trong Cursor với bộ công cụ giống hệt. Cả hai dùng biến thể suy luận cao.

Prompt nguyên văn:

Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.

Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.

Grok 4.6 tạo ra gì

Grok 4.6 xuất một index.html chạy được trong 13 lượt. Hiệu ứng là GLSL fragment shader thật với p5 chỉ dùng để chứa canvas. Các dải rèm chuyển động giống cực quang, với tách ba màu trông đẹp hơn tấm xanh chủ đạo của Opus 5, kèm nền sao nhấp nháy.

Điểm trừ là phần phong cảnh. Dãy núi trông như bóng cắt hoạt hình, nên mức khớp thẩm mỹ là 4 thay vì 5. Tính tương tác với con trỏ ở mức trung bình: Như thấy trong video dưới, đồ họa phản ứng mạnh theo trục x, nhưng không nhiều theo trục y.

Claude Opus 5 tạo ra gì

Opus 5 cũng vượt bài, cũng dùng GLSL thật. Mức khớp thẩm mỹ rất đúng: ba dãy núi với các sắc xám khác nhau, rèm cực quang dễ nhận, sao nhấp nháy. Màu chủ đạo là xanh lục, cũng là màu phổ biến nhất của cực quang. Vì vậy, xét độ đúng, nó nhỉnh hơn, dù ba màu của Grok trông đẹp mắt hơn theo ý kiến cá nhân tôi. Tính tương tác với con trỏ tốt hơn shader của Grok, với rèm uốn cong và sáng lên theo cả hai trục.

Opus mất nhiều lượt hơn Grok, tổng cộng 46. Dù vậy, 19 lượt là do xin phép thực thi lệnh kiểm chứng (không được phép theo luật bài kiểm), nên chỉ 27 lượt liên quan đến việc tạo shader thuần túy. Dẫu vậy, Grok chỉ dùng một nửa số lượt của Opus.

Kết quả

Thước đo Grok 4.6 high Claude Opus 5 high
Lượt 13 27
Chạy được đạt đạt
Khớp thẩm mỹ 4 5
Năng lực shader 5 5
Tương tác con trỏ 3 5
Tuân thủ kỹ thuật 5 5

Opus 5 khớp đề bài sát hơn: núi phân lớp và phản hồi chuột trên cả hai trục. Rèm của Grok 4.6 màu sắc hơn và vẫn vượt, nhưng núi bị giản lược quá, và con trỏ chủ yếu điều khiển trục x.

Đây là n=1, không phải con số token hay chi phí, và chỉ kiểm tra shader cảnh mô tả với GLSL phản ứng con trỏ, không phải lập trình kho mã hay công việc tri thức.

Khi nào chọn Grok 4.6 so với Claude Opus 5

Opus 5 cho cảnh, Grok 4.6 cho hóa đơn

Nếu quyết định dựa trên bảng điểm, chọn Opus 5. Nếu dựa trên hóa đơn, Grok 4.6 là mẫu biên mà tôi sẽ để chạy thực sự.

Chọn Claude Opus 5 nếu...

  • Elo cho công việc tri thức là tiêu chí tuyển chọn. GDPval-AA v2 (1.861 so với 1.753) và AA Index (63 so với 61) đều nghiêng về Opus 5 (tối đa).
  • Công việc là lập trình theo kho mã. Opus 5 có các hàng đã công bố: 68,8% trên DeepSWE v1.1 so với 65,9% cho Grok 4.6 High, thêm 79,2% trên SWE-bench Pro và 43,3% trên Frontier-Bench, nơi Grok chưa có điểm.
  • Đội của bạn đã dùng Claude Max, Claude Code, hoặc Claude Pro. Opus 5 là mặc định trên Max và là mẫu mạnh nhất trên Pro, nên đổi để được giảm 4x ở đầu ra chỉ đáng nếu bạn thực sự chuyển khối lượng công việc.
  • Đầu ra là hình ảnh phải khớp cảnh mô tả. Trong lần chạy shader của chúng tôi, Opus 5 bám đề sát hơn và phản hồi trên cả hai trục chuột.

Chọn Grok 4.6 nếu...

  • Bảng giá là yếu tố quyết định. $2/$6 so với $5/$25 là khoảng cách tồn tại ở mọi dạng khối công việc chúng tôi tính được, kể cả phụ phí 200k của Grok. Một tháng tạo sinh nặng là $26 so với $105.
  • Số lượt là hóa đơn. Trên AA-Briefcase, Grok 4.6 dùng khoảng 53 lượt và 0,5 tỷ token đầu vào so với ~103 và ~2,0 tỷ của Opus 5 tối đa.
  • Bạn muốn mẫu biên trong Cursor hoặc Grok Build mà không trả giá Opus, và một lượt thử đầu mạnh quan trọng hơn bản hoàn thiện.

Bắt đầu với Grok 4.6 và Claude Opus 5

Cả hai mẫu có thể được truy cập theo nhiều cách. Chuỗi model cần dùng là grok-4.6claude-opus-5

Bề mặt Grok 4.6 Claude Opus 5
Ứng dụng người dùng Grok Build; Cursor (desktop, web, iOS, CLI) Claude Pro; mặc định trên Claude Max
API bên thứ nhất Có (SpaceXAI API) Có (Claude API)
Nền tảng đám mây Amazon Bedrock, Google Vertex AI, Azure AI Foundry Amazon Bedrock, Google Vertex AI, Azure AI Foundry
Tác tử lập trình Cursor, Grok Build Claude Code, Cursor
Router bên thứ ba OpenRouter, Vercel, Cloudflare OpenRouter, Vercel, Cloudflare
ID mẫu API grok-4.6 claude-opus-5

Dùng Grok 4.6 và Claude Opus 5 trong tác tử lập trình

Trong Cursor, cả hai đều có trong danh sách chọn. Claude Code là bản địa của Anthropic; Grok Build đọc cây .claude/, điều mà Claude Code sẽ không làm ngược lại cho tệp .grok/. API chỉ là đổi một chuỗi model trong từng SDK của nhà cung cấp.

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)

Thiết lập đầy đủ cho mỗi API có trong hướng dẫn API Grok 4.6hướng dẫn API Claude Opus 5. Nếu bạn muốn sản phẩm tác tử thay vì ID mẫu, hãy bắt đầu với Claude Code 101.

Kết luận

Nếu công việc là cảnh trực quan mô tả hoặc tác tử công việc tri thức mà bạn sẽ chấm theo Elo, hãy dùng Claude Opus 5. Nếu công việc là tác tử lập trình biên và bạn cũng sẽ chấm theo hóa đơn, hãy dùng Grok 4.6.

Điều nổi bật là các benchmark quyết định rất ít. Hai điểm trên AA Index, hay trăm Elo trên GDPval-AA, là khoảng cách hẹp hơn nhiều so với trên bảng giá: $105 so với $26 cho cùng một tháng tạo sinh nặng. Mẫu thì sát nhau; hóa đơn thì không.

Nếu bạn muốn các khái niệm đằng sau những tác tử này, tôi gợi ý lộ trình kỹ năng AI Fundamentals. Với quy trình gốc Claude, Claude Code 101 là điểm khởi đầu thực tiễn.

Câu hỏi thường gặp

Khi nào tôi nên dùng Grok 4.6 thay vì Claude Opus 5?

Dùng Grok 4.6 khi chi phí API là ràng buộc. Mẫu này niêm yết $2/$6 cho mỗi 1M token so với Opus 5 là $5/$25, nên một tháng tạo sinh nặng là $26 so với $105. Nó cũng hoàn thành shader cực quang của chúng tôi với một nửa số lượt của Opus và kết quả tốt, và Artificial Analysis báo cáo ít lượt và ít token đầu vào hơn Opus 5 tối đa trên AA-Briefcase.

Khi nào tôi nên dùng Claude Opus 5 thay vì Grok 4.6?

Hãy dùng Claude Opus 5 khi chất lượng là yếu tố quyết định: mẫu này dẫn về Elo cho công việc tri thức (1.861 so với 1.753 trên GDPval-AA v2), AA Index (63 so với 61), và các hàng lập trình đã công bố như DeepSWE v1.1 (68,8% so với 65,9%).

Grok 4.6 và Claude Opus 5 so sánh về giá như thế nào?

Grok 4.6 có giá $2 đầu vào và $6 đầu ra cho mỗi 1M token. Claude Opus 5 là $5 và $25, giống Opus 4.8. Grok 4.6 phụ thu 2x cho prompt từ 200k token trở lên; Opus 5 không công bố phụ phí ngữ cảnh dài. Đọc cache là $0,50 / 1M cho cả hai ở mức chuẩn.

ID mẫu API của Grok 4.6 và Claude Opus 5 là gì?

Grok 4.6 là grok-4.6 trên SpaceXAI API. Claude Opus 5 là claude-opus-5 trên Claude API. Chúng không thể thay thế trực tiếp qua SDK; mỗi ID thuộc về client riêng.

Tôi có thể dùng Grok 4.6 và Claude Opus 5 cùng nhau không?

Có, nếu bộ chọn tác tử của bạn hiển thị cả hai. Cursor liệt kê Grok 4.6 và Claude Opus 5 như các model có thể chọn, và hầu hết router, danh mục đám mây phổ biến đều có cả hai, nên bộ chọn hiếm khi là ràng buộc. Sự bất đối xứng nằm ở tác tử bên thứ nhất: Claude Code là bản địa Anthropic và sẽ không chạy Grok, trong khi Grok Build đọc cây .claude/, vì vậy cấu hình kiểu Claude có thể mang sang hướng đó nhưng không ngược lại.


Tom Farnschläder's photo
Author
Tom Farnschläder
LinkedIn

Tom là một nhà khoa học dữ liệu và giảng viên kỹ thuật. Anh viết và quản lý các bài hướng dẫn và bài blog về khoa học dữ liệu của DataCamp. Trước đây, Tom làm việc trong lĩnh vực khoa học dữ liệu tại Deutsche Telekom.

Chủ đề

Học AI cùng DataCamp!

Tracks

Cơ bản về Trí tuệ Nhân tạo

10 giờ
Khám phá những kiến thức cơ bản về Trí tuệ Nhân tạo (AI), học cách ứng dụng AI một cách hiệu quả trong công việc, và tìm hiểu sâu về các mô hình như ChatGPT để nắm bắt xu hướng phát triển của lĩnh vực AI.
Xem chi tiếtRight Arrow
Bắt Đầu Khóa Học
Xem thêmRight Arrow