Tracks
Hãy dùng Claude Opus 5 khi chất lượng là yếu tố quyết định: mẫu này dẫn về Elo cho công việc tri thức (1.861 so với 1.753 trên GDPval-AA v2), AA Index (63 so với 61), và các hàng lập trình đã công bố như DeepSWE v1.1 (68,8% so với 65,9%).
Ngày 12 tháng 8 năm 2026, SpaceXAI ra mắt Grok 4.6 với trọng tâm vào tác tử chạy dài và các dự án tương tác, trực quan tham vọng hơn. Mẫu này ngang GPT-5.6 Sol trên Artificial Analysis Intelligence Index và niêm yết $2 cho mỗi triệu token đầu vào, $6 cho mỗi triệu token đầu ra. Claude Opus 5 vốn đã là mẫu chủ lực dùng hằng ngày của Anthropic: mặc định trên Claude Max, mạnh nhất trên Claude Pro, và bằng nửa giá của Claude Fable 5 ở mức $5 / $25 cho mỗi triệu token.
Trong bài viết này, tôi sẽ so sánh Grok 4.6 và Claude Opus 5 về lập trình, công việc tri thức, dự án trực quan, và giá. Để tìm hiểu sâu từng mẫu, hãy xem hướng dẫn Grok 4.6 và hướng dẫn Claude Opus 5 của chúng tôi.
Grok 4.6 là mẫu biên của SpaceXAI ra mắt tháng 8/2026, phát triển từ Grok 4.5 để phục vụ tác tử chạy dài và dự án tương tác, trực quan tham vọng hơn. ID mẫu API là grok-4.6. Cửa sổ ngữ cảnh là 500.000 token, với mức phí 2x khi prompt vượt 200.000 token.
Bài viết của xAI nhấn mạnh lượt thử đầu cho dự án trực quan và tương tác, cùng tự kiểm thử nhiều hơn trên quãng tác vụ dài. Artificial Analysis chấm 61 trên Intelligence Index, ngang GPT-5.6 Sol và sau Claude Opus 5 (tối đa, 63). Mẫu này có trong Cursor và Grok Build, và trên SpaceXAI API cũng như OpenRouter, Vercel, và Cloudflare.
Để tự gọi mẫu, hãy theo hướng dẫn API Grok 4.6 của chúng tôi. Nếu bạn quan tâm lớp tác tử hơn là thẻ mẫu, chúng tôi cũng đã chạy Grok Build so với Claude Code trên một bộ dữ liệu churn cài bẫy. Chúng tôi cũng so sánh với mẫu chủ lực hiện tại của OpenAI trong hướng dẫn Grok 4.6 vs GPT-5.6 Sol.
Claude Opus 5 là mẫu thuộc lớp Opus hiện tại của Anthropic, được định vị là công cụ suy xét dùng hằng ngày, tiệm cận Claude Fable 5 với nửa mức giá. ID mẫu API là claude-opus-5. Đây là mặc định trên Claude Max và là mẫu mạnh nhất trên Claude Pro, với mức $5 / $25 cho mỗi triệu token như Opus 4.8.
Anthropic báo cáo các con số dẫn đầu trên Frontier-Bench v0.1 (43,3%) và GDPval-AA v2 (1.861 Elo), trong khi vẫn sau Mythos 5 ở khai thác an ninh mạng. Chế độ nhanh chạy khoảng nhanh hơn 2,5x so với mặc định với mức giá gấp đôi. Nhà phát triển bắt đầu từ Claude API; các danh mục đám mây cũng liệt kê trên Amazon Bedrock, Google Vertex AI, và Azure AI Foundry.
Chúng tôi phân tích đợt ra mắt trong hướng dẫn Claude Opus 5 và tuyến yêu cầu trong hướng dẫn API Opus 5. Nếu bạn lựa chọn trong hệ sinh thái của Anthropic, hãy xem các so sánh Opus 5 vs Fable 5 và Opus 5 vs Sonnet 5.

Trên các thang tổng hợp mà cả hai phòng lab công bố, Opus 5 nhỉnh hơn: 63 so với 61 trên Artificial Analysis Intelligence Index, và 1861 so với 1753 Elo trên GDPval-AA v2. Bảng giá thì cách biệt rõ: Grok 4.6 là $2/$6 cho mỗi 1M token so với Opus 5 là $5/$25.
| Tính năng | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| AA Intelligence Index | 61 | 63 (tối đa) |
| GDPval-AA v2 (Elo) | 1753 | 1861 |
| API đầu vào / đầu ra mỗi 1M | $2 / $6 | $5 / $25 |
| Cửa sổ ngữ cảnh | 500k | 1M |
| Phụ phí ngữ cảnh dài | 2x ở ≥200k token prompt | Chưa công bố |
| ID mẫu API | grok-4.6 |
claude-opus-5 |
Opus 5 dẫn đầu trên các hàng lập trình đã công bố mà cả hai cùng có. Đáng chú ý nhất, trên DeepSWE v1.1, Opus 5 đạt 68,8% so với 65,9% của Grok 4.6 High trong Cursor.
Một tín hiệu khác là kết quả lần chạy Grok Build vs Claude Code của chúng tôi: Grok 4.6 high so với Claude Opus 5 high, mỗi bên một cuộc hội thoại, trên một bảng churn có gài rò rỉ. Grok Build đưa ra ít câu trả lời hơn nhưng dùng được ngay. Claude Code đi sâu hơn, nhưng cũng tạo ra một lỗi định dạng dashboard.
Nếu bạn đã trả mức giá Anthropic cho công việc theo kho mã, Opus 5 là lựa chọn an toàn hơn theo công bố. Nếu bạn muốn một mẫu lập trình biên mà không tốn như một mẫu biên, Grok 4.6 là lựa chọn trong Cursor mà tôi thực sự sẽ bật sẵn.
Opus 5 dẫn trong công việc tri thức: GDPval-AA v2 là 1861 cho Opus 5 và 1753 cho Grok 4.6. Artificial Analysis vẫn xếp Grok chỉ sau Opus 5 tại đó, với khoảng sai số chồng lấn so với Fable 5 và Qwen3.8 Max.
Khoảng cách hiệu suất lớn hơn. Trên AA-Briefcase, Grok 4.6 đạt 1577, sau gia đình Opus 5, nhưng hoàn thành khoảng 53 lượt và khoảng 0,5 tỷ token đầu vào. Opus 5 (tối đa) mất khoảng 103 lượt và khoảng 2,0 tỷ token đầu vào. Kết luận là Opus 5 thắng trên bảng điểm, còn Grok 4.6 thắng về ngân sách token.
Thông điệp của SpaceXAI cho Grok 4.6 là lượt thử đầu mạnh hơn cho các dự án trực quan và tương tác. Đợt ra mắt Opus 5 của Anthropic thì lặng hơn ở mảng này và nói nhiều hơn về kiểm chứng, kèm "đầu ra trực quan mạnh hơn nhiều" nhưng không có số công khai so với Grok.
Đó là lý do chúng tôi chạy một tác vụ shader chung. Cả hai mẫu đều viết GLSL thật, nhưng kết quả của Opus 5 khớp đề bài sát hơn một chút và phản ứng tốt hơn với chuyển động con trỏ. Kết quả của Grok 4.6 cũng rất đẹp mắt và làm được với ít lượt hơn.

Bảng giá niêm yết là khoảng cách rõ ràng nhất trong so sánh này. Grok 4.6 là $2 đầu vào và $6 đầu ra cho mỗi 1M token, còn Opus 5 là $5 và $25. Điều này khiến mẫu của Anthropic đắt hơn 2,5 lần ở đầu vào và hơn 4 lần ở đầu ra, một khác biệt lớn. Ví dụ, một tháng tạo sinh nặng ở 1M vào / 4M ra là $26 với Grok 4.6 và $105 với Opus 5. Một trợ lý cân bằng hơn ở 1M vào / 250K ra là $3,50 so với $11,25.
Đây là các mức tiêu chuẩn đã công bố, kèm các phần bổ sung thực tế cho cả hai mẫu.
| Mức giá | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Đầu vào, mỗi 1M token | $2,00 | $5,00 |
| Đầu ra, mỗi 1M token | $6,00 | $25,00 |
| Đọc cache, mỗi 1M token | $0,50 | $0,50 |
| Ghi cache, mỗi 1M token | $1,00 (≥200k hàng) | $6,25 (5 phút) / $10 (1 giờ) |
| Biến thể nhanh | $4 / $12 (2x) | $10 / $50 (2x; ~2,5x tốc độ) |
| Phụ phí ngữ cảnh dài | 2x ở ≥200k token prompt ($4 / $1 / $12) | Chưa công bố |
Phần đội giá ở đầu ra là đau nhất. Chế độ nhanh là lớp phủ 2x cho cả hai, không phải một dạng giá thứ ba. Opus 5 cũng công bố giảm 50% cho lô ($2,50 / $12,50), điều mà Grok 4.6 hiện chưa có.
Công thức một lần: (khối lượng ÷ 1M) × mức giá, cộng đầu vào và đầu ra, ở mức chuẩn trừ hàng vượt ngưỡng dùng phụ phí 2x của Grok. Số được làm tròn đến cent dưới $10, còn lại làm tròn đến đô la gần nhất.
| Khối công việc | Grok 4.6 | Claude Opus 5 | Chênh lệch |
|---|---|---|---|
| Trợ lý cân bằng: 1M vào / 250K ra | $3,50 | $11,25 | Opus 5 +$7,75 (221%) |
| Tạo sinh nặng: 1M vào / 4M ra | $26 | $105 | Opus 5 +$79 (304%) |
| Truy xuất, dưới ngưỡng: 10M vào / 1M ra | $26 | $75 | Opus 5 +$49 (188%) |
| Truy xuất, vượt ngưỡng: 10M vào / 1M ra | $52 | $75 | Opus 5 +$23 (44%) |
Truy xuất dưới 200k là câu chuyện của giá đầu vào ($26 so với $75). Dù vậy, phụ phí 200k của Grok cũng ảnh hưởng: Vượt ngưỡng, cùng tổng 10M / 1M chỉ còn $52 so với $75. Phụ phí thu hẹp khoảng cách, nhưng không khiến Opus 5 rẻ hơn.
Biểu đồ của nhà cung cấp sẽ không cho bạn biết mẫu có vẽ được cảnh bạn mô tả hay không. Chúng tôi chạy một tác vụ tác tử lập trình chung từ ngân hàng kiểm thử, rồi tổng hợp kết quả.
Chúng tôi kiểm thử cả hai về khả năng tạo một đồ họa shader toàn cửa sổ hiển thị cực quang trên đường chân trời núi, chạy trên p5.js, với chuột và thời gian được truyền vào dưới dạng uniform. Bài kiểm thử lấy cảm hứng từ prompt shader của Ethan Mollick. Chúng tôi định chủ đề để kết quả dễ so sánh hơn. Cả hai mẫu chạy một lần, không thử lại, trong Cursor với bộ công cụ giống hệt. Cả hai dùng biến thể suy luận cao.
Prompt nguyên văn:
Using p5.js (loaded from a CDN — that is the only external dependency allowed), build a single-file HTML page with a full-window animated shader. The scene: an aurora borealis rippling in curtains over a dark, silhouetted mountain horizon under a star-filled night sky. The aurora should react to the mouse — the curtains brighten and bend toward the cursor as it moves. Write the visual effect as a GLSL fragment shader; use p5 only to host the canvas, run the animation loop, and pass the mouse position and time into the shader as uniforms.
Ship it as one working file named index.html that starts animating on load. Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.
Grok 4.6 xuất một index.html chạy được trong 13 lượt. Hiệu ứng là GLSL fragment shader thật với p5 chỉ dùng để chứa canvas. Các dải rèm chuyển động giống cực quang, với tách ba màu trông đẹp hơn tấm xanh chủ đạo của Opus 5, kèm nền sao nhấp nháy.
Điểm trừ là phần phong cảnh. Dãy núi trông như bóng cắt hoạt hình, nên mức khớp thẩm mỹ là 4 thay vì 5. Tính tương tác với con trỏ ở mức trung bình: Như thấy trong video dưới, đồ họa phản ứng mạnh theo trục x, nhưng không nhiều theo trục y.
Opus 5 cũng vượt bài, cũng dùng GLSL thật. Mức khớp thẩm mỹ rất đúng: ba dãy núi với các sắc xám khác nhau, rèm cực quang dễ nhận, sao nhấp nháy. Màu chủ đạo là xanh lục, cũng là màu phổ biến nhất của cực quang. Vì vậy, xét độ đúng, nó nhỉnh hơn, dù ba màu của Grok trông đẹp mắt hơn theo ý kiến cá nhân tôi. Tính tương tác với con trỏ tốt hơn shader của Grok, với rèm uốn cong và sáng lên theo cả hai trục.
Opus mất nhiều lượt hơn Grok, tổng cộng 46. Dù vậy, 19 lượt là do xin phép thực thi lệnh kiểm chứng (không được phép theo luật bài kiểm), nên chỉ 27 lượt liên quan đến việc tạo shader thuần túy. Dẫu vậy, Grok chỉ dùng một nửa số lượt của Opus.
| Thước đo | Grok 4.6 high | Claude Opus 5 high |
|---|---|---|
| Lượt | 13 | 27 |
| Chạy được | đạt | đạt |
| Khớp thẩm mỹ | 4 | 5 |
| Năng lực shader | 5 | 5 |
| Tương tác con trỏ | 3 | 5 |
| Tuân thủ kỹ thuật | 5 | 5 |
Opus 5 khớp đề bài sát hơn: núi phân lớp và phản hồi chuột trên cả hai trục. Rèm của Grok 4.6 màu sắc hơn và vẫn vượt, nhưng núi bị giản lược quá, và con trỏ chủ yếu điều khiển trục x.
Đây là n=1, không phải con số token hay chi phí, và chỉ kiểm tra shader cảnh mô tả với GLSL phản ứng con trỏ, không phải lập trình kho mã hay công việc tri thức.

Nếu quyết định dựa trên bảng điểm, chọn Opus 5. Nếu dựa trên hóa đơn, Grok 4.6 là mẫu biên mà tôi sẽ để chạy thực sự.
Chọn Grok 4.6 nếu...
Cả hai mẫu có thể được truy cập theo nhiều cách. Chuỗi model cần dùng là grok-4.6 và claude-opus-5.
| Bề mặt | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Ứng dụng người dùng | Grok Build; Cursor (desktop, web, iOS, CLI) | Claude Pro; mặc định trên Claude Max |
| API bên thứ nhất | Có (SpaceXAI API) | Có (Claude API) |
| Nền tảng đám mây | Amazon Bedrock, Google Vertex AI, Azure AI Foundry | Amazon Bedrock, Google Vertex AI, Azure AI Foundry |
| Tác tử lập trình | Cursor, Grok Build | Claude Code, Cursor |
| Router bên thứ ba | OpenRouter, Vercel, Cloudflare | OpenRouter, Vercel, Cloudflare |
| ID mẫu API | grok-4.6 |
claude-opus-5 |
Trong Cursor, cả hai đều có trong danh sách chọn. Claude Code là bản địa của Anthropic; Grok Build đọc cây .claude/, điều mà Claude Code sẽ không làm ngược lại cho tệp .grok/. API chỉ là đổi một chuỗi model trong từng SDK của nhà cung cấp.
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # Grok 4.6 is grok-4.6 on the SpaceXAI SDK, not this client
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function to reject leaked labels."}],
)
print(response.content[0].text)
Thiết lập đầy đủ cho mỗi API có trong hướng dẫn API Grok 4.6 và hướng dẫn API Claude Opus 5. Nếu bạn muốn sản phẩm tác tử thay vì ID mẫu, hãy bắt đầu với Claude Code 101.
Nếu công việc là cảnh trực quan mô tả hoặc tác tử công việc tri thức mà bạn sẽ chấm theo Elo, hãy dùng Claude Opus 5. Nếu công việc là tác tử lập trình biên và bạn cũng sẽ chấm theo hóa đơn, hãy dùng Grok 4.6.
Điều nổi bật là các benchmark quyết định rất ít. Hai điểm trên AA Index, hay trăm Elo trên GDPval-AA, là khoảng cách hẹp hơn nhiều so với trên bảng giá: $105 so với $26 cho cùng một tháng tạo sinh nặng. Mẫu thì sát nhau; hóa đơn thì không.
Nếu bạn muốn các khái niệm đằng sau những tác tử này, tôi gợi ý lộ trình kỹ năng AI Fundamentals. Với quy trình gốc Claude, Claude Code 101 là điểm khởi đầu thực tiễn.
Dùng Grok 4.6 khi chi phí API là ràng buộc. Mẫu này niêm yết $2/$6 cho mỗi 1M token so với Opus 5 là $5/$25, nên một tháng tạo sinh nặng là $26 so với $105. Nó cũng hoàn thành shader cực quang của chúng tôi với một nửa số lượt của Opus và kết quả tốt, và Artificial Analysis báo cáo ít lượt và ít token đầu vào hơn Opus 5 tối đa trên AA-Briefcase.
Hãy dùng Claude Opus 5 khi chất lượng là yếu tố quyết định: mẫu này dẫn về Elo cho công việc tri thức (1.861 so với 1.753 trên GDPval-AA v2), AA Index (63 so với 61), và các hàng lập trình đã công bố như DeepSWE v1.1 (68,8% so với 65,9%).
Grok 4.6 có giá $2 đầu vào và $6 đầu ra cho mỗi 1M token. Claude Opus 5 là $5 và $25, giống Opus 4.8. Grok 4.6 phụ thu 2x cho prompt từ 200k token trở lên; Opus 5 không công bố phụ phí ngữ cảnh dài. Đọc cache là $0,50 / 1M cho cả hai ở mức chuẩn.
Grok 4.6 là grok-4.6 trên SpaceXAI API. Claude Opus 5 là claude-opus-5 trên Claude API. Chúng không thể thay thế trực tiếp qua SDK; mỗi ID thuộc về client riêng.
Có, nếu bộ chọn tác tử của bạn hiển thị cả hai. Cursor liệt kê Grok 4.6 và Claude Opus 5 như các model có thể chọn, và hầu hết router, danh mục đám mây phổ biến đều có cả hai, nên bộ chọn hiếm khi là ràng buộc. Sự bất đối xứng nằm ở tác tử bên thứ nhất: Claude Code là bản địa Anthropic và sẽ không chạy Grok, trong khi Grok Build đọc cây .claude/, vì vậy cấu hình kiểu Claude có thể mang sang hướng đó nhưng không ngược lại.
Tom là một nhà khoa học dữ liệu và giảng viên kỹ thuật. Anh viết và quản lý các bài hướng dẫn và bài blog về khoa học dữ liệu của DataCamp. Trước đây, Tom làm việc trong lĩnh vực khoa học dữ liệu tại Deutsche Telekom.
Học AI cùng DataCamp!
Tracks
Courses
Courses