Chuyển đến nội dung chính

Claude Opus 5 so với Claude Sonnet 5: Nên chọn cái nào

Cân nhắc điểm chuẩn của Claude Opus 5 với giá của Claude Sonnet 5 để chọn đúng mẫu Anthropic cho đội của bạn.
Đã cập nhật 31 thg 8, 2026  · 5 phút đọc

Khám phá với AI

ChatGPTClaudePerplexity

Anthropic chưa công bố bài đo trực tiếp giữa Opus 5 và Sonnet 5. Mỗi bài ra mắt đều so sánh mẫu của mình với thế hệ trước và với Opus 4.8. Vì vậy, các con số dưới đây chỉ phản ánh một phần bức tranh. Phần còn lại vẫn là phán đoán bạn luôn phải đưa ra với bất kỳ cặp Opus vs. Sonnet nào: bạn thực sự cần “trần” năng lực đến mức nào, và bạn sẵn sàng trả bao nhiêu cho điều đó.

Claude Opus 5 là gì?

Opus 5 là mẫu cao cấp nhất của Anthropic, ra mắt ngày 24 tháng 7 năm 2026, có giá 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra. Anthropic gọi đây là mẫu tiên tiến nhất trên Frontier-Bench và GDPval-AA, và tiệm cận mẫu Fable 5 lớn hơn với mức giá bằng một nửa. Đây là mẫu mặc định trên Claude Max và là mẫu mạnh nhất trên Claude Pro.

Điểm nổi bật của nó là tự kiểm chứng: tự rà soát kết quả, dựng bộ kiểm thử khi không có dữ liệu cấp sẵn, và phản biện lại hướng dẫn kém thay vì làm theo máy móc.

Claude Sonnet 5 là gì?

Sonnet 5 là mẫu tầm trung của Anthropic, ra mắt ngày 30 tháng 6 năm 2026. Anthropic mô tả đây là phiên bản Sonnet có tính tác vụ tự chủ cao nhất từ trước đến nay, với hiệu năng tiệm cận Opus 4.8 ở mức giá thấp hơn. Đây là mẫu mặc định trên gói Free và Pro, đồng thời có mặt trên Max, Team, Enterprise và API.

Giá: 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra đến hết ngày 31 tháng 8 năm 2026, sau đó chuẩn là 3/15 USD.

Khác biệt theo hạng, dưới góc nhìn thực tế

Đây là phần mà các bài ra mắt không nói thẳng, vì đó là cách dòng sản phẩm của Anthropic vận hành nói chung, không riêng cặp này.

Opus là mẫu “trần” năng lực

Bạn chọn nó khi sai lầm là đắt giá, khi một tác vụ chạy lâu và tự động mà không ai rà soát giữa chừng, hoặc khi vấn đề thực sự mới lạ chứ không chỉ là biến thể của thứ mô hình đã thấy hàng nghìn lần. Tái cấu trúc sâu đa tệp, câu hỏi nghiên cứu mơ hồ, các chuỗi tác vụ tự chủ dài nơi lỗi có thể tích lũy — đó là lãnh địa của Opus. Bạn đang trả tiền để mô hình tự bắt lỗi trước khi chúng thành vấn đề của bạn.

Sonnet là “máy cày” công việc

Nó được xây để đủ nhanh và rẻ cho vận hành liên tục: trợ lý chat, phân loại khối lượng lớn, lập trình lặp nơi bạn vẫn ở trong vòng lặp để rà soát mỗi vài bước, các ứng dụng nhạy độ trễ. “Trần” phán đoán thấp hơn, nhưng với phần lớn công việc thực tế, bạn hiếm khi chạm tới trần đó. Hoạt động thường nhật của đa số đội nên nghiêng về Sonnet, còn Opus được gọi vào chọn lọc cho các tác vụ thực sự cần đến nó.

Riêng Sonnet 5 là nỗ lực của Anthropic nhằm đẩy trần đó cao hơn thường lệ cho một mẫu tầm trung — vì thế mới có “Sonnet mang tính tác vụ tự chủ nhất từ trước đến nay” và tuyên bố rằng nó tiệm cận Opus 4.8 trên một số tác vụ. Đó là bối cảnh để đọc các con số điểm chuẩn bên dưới: Sonnet 5 không chỉ rẻ, mà còn rẻ và gần với hạng Opus hơn so với các phiên bản Sonnet trước.

Những con số phát hành thực sự cho thấy gì

Giá

Khác biệt rõ ràng và ít nhập nhằng nhất. Sonnet 5 có mức 2/10 USD (đến hết 31/8) hoặc 3/15 USD (chuẩn) so với mức cố định 5/25 USD của Opus 5 — Sonnet 5 tốn 40–60% chi phí của Opus 5 tùy giai đoạn giá.

Căn chỉnh 

Đây là chỗ duy nhất hai bài ra mắt nêu đích danh nhau. Kiểm toán tự động của Anthropic kết luận Opus 5 “tuân thủ Hiến pháp của Claude tốt hơn Opus 4.8, Sonnet 5 hoặc Fable 5” — một kết quả được nêu rõ, không phải suy diễn. Opus 5 đạt 2,3 ở bài kiểm toán đó, mức điểm an toàn nhất của nó tới nay. Sonnet 5 cải thiện so với thế hệ trước (ít ảo giác hơn, ít xu nịnh hơn, chống chịu tốt hơn với tấn công chèn prompt), nhưng Anthropic lưu ý nó vẫn có tỷ lệ hành vi lệch chuẩn cao hơn Opus 4.8.

An ninh mạng

Cả hai mẫu đều không được huấn luyện có chủ đích về không gian mạng, nhưng chúng cho kết quả khác nhau.

Opus 5 tiệm cận Mythos 5 trong việc phát hiện lỗ hổng, dù kém hơn khi chuyển chúng thành khai thác thực tế. Sonnet 5 đứng lùi xa hơn: Anthropic nói thẳng rằng Sonnet 5 có “năng lực an ninh mạng kém đáng kể so với Opus 4.8 và Mythos 5”, và trong một bài đánh giá phát triển khai thác trên Firefox, nó không bao giờ tạo được một khai thác hoạt động đầy đủ (tỷ lệ thành công 0,0%, chỉ nhỉnh hơn đôi chút so với Sonnet 4.6 ở các nỗ lực bán phần).

Nếu trường hợp sử dụng của bạn có liên quan đến không gian mạng, khoảng cách này là có thật và ưu thế nghiêng rõ về Opus 5.

Lập trình và công việc tri thức

Hai bài ra mắt dùng các bộ điểm chuẩn khác nhau, nên không có một bảng điểm so kè sạch sẽ.

Opus 5 đạt điểm hơn gấp đôi Opus 4.8 trên Frontier-Bench v0.1 và chỉ kém 0,5% so với Fable 5 trên CursorBench 3.2 với chi phí bằng một nửa. Sonnet 5 được mô tả là tiệm cận Opus 4.8 trên BrowseComp và OSWorld-Verified ở mức nỗ lực cao.

Đọc cùng với logic phân hạng ở trên: Sonnet 5 tiến gần trên các tác vụ Anthropic chọn để nhấn mạnh, nhưng các chiến thắng của Opus 5 có vẻ lớn hơn và rộng hơn. Hãy xem phần này như chỉ dẫn định hướng, không phải đo lường tuyệt đối.

Khi nào chọn cái nào

Chọn Opus 5 nếu 

tác vụ có rủi ro cao, chạy dài, hoặc thực sự mới lạ; bạn làm về khoa học đời sống, hóa học, hoặc công việc tác vụ tự chủ nhiều bước phức tạp; bạn cần mẫu có mức căn chỉnh cao nhất hiện có; mọi thứ liên quan đến an ninh mạng đều nằm trong phạm vi.

Chọn Sonnet 5 nếu

bạn vận hành khối lượng lớn, độ trễ quan trọng, hoặc tác vụ đủ rõ phạm vi đến mức không cần “trần” phán đoán của Opus; bạn dùng gói Free hoặc Pro nơi nó đã là mặc định; chi phí trên mỗi token là ràng buộc chính.

Không chọn cái nào, nếu

bạn cần công việc an ninh mạng với hàng rào kiểm soát nới lỏng. Opus 5 sẽ tự động lùi về Opus 4.8, và Sonnet 5 thì ở phía sau Opus 4.8 một cách rõ ràng.

Kết luận

Yếu tố quyết định ở đây phần lớn cũng là thứ quyết định cho mọi câu hỏi Opus so với Sonnet: tác vụ này có cần “trần” năng lực, hay chỉ cần làm ổn định ở quy mô lớn? Sonnet 5 đẩy trần đó cao hơn các phiên bản Sonnet trước — đó là điểm đáng chú ý trong lần ra mắt này. Nhưng ở nơi Anthropic đặt con số cho cả hai mẫu — bài kiểm toán căn chỉnh — Opus 5 vượt lên, và câu chuyện an ninh mạng cũng chỉ cùng một hướng. Mặc định hãy chọn Sonnet 5 cho khối lượng lớn, và chuyển sang Opus 5 khi tác vụ không thể chịu đựng một câu trả lời sai.

Chủ đề
Trí tuệ Nhân tạo
Có liên quan

blogs

Claude Opus 4.6: Tính năng, Điểm chuẩn, Bài kiểm tra thực hành và hơn thế nữa

Mô hình mới nhất của Anthropic dẫn đầu ở mã hóa tác tử và lập luận phức tạp. Thêm vào đó, nó có cửa sổ ngữ cảnh 1M.
Matt Crabtree's photo

Matt Crabtree

10 phút

Xem ThêmXem Thêm