Tracks
Nếu bạn đang chọn một mô hình tầm trung để đứng sau một agent chạy suốt ngày, hai ứng viên rõ ràng hiện nay là GPT-5.6 Terra và Claude Sonnet 5. Cả hai đều là mô hình mặc định mà nhà cung cấp đưa cho người dùng miễn phí, đều có cửa sổ ngữ cảnh khoảng 1M token, và đều có giá input token chênh nhau chưa đến một đô.
Trong bài viết này, tôi sẽ so sánh GPT-5.6 Terra và Claude Sonnet 5 trên các tác vụ lập trình và terminal, công việc tri thức, tư thế an ninh mạng, hành vi trong ngữ cảnh dài, bề mặt điều khiển API và giá, để bạn có thể chọn mô hình phù hợp với khối lượng công việc. Để tìm hiểu sâu từng mô hình riêng lẻ, hãy xem các hướng dẫn của chúng tôi về dòng GPT-5.6 và Claude Sonnet 5.
TL;DR
- Terra là lựa chọn mạnh hơn cho các agent lập trình chạy bằng terminal và các pipeline nặng công cụ, nơi các tính năng tiết kiệm token phát huy hiệu quả thực tế.
- Sonnet 5 là lựa chọn điềm tĩnh hơn cho công việc ngữ cảnh dài và tài liệu nặng, vì mức giá của nó giữ nguyên trên toàn bộ cửa sổ.
- Chọn GPT-5.6 Terra nếu agent của bạn sống trong shell, gọi nhiều công cụ ở mỗi lượt, hoặc bạn muốn token đầu ra rẻ hơn sau tháng 8.
- Chọn Claude Sonnet 5 nếu bạn gửi prompt rất lớn, muốn tính phí theo token có thể dự đoán, hoặc bạn chủ động muốn một mô hình từ chối công việc khai thác lỗ hổng.
GPT-5.6 Terra là gì?
GPT-5.6 Terra là tầng giữa của dòng GPT-5.6 của OpenAI, ra mắt khả dụng rộng rãi vào ngày 9 tháng 7, 2026, cùng với bản đầu bảng Sol và tầng rẻ nhất, Luna. OpenAI mô tả Terra là lựa chọn cân bằng cho công việc hàng ngày và lưu ý rằng nó tương ứng gần với tầng mini của các dòng GPT-5 trước đây. Nó có cửa sổ ngữ cảnh 1.050.000 token, trần đầu ra 128.000 token và mốc cắt kiến thức ngày 16 tháng 2, 2026.
Hai điểm khiến Terra thú vị chứ không chỉ rẻ. Nó thừa hưởng Programmatic Tool Calling từ Responses API, cho phép mô hình viết và chạy các chương trình nhỏ trong bộ nhớ để điều phối công cụ, thay vì vòng lặp qua mô hình ở mỗi phản hồi công cụ. Và vào ngày 30 tháng 7, 2026, OpenAI giảm giá Terra 20%, từ $2,50/$15 khi ra mắt xuống $2,00/$12 trên mỗi 1M token.
Chúng tôi đã đề cập đến toàn bộ dòng trong hướng dẫn GPT-5.6 Sol, Terra và Luna, và nếu bạn muốn xem tầng đầu bảng đang được dùng cho gì, bài viết của chúng tôi về cách GPT-5.6 Sol giúp bác bỏ giả thuyết Maxwell là một gợi ý hay. Cũng có một so găng ở cấp flagship trong bài so sánh Claude Opus 5 vs GPT-5.6 Sol của chúng tôi.
Claude Sonnet 5 là gì?
Claude Sonnet 5 là mô hình tầm trung của Anthropic, ra mắt ngày 30 tháng 6, 2026, được giới thiệu là Sonnet tác vụ tự chủ (agentic) nhất mà công ty từng phát hành. Anthropic cho rằng nó lập kế hoạch, điều khiển trình duyệt và terminal, và chạy tự động ở mức trước đây cần các mô hình hạng Opus, tiệm cận Opus 4.8 về suy luận, sử dụng công cụ, lập trình và công việc tri thức với mức giá thấp hơn.
Đây là mô hình mặc định trên gói Free và Pro, và đi kèm một tập ràng buộc cố ý: temperature, top_p và top_k bị loại bỏ, việc bật tư duy mở rộng thủ công trả về lỗi 400, và tư duy thích ứng được bật theo mặc định. Nó cũng dùng bộ tách token mới tạo ra khoảng 30% token nhiều hơn cho cùng văn bản so với Sonnet 4.6, mà Anthropic bù đắp bằng giá giới thiệu đến hết ngày 31 tháng 8, 2026.
Chúng tôi đã đi qua các con số khi ra mắt trong hướng dẫn Claude Sonnet 5 và so sánh lên trên với bản đầu bảng của Anthropic trong Claude Opus 5 vs Claude Sonnet 5.
GPT-5.6 Terra vs Claude Sonnet 5: So sánh trực diện
Dưới đây là diện mạo của hai mô hình đặt cạnh nhau trước khi đi vào từng nhóm năng lực.
| Tính năng | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|
| Nhà cung cấp và ngày phát hành | OpenAI, khả dụng rộng rãi 9/7/2026 | Anthropic, 30/6/2026 |
| Định vị | Tầm trung | Tầm trung |
| Cửa sổ ngữ cảnh | 1.050.000 token | 1M token |
| Đầu ra tối đa | 128K token | 128K token |
| Giá trên mỗi 1M token | $2,00 vào / $12,00 ra | $3,00 vào / $15,00 ra ($2,00/$10,00 đến 31/8/2026) |
| Phụ phí ngữ cảnh dài | 2x input, 1,5x output trên 272K input token | Chưa công bố; phẳng đến 1M |
| Tính năng đặc trưng | Programmatic Tool Calling trong Responses API | Tư duy thích ứng với các mức nỗ lực có thể chọn |
| Tư thế an ninh mạng | Được huấn luyện cho mảng cyber; năng lực phòng thủ sau Trusted Access | Không huấn luyện cho cyber; biện pháp bảo vệ bật mặc định |
| Tầng miễn phí | Mặc định cho người dùng Free và Go trong ChatGPT Work và Codex | Mặc định cho gói Free và Pro |
| API model ID | gpt-5.6-terra |
claude-sonnet-5 |
Agent lập trình và terminal
Thường thì phần làm việc trong repository nghiêng về Anthropic, còn phần terminal nghiêng về OpenAI.
Sự phân hóa sau vẫn giữ nguyên: Trên Terminal-Bench 2.1, Terra đạt 87,4%, so với 80,4% của Sonnet 5 trong tài liệu ra mắt của Anthropic, chênh 7 điểm trên các quy trình dòng lệnh. Đáng chú ý, Terra cũng vượt Claude Opus 4.8 (78,9%) và Claude Fable 5 (83,1%) trong lần chạy cùng bài đánh giá của OpenAI.
Nhưng hiện tại, cả hai mô hình tầm trung cạnh tranh đều ngang nhau cho lập trình trên repo. Trên SWE-Bench Pro, nơi chạy các bản sửa nhiều bước trên các repository thực, OpenAI báo Terra đạt 63,4% và Anthropic báo Sonnet 5 đạt 63,2%.
| Điểm chuẩn | GPT-5.6 Terra | Claude Sonnet 5 | Ghi chú |
|---|---|---|---|
| SWE-Bench Pro | 63,4% | 63,2% | Nhà cung cấp tự báo cáo trên khung riêng; coi như hòa |
| Terminal-Bench 2.1 | 87,4% | 80,4% | Nhà cung cấp báo cáo; lợi thế lập trình lớn nhất đã công bố của Terra |
| Artificial Analysis Coding Agent Index v1.1 | 77,4 | Chưa công bố | Chỉ số độc lập; Terra cao hơn Fable 5 ở mức 77,2 |
Cách diễn giải của chính Anthropic cũng ủng hộ sự phân hóa này. Câu chuyện lập trình của Sonnet 5 nói về khả năng theo đuổi đến cùng hơn là điểm đỉnh: người thử sớm mô tả nó hoàn thành các tác vụ nơi Sonnet 4.6 dừng lại và tự kiểm tra đầu ra mà không cần nhắc.
Nếu agent của bạn sống trong shell, Terra có lợi thế. Nếu nó sống trong codebase để suy luận về một lỗi, các điểm chuẩn nói rằng bạn đang chọn giữa hai mô hình cùng đẳng cấp.

Công việc tri thức và tác vụ chuyên môn
Cả hai nhà cung cấp đều báo cáo GDPval-AA v2, một thước đo kiểu Elo về chất lượng đầu ra chuyên nghiệp, và các con số đủ gần để coi như không phân thắng bại. OpenAI đặt Terra ở mức 1.593 Elo; Anthropic đặt Sonnet 5 ở 1618. OpenAI chấm Claude Opus 4.8 ở 1600 Elo trên bài đánh giá này, trong khi Anthropic chấm cùng mô hình ở 1615, vì vậy chênh 25 điểm giữa Terra và Sonnet 5 nằm trong nhiễu phương pháp.
Nơi Terra có tuyên bố chưa được phản hồi là Agents' Last Exam, một đánh giá về các quy trình công việc chuyên môn chạy dài hạn trên 55 lĩnh vực. Terra đạt 50,4%, vượt GPT-5.5 (46,9%), Claude Opus 4.8 (45,2%) và Claude Fable 5 (40,5%). Anthropic không báo cáo Sonnet 5 trên bài đánh giá đó, nên hãy coi đây là mảnh đất do OpenAI chọn chứ chưa phải phán quyết.
Máy tính người dùng là nơi tôi khuyên bạn không nên so sánh trực tiếp. OpenAI báo Terra đạt 50,2% trên OSWorld 2.0, trong khi Anthropic báo Sonnet 5 đạt 81,2% trên OSWorld-Verified. Đó là các tập đánh giá khác nhau với cách chấm khác nhau, và Anthropic đã điều chỉnh cách chạy OSWorld-Verified cho lần phát hành này, nên đặt hai con số cạnh nhau không mang ý nghĩa gì.
Ưu thế thực tế của Terra ở mảng này là cách tính token. Notion báo cáo rằng nhiều agent chạy GPT-5.5 cho hiệu năng tương đương trên Terra với chi phí chỉ bằng một nửa và ít hơn 16% token, và Clio báo Programmatic Tool Calling cắt 38% token prompt trên phân tích tài liệu nhiều bước mà không giảm chất lượng. Đây là các tuyên bố đối tác nhà cung cấp, không phải đo lường độc lập, nhưng chúng cụ thể về những gì đã thay đổi.
An ninh mạng: hai canh bạc đối nghịch
Đây là khoảng cách lớn nhất trong so sánh, và là quyết định thiết kế chứ không phải sự tình cờ về năng lực.
OpenAI huấn luyện dòng GPT-5.6 cho công việc cyber: Terra đạt 91,8% trên các thử thách Capture-the-Flag, 57,7% trên SEC-Bench Pro, 52,9% trên ExploitBench và 23,2% trên ExploitGym. Hai con số trong số đó vượt GPT-5.5, bản flagship trước đó, đạt 45,8% trên SEC-Bench Pro và 47,9% trên ExploitBench.
Anthropic đi theo hướng ngược lại. Sonnet 5 không được huấn luyện có chủ đích cho các tác vụ an ninh mạng, và trên một bài đánh giá phát triển exploit xây dựng cùng Mozilla dựa trên lỗ hổng Firefox 147, nó không bao giờ tạo ra exploit hoạt động, đạt 0,0%. Anthropic phát hành Sonnet 5 với các biện pháp bảo vệ cyber thời gian thực bật mặc định và khuyến nghị Opus 4.8 cho công việc cyber cần nới lỏng rào chắn.
Với đa số độc giả, đây là ưu điểm của Sonnet 5 chứ không phải điểm yếu. Nếu bạn xây sản phẩm mà việc mô hình cố gắng tạo exploit là rủi ro, một mô hình từ chối đáng tin cậy là phụ thuộc an toàn hơn. Nếu bạn làm an ninh phòng thủ, Terra nằm trong chương trình Daybreak Trusted Access for Cyber của OpenAI, và từng thành viên cần bật passkey dựa trên phần cứng trước ngày 1/9 để giữ quyền truy cập các mô hình có năng lực cyber cao nhất.
Cũng đáng lưu ý chi phí ma sát phía OpenAI. OpenAI nói rằng các biện pháp bảo vệ cyber của GPT-5.6 Sol chặn khoảng gấp 10 lần hoạt động có thể gây hại so với các mô hình trước, và họ thêm tùy chọn thử lại trên mô hình năng lực thấp hơn trong ChatGPT và Codex chính vì các yêu cầu vô hại bị chặn. Các chủ đề trên Reddit phía Anthropic cũng báo cáo phàn nàn tương tự: Sonnet 5 đang chặn nội dung dạy bảo mật vô hại, nên cả hai bên đều chưa giải quyết xong vấn đề chặn quá đà.
Cửa sổ ngữ cảnh và công việc ngữ cảnh dài
Về danh nghĩa, hai mô hình giống nhau: Terra công bố cửa sổ ngữ cảnh 1.050.000 token với trần đầu ra 128.000 token, còn Sonnet 5 có cửa sổ 1M với trần đầu ra 128K. Khác biệt nằm ở chuyện gì xảy ra khi bạn thực sự lấp đầy nó.
Terra đã công bố điểm truy xuất trên toàn cửa sổ. Trên OpenAI MRCR v2 8-needle, nó đạt 89,6% trong dải 256K-512K và 72,5% trong dải 512K-1M, gần với Sol ở mức 91,5% và 73,8% và vượt xa Luna ở 41,3%. Điều này có nghĩa bạn có thể kỳ vọng mô hình tìm được chi tiết ẩn trong khoảng 9/10 trường hợp trong tài liệu 512k, khiến nó trở thành bạn đồng hành rất đáng tin cho trích xuất tri thức. Anthropic không công bố các con số truy xuất needle tương đương cho Sonnet 5 khi ra mắt.
Hành vi tính phí mới là khác biệt hệ trọng hơn. Prompt vượt 272K input token trên Terra sẽ bị tính 2x input và 1,5x output cho toàn bộ yêu cầu, không chỉ phần vượt. Sonnet 5 không có phụ phí ngữ cảnh dài đã công bố, nên mức giá giữ nguyên trên toàn cửa sổ. Tôi sẽ đưa số cụ thể ở phần giá, vì điều này đảo ngược mô hình nào rẻ hơn.
Bề mặt điều khiển: nỗ lực, tư duy và ràng buộc API
Cả hai mô hình đều có núm chỉnh mức nỗ lực suy luận, rồi tách bạch rõ rệt về mức độ thứ khác bạn được phép đụng vào.
Sonnet 5 loại bỏ hoàn toàn temperature, top_p và top_k, và các lệnh gọi đặt những tham số đó sẽ trả về lỗi 400. Tư duy mở rộng thủ công cũng trả về 400; bạn có tư duy thích ứng bật mặc định, hoặc tắt tư duy hoàn toàn.
Sonnet 5 cũng không hỗ trợ Priority Tier trên nền tảng Anthropic, điều này quan trọng nếu đội bạn dựa vào nó để đảm bảo độ trễ trên Opus hoặc Sonnet 4.6 hiện nay. Anthropic đã tăng hạn mức tốc độ trên Chat, Cowork, Claude Code và Claude Platform để hấp thụ mức sử dụng token nặng hơn do các mức nỗ lực cao tạo ra.
Bề mặt của Terra rộng hơn theo hướng khác. Các tính năng đáng biết:
-
Programmatic Tool Calling trong Responses API, chạy các chương trình điều phối trong bộ nhớ và tương thích Zero Data Retention.
-
Beta đa agent trong Responses API, cho phép mô hình chạy các tiểu agent đồng thời và tổng hợp kết quả trong một yêu cầu.
-
Cài đặt nỗ lực
max, có thể bật bởi bất kỳ người dùng có quyền GPT-5.6 trong ChatGPT Work và Codex. -
Điểm ngắt cache tường minh với thời gian lưu cache tối thiểu 30 phút, đọc cache giảm 90% chi phí, và ghi cache ở mức 1,25x giá input không cache.
-
Gọi hàm, đầu ra có cấu trúc, shell lưu trữ, trình thông dịch mã và computer use trên Responses API, chưa hỗ trợ fine-tuning.
Một bất đối xứng cần lưu ý: Cài đặt ultra của OpenAI điều phối bốn agent song song, nhưng mọi điểm chuẩn ultra được công bố đều thuộc về Sol, không phải Terra. Đừng giả định tầng tầm trung có mức tăng đa agent như nhau cho đến khi có ai đó công bố số Terra Ultra.
Giá: bạn thực sự trả bao nhiêu
Hiện Terra và Sonnet 5 chỉ chênh nhau chưa đến một đô ở phần input, vì vậy hình dạng khối lượng công việc, chứ không phải mức giá niêm yết, mới là thứ quyết định hóa đơn.
So sánh mức giá theo token
| Mức | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|
| Input, mỗi 1M token | $2,00 | $3,00 ($2,00 đến 31/8/2026) |
| Output, mỗi 1M token | $12,00 | $15,00 ($10,00 đến 31/8/2026) |
| Phụ phí ngữ cảnh dài | 2x input, 1,5x output trên 272K input token | Chưa công bố; phẳng đến 1M |
| Token tư duy | Không công bố mức riêng | Tính phí như token đầu ra |
| Truy cập tầng miễn phí | Mặc định cho Free và Go trong ChatGPT Work và Codex | Mặc định trên gói Free và Pro |
Mức $2,00/$12,00 của Terra phản ánh mức cắt giảm 20% mà OpenAI áp dụng ngày 30/7/2026, từ $2,50/$15,00 khi ra mắt. Đọc input từ cache trên Terra là $0,20 cho mỗi 1M, và Anthropic hỗ trợ prompt caching cho Sonnet 5 mà không tách riêng mức giá cho Sonnet trong tài liệu ra mắt.
Vì Anthropic tính phí token tư duy ở mức giá đầu ra, chạy Sonnet 5 ở nỗ lực rất cao là hệ số nhân trực tiếp trên dòng chi phí đắt nhất. Đó là cách dễ nhất để vượt ngân sách nếu bạn ước tính dựa trên khối lượng input.
Một khối lượng công việc thực tế tốn bao nhiêu
Công thức đơn giản: (khối lượng ÷ 1M) × mức giá, cộng gộp giữa input và output. Tôi đã làm ba dạng khối lượng ở mức giá chuẩn, được chọn vì mỗi dạng cô lập một cơ chế mà hai mô hình này thực sự khác nhau.
| Khối lượng | GPT-5.6 Terra | Claude Sonnet 5 | Chênh lệch |
|---|---|---|---|
| Nặng sinh nội dung: 1M vào / 4M ra | $50 | $63 | Sonnet 5 +$13 (26%) |
| Truy xuất, dưới ngưỡng: 10M vào / 1M ra, mỗi yêu cầu dưới 272K | $32 | $45 | Sonnet 5 +$13 (41%) |
| Truy xuất, vượt ngưỡng: 10M vào / 1M ra, mỗi yêu cầu trên 272K | $58 | $45 | Terra +$13 (29%) |
Hàng thứ ba là phát hiện chính. Không có gì thay đổi về tổng khối lượng giữa hàng hai và ba, chỉ thay đổi kích thước của từng yêu cầu, và phụ phí 272K của Terra biến lợi thế chi phí 41% thành bất lợi 29%. Nếu bạn thường xuyên nhồi 300K token văn bản hợp đồng hoặc ngữ cảnh repository vào một lần gọi, mức giá dán trên Terra dễ gây hiểu lầm.
Hàng nặng sinh nội dung cũng đảo ngược nếu bạn mua trước tháng 9. Ở mức giới thiệu $2,00/$10,00 của Sonnet 5, khối lượng đó tốn $42 so với $50 của Terra, vậy Sonnet 5 rẻ hơn $8 cho đến khi mức giá chuẩn áp dụng từ ngày 1/9/2026. Anthropic đặt khung thời gian giới thiệu để việc di trú từ Sonnet 4.6 gần như trung hòa chi phí, điều đáng nhớ trước khi bạn lập ngân sách dựa trên nó.

Tại sao cùng một tác vụ lại tốn các mức khác nhau
Những mức giá này chỉ chuyển thành hóa đơn nếu cả hai mô hình tiêu thụ cùng số token cho cùng công việc, mà thường thì không. Terra và Sonnet 5 dùng các bộ tách token khác nhau từ các nhà cung cấp khác nhau, nên văn bản giống hệt sẽ cho số lượng token input khác nhau cho mỗi mô hình trước khi mô hình phản hồi.
Không nhà cung cấp nào công bố số đếm token giữa các đối tượng, nên tôi không thể đưa ra con số điều chỉnh. Những gì tồn tại là các tuyên bố tiền nhiệm không nói trực tiếp về Terra so với Sonnet 5:
- Anthropic ghi nhận bộ tách token mới của Sonnet 5 tạo ra khoảng 30% token nhiều hơn Sonnet 4.6, và
- Notion báo Terra dùng ít hơn 16% token so với GPT-5.5.
Lời khuyên của tôi là coi bảng trên như so sánh mức giá chứ không phải dự báo, và đo đếm token của chính bạn trên mẫu đại diện trước khi cam kết. Thay đổi bộ tách token của Sonnet 5 đặc biệt đã khiến nhiều đội bất ngờ khi ra mắt, với bài đánh giá của Simon Willison và các công ty tư vấn đám mây đều nêu nó là bất ngờ di trú lớn nhất.
Khi nào chọn GPT-5.6 Terra so với Claude Sonnet 5
Dưới đây là cách quyết định phân rã theo các kịch bản tôi kỳ vọng phần lớn độc giả sẽ gặp.
| Tình huống sử dụng | Khuyến nghị | Lý do |
|---|---|---|
| Agent lập trình Terminal và CLI | GPT-5.6 Terra | 87,4% trên Terminal-Bench 2.1 so với 80,4% của Sonnet 5. |
| Sửa lỗi ở cấp độ repository | Cả hai | 63,4% vs 63,2% trên SWE-Bench Pro là hòa; chọn theo giá và hệ sinh thái. |
| Ngữ cảnh rất lớn (300K+ token) | Claude Sonnet 5 | Không có phụ phí ngữ cảnh dài, trong khi Terra tính 2x input trên 272K. |
| Pipeline nặng công cụ với nhiều lần gọi mỗi lượt | GPT-5.6 Terra | Programmatic Tool Calling cắt 38% token prompt trong quy trình tài liệu của Clio. |
| An ninh phòng thủ và phân loại lỗ hổng | GPT-5.6 Terra | 91,8% trên Capture-the-Flag và truy cập qua Trusted Access for Cyber. |
| Sản phẩm nơi việc tạo exploit là rủi ro | Claude Sonnet 5 | Đạt 0,0% trên phát triển exploit Firefox và bật sẵn bảo vệ cyber theo mặc định. |
| Khối lượng nặng sinh nội dung trước tháng 9/2026 | Claude Sonnet 5 | Mức giới thiệu $2/$10 rẻ hơn Terra $8 cho tháng 1M vào / 4M ra. |
| Khối lượng cần tham số sampling tùy chỉnh | GPT-5.6 Terra | Sonnet 5 từ chối temperature, top_p và top_k với lỗi 400. |
Chọn GPT-5.6 Terra nếu...
- Agent của bạn sống trong shell. Khoảng cách 7 điểm trên Terminal-Bench 2.1 là khác biệt lập trình lớn nhất đã công bố giữa hai mô hình này.
- Bạn gọi nhiều công cụ mỗi lượt. Programmatic Tool Calling giữ dữ liệu trung gian ngoài ngữ cảnh mô hình, và PlayCo báo giảm 63,5% tổng token và 50,1% lượt mô hình trong công việc dựng cảnh có cấu trúc.
- Bạn làm an ninh phòng thủ. Điểm 57,7% trên SEC-Bench Pro và 52,9% trên ExploitBench của Terra ở một đẳng cấp khác so với sự từ chối có chủ đích của Sonnet 5.
- Bạn cần token đầu ra rẻ hơn. Sau tháng 8/2026, mức của Sonnet 5 là $15 mỗi 1M so với $12 của Terra.
- Bạn muốn số liệu truy xuất ngữ cảnh dài được công bố, như 72,5% trên MRCR v2 ở dải 512K-1M.
Chọn Claude Sonnet 5 nếu...
- Prompt hoặc ngữ cảnh tệp của bạn lớn. Giá phẳng đến 1M token vượt trội hơn ngưỡng 272K của Terra, và khác biệt là cú xoay 29% trên tháng 10M input.
- Bạn muốn mô hình từ chối công việc cyber theo thiết kế. Đánh giá của chính Anthropic là Sonnet 5 kém hơn đáng kể về năng lực cyber so với Opus 4.8 và Mythos 5, điều mà với hầu hết đội sản phẩm là hành vi mong muốn.
- Bạn đã ở trong hệ sinh thái Claude. Sonnet 5 là mặc định trên Free và Pro và chạy trong Claude Code.
- Bạn muốn một núm chỉnh duy nhất thay vì cả bảng cài đặt. Tư duy thích ứng cộng mức nỗ lực là bề mặt nhỏ hơn để cân nhắc so với nỗ lực cộng max cộng ultra cộng các chế độ gọi công cụ.
Nếu chi phí là ràng buộc, ba khối lượng đã tính là cách nhanh nhất để thấy bạn thuộc phía nào: $50 so với $63 cho tháng nặng sinh nội dung, $32 so với $45 cho truy xuất dưới ngưỡng, và $58 so với $45 khi mỗi yêu cầu vượt 272K input token.
Bắt đầu với GPT-5.6 Terra và Claude Sonnet 5 như thế nào
Cả hai mô hình đều đã khả dụng rộng rãi hôm nay, và đều là mô hình mà nhà cung cấp cho dùng miễn phí, nên thử nghiệm chỉ tốn thời gian.
| Bề mặt | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|
| Ứng dụng tiêu dùng và tầng | ChatGPT Work: mặc định cho Free và Go; có thể chọn cho Plus, Pro, Business, Enterprise | Ứng dụng Claude: mặc định trên Free và Pro; khả dụng cho Max, Team, Enterprise |
| API bên thứ nhất | OpenAI API, qua Responses và Chat Completions | Claude API trên Claude Platform |
| Nền tảng đám mây | Amazon Bedrock (GA) và Microsoft Foundry (GA, gồm APAC Data Zone); chưa có trên Google Vertex | Claude Platform trên AWS và Claude trong Microsoft Foundry; Google Vertex dự kiến sắp có |
| Agent lập trình | Codex: mặc định cho Free và Go, có thể chọn trên Plus trở lên | Claude Code |
| API model ID | gpt-5.6-terra |
claude-sonnet-5 |
Thực hiện cuộc gọi API đầu tiên
Đây là các SDK khác nhau, nên chuyển đổi giữa chúng không chỉ là đổi chuỗi mô hình. Cả hai lệnh gọi đều đủ ngắn để bạn thấy rõ khác biệt.
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra", # swap for gpt-5.6-sol or gpt-5.6-luna
input="Refactor this pytest fixture to avoid module-level state.",
)
print(response.output_text)
from anthropic import Anthropic
client = Anthropic()
message = client.messages.create(
model="claude-sonnet-5", # no temperature/top_p/top_k on this model
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this pytest fixture to avoid module-level state."}],
)
print(message.content.text)
Nếu bạn đang port mã Anthropic sẵn có, nhớ bỏ temperature, top_p, top_k và bất kỳ cấu hình tư duy mở rộng thủ công nào trước, vì Sonnet 5 trả về lỗi 400 thay vì bỏ qua chúng.
Để có lộ trình thiết lập đầy đủ phía Anthropic, hướng dẫn hoàn chỉnh về Claude API của chúng tôi chi tiết hơn mức hợp lý ở đây. Để bắt đầu phía GPT, khóa học Working with the OpenAI API là nơi tốt nhất để bắt đầu.
Suy ngẫm cuối
Nói ngắn gọn trong một câu: Terra là mô hình tầm trung tốt hơn cho các agent terminal và pipeline dày đặc công cụ, còn Sonnet 5 tốt hơn cho prompt lớn và các đội muốn bề mặt điều khiển nhỏ hơn.
Điều tôi thấy thú vị nhất là cả hai nhà cung cấp đều chọn tầng tầm trung làm mặc định miễn phí, rồi đặt cược đối nghịch về những gì mô hình tầm trung nên từ chối. OpenAI huấn luyện Terra cho công việc cyber và đặt khả năng sắc bén nhất sau xác minh danh tính và passkey phần cứng. Anthropic huấn luyện Sonnet 5 để không làm việc đó, rồi chồng thêm biện pháp bảo vệ. Cách tiếp cận nào cũng không hiển nhiên là đúng, và cả hai đều tạo ma sát thực cho công việc hợp pháp.
Nếu bạn muốn tự xây nền tảng để đưa ra các quyết định này thay vì đọc bảng điểm chuẩn của người khác, tôi khuyến nghị bắt đầu với lộ trình kỹ năng AI Fundamentals của chúng tôi.
FAQs
GPT-5.6 Terra hay Claude Sonnet 5 tốt hơn cho lập trình?
Tùy vào loại công việc lập trình. Trên SWE-Bench Pro, cả hai mô hình coi như hòa ở 63,4% (Terra) và 63,2% (Sonnet 5) cho sửa lỗi ở cấp repository. Tuy nhiên, GPT-5.6 Terra dẫn đáng kể ở quy trình terminal và CLI, đạt 87,4% trên Terminal-Bench 2.1 so với 80,4% của Sonnet 5. Hãy chọn Terra nếu agent của bạn chạy trong shell; chọn bất kỳ mô hình nào cho suy luận chung trong codebase.
GPT-5.6 Terra và Claude Sonnet 5 có giá bao nhiêu?
GPT-5.6 Terra có giá $2,00 cho mỗi 1M token đầu vào và $12,00 cho mỗi 1M token đầu ra (sau khi giảm 20% vào ngày 30/7/2026). Claude Sonnet 5 có giá chuẩn $3,00/$15,00, với mức giới thiệu $2,00/$10,00 đến hết ngày 31/8/2026. Terra có phụ phí ngữ cảnh dài (2x input, 1,5x output) cho các yêu cầu vượt 272K token đầu vào, trong khi Sonnet 5 tính giá phẳng đến 1M token.
Cửa sổ ngữ cảnh của GPT-5.6 Terra và Claude Sonnet 5 là gì?
GPT-5.6 Terra có cửa sổ ngữ cảnh 1.050.000 token với trần đầu ra 128.000 token. Claude Sonnet 5 có cửa sổ ngữ cảnh 1M token với trần đầu ra 128K token. Cả hai đều đủ lớn cho hầu hết khối lượng công việc.
Claude Sonnet 5 có làm được công việc an ninh mạng không?
Claude Sonnet 5 không được huấn luyện có chủ đích cho các tác vụ an ninh mạng. Trên bài đánh giá phát triển exploit xây dựng cùng Mozilla dựa trên lỗ hổng Firefox 147, nó đạt 0,0%. Anthropic phát hành nó với biện pháp bảo vệ cyber thời gian thực bật mặc định. Với hầu hết đội sản phẩm đây là ưu điểm chứ không phải điểm yếu, vì một mô hình nhất quán từ chối tạo exploit là phụ thuộc an toàn hơn. Nếu bạn cần năng lực cyber phòng thủ, GPT-5.6 Terra đạt 91,8% trên Capture-the-Flag và 57,7% trên SEC-Bench Pro.
Mô hình nào rẻ hơn cho các prompt lớn trên 300K token?
Trong khi GPT-5.6 Terra nhìn chung rẻ hơn cho đa số quy trình, Claude Sonnet 5 rẻ hơn cho prompt lớn. GPT-5.6 Terra áp dụng phụ phí ngữ cảnh dài ở mức 2x cho input và 1,5x cho output cho toàn bộ yêu cầu khi input vượt 272K token. Sonnet 5 không có phụ phí ngữ cảnh dài đã công bố, nên mức giá giữ nguyên đến 1M token.
Tom là một nhà khoa học dữ liệu và giảng viên kỹ thuật. Anh viết và quản lý các bài hướng dẫn và bài blog về khoa học dữ liệu của DataCamp. Trước đây, Tom làm việc trong lĩnh vực khoa học dữ liệu tại Deutsche Telekom.
