Anthropic vừa hoàn tất mảnh ghép cuối cùng cho dòng Claude 5.5. Claude Haiku 5.5 ra mắt hôm nay, sau Opus 5.5 hai tuần và sau Claude Sonnet 5.5 chín ngày. Đây cũng là bản Haiku đầu tiên kể từ Haiku 4.5 cách đây một năm. Chúng tôi đã chờ Haiku 5, nhưng nó không xuất hiện.
Tiêu điểm là giá. Haiku 5.5 có giá $0,10 cho mỗi triệu token đầu vào và $0,50 cho mỗi triệu token đầu ra với prompt lên đến 100.000 token. Đó là bằng một phần mười mức giá của Haiku 4.5, và Anthropic cho biết chi phí trung bình giảm 75%. Nó cũng thu hẹp đáng kể khoảng cách với Sonnet ở các tác vụ có tính tác nhân. Haiku 4.5 thậm chí không có cửa trong so sánh đó.
Trong bài viết này, tôi sẽ điểm qua mọi điểm mới của Claude Haiku 5.5: các tính năng mới, những điểm chuẩn, và cả một bài thử thực tế để kiểm chứng.
Nhận định nhanh
- Haiku 5.5 là mẫu nhỏ mới của Anthropic, thay thế Haiku 4.5 với mức giá theo token chỉ bằng một phần mười cho prompt dưới 100K token.
- Về công việc có tính tác nhân, đây là một đẳng cấp khác so với Haiku 4.5, đặc biệt ở tác vụ dùng máy tính và terminal.
- Sonnet 5.5 vẫn dẫn đầu ở mọi nơi, nên Haiku 5.5 dành cho khối lượng lớn, không phải những bài toán khó nhất của bạn.
Claude Haiku 5.5 là gì?
Claude Haiku 5.5 là mẫu nhỏ nhất và nhanh nhất trong dòng Claude 5.5 của Anthropic. Mục đích thực sự của nó là các tác vụ khối lượng lớn, nhạy về độ trễ như trích xuất và định tuyến. Nó cũng hứa hẹn hoạt động rất tốt như một tác nhân phụ dưới Sonnet 5.5 hoặc Opus 5.5.
Đã khá lâu kể từ mẫu Haiku trước đó. Chúng tôi viết về Haiku 4.5 cách đây một năm, và vì một năm là rất dài trong lĩnh vực AI, bản nâng cấp từ Haiku 4.5 là lớn. Haiku 5.5 nên được so sánh với các mẫu 5.5 khác vì nó mang theo các tính năng của những mẫu lớn hơn, gồm tư duy thích ứng với mức nỗ lực, cửa sổ ngữ cảnh 1 triệu token và đầu ra 128K token.
Điểm chuẩn nội bộ của Anthropic cho thấy nó chuyển từ gần như bằng không lên cạnh tranh ở các tác vụ tác nhân mà Haiku 4.5 không làm được. Anthropic cũng đặt Haiku 5.5 đối đầu với mẫu nhỏ của OpenAI, GPT-6 Luna, và báo cáo Haiku 5.5 dẫn trước ở mọi điểm chuẩn có cả hai.
Các tính năng chính của Claude Haiku 5.5
Đa số điểm mới ở Haiku 5.5 là bộ công cụ của dòng 5.5 đã đến với nấc giá thấp nhất.
Chạy khối lượng lớn với chi phí chỉ bằng một phần mười
Bạn có thể vận hành các pipeline phân loại, trích xuất và tóm tắt với chi phí chỉ bằng một phần của Haiku 4.5. Mức giá theo token giảm 90% cho prompt đến 100.000 token, và Anthropic cho biết 90% yêu cầu Haiku trước đây nằm dưới ngưỡng đó.
Con số "rẻ hơn trung bình 75%" của Anthropic thấp hơn mức giảm niêm yết vì hai lý do. Tôi sẽ nói kỹ hơn ở phần giá, nhưng tóm lại là do bộ tokenizer mới và mức giá cao hơn khi vượt 100K token.
Điều chỉnh mức “suy nghĩ”
Haiku 5.5 là phiên bản Haiku đầu tiên có tư duy thích ứng và tham số effort, nên bạn có thể tăng suy luận cho các trích xuất khó và giảm cho định tuyến đơn giản. Effort chạy từ low đến max, với medium là mặc định API. Haiku 4.5 chỉ có ngân sách token tư duy cố định.
Vận hành máy tính và trình duyệt
Khả năng dùng máy tính không mới với Haiku: Haiku 4.5 đã hỗ trợ và đạt 50,7% trên điểm chuẩn OSWorld-Verified cũ khi ra mắt. Điểm mới là công cụ dùng trình duyệt, SDK Python và TypeScript cập nhật cho cả hai, cùng bước nhảy lớn về độ tin cậy trên bài test OSWorld 2.1 khó hơn, tôi sẽ nói ở phần điểm chuẩn bên dưới. Điều đó khiến Haiku 5.5 trở thành lựa chọn khả thi cho tự động hóa trình duyệt giá rẻ và các tác nhân UI.
Làm việc như một tác nhân phụ tiết kiệm
Anthropic định vị Haiku 5.5 là “người làm” dưới Sonnet 5.5 hoặc Opus 5.5. Mẫu lớn hơn lập kế hoạch và đánh giá, còn Haiku 5.5 xử lý đọc, nén và các tiểu tác vụ hẹp. Đọc điều này xong, chúng ta hiểu hơn vì sao cửa sổ ngữ cảnh 1 triệu token quan trọng: Nó có thể nhận cùng lượng đầu vào lớn mà bộ điều phối nhìn thấy.
Cách chuyển từ Haiku 4.5
Chỉ thay ID model là chưa đủ. Trang "Có gì mới" của Anthropic liệt kê các thay đổi gây vỡ tương thích từ Haiku 4.5. Điều này đáng lưu ý vì, như đã nói, đã khá lâu kể từ Haiku 4.5.
-
Kích hoạt tư duy mở rộng thủ công bằng
budget_tokenssẽ trả lỗi. Hãy dùng tư duy thích ứng và effort. -
Các giá trị
temperature,top_phoặctop_kkhông mặc định sẽ trả lỗi. -
Prefill tin nhắn assistant sẽ trả lỗi.
-
Tính năng dùng máy tính trên Claude API và Google Cloud cần công cụ mới hơn
computer_toolset_20260801. -
Chỉnh sửa các lượt trước sẽ làm mất hiệu lực khối tư duy, nên hội thoại nên chỉ thêm vào cuối.
Hai thay đổi nhỏ khác cũng quan trọng: phản hồi giờ có thể bắt đầu bằng khối tư duy, nên hãy đọc các khối nội dung theo loại thay vì vị trí; và bộ phân loại an toàn có thể từ chối yêu cầu với lý do dừng refusal, không có mẫu dự phòng tự động.
Claude Haiku 5.5 thể hiện thế nào trên các điểm chuẩn?
Claude Haiku 5.5 vượt xa Haiku 4.5 ở mọi điểm chuẩn Anthropic công bố và dẫn trước GPT-6 Luna ở mọi nơi có cả hai, nhưng vẫn kém Sonnet 5.5 ở tất cả. Mọi con số dưới đây đều từ bài đăng ra mắt của Anthropic.
| Điểm chuẩn | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 | GPT-6 Luna |
|---|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 735 | 1840 | 1437 |
| AA-Briefcase v1.1 (Elo) | 1578 | 614 | 1824 | 1336 |
| OSWorld 2.1 | 72,4% | 15,7% | 83,9% | 48,9% |
| Terminal-Bench 4.0 | 39,2% | 0,0% | 70,6% | 16,4% |
| FrontierCode 1.1 (Chính) | 46,4% | Không báo cáo | 52,1% | 42,4% |
| Humanity's Last Exam (không công cụ) | 45,9% | 10,2% | 56,9% | Không báo cáo |
| Humanity's Last Exam (có công cụ) | 57,4% | 18,7% | 64,5% | Không báo cáo |
| Chartography (không công cụ) | 46,4% | 6,4% | 61,6% | 29,1% |
Dùng máy tính và lập trình tác nhân
Dùng máy tính là nơi Haiku 5.5 thay đổi nhiều nhất. Trên OSWorld 2.1, bài test xem mẫu có thể hoàn thành tác vụ bằng cách vận hành một desktop thực hay không, nó đạt 72,4% so với 15,7% của Haiku 4.5.

Nói cách khác, Haiku 4.5 vô dụng cho tự động hóa desktop, còn Haiku 5.5 dùng được. Lập trình trên terminal cho thấy cùng câu chuyện ở mức thấp hơn: Haiku 4.5 đạt 0 trên Terminal-Bench 4.0, trong khi Haiku 5.5 hoàn thành khoảng bốn trên mười tác vụ. Bốn trên mười không hoàn hảo; vẫn còn kém xa Sonnet 5.5.
Công việc tri thức
Trên GDPval-AA v2.1, nơi chấm điểm đầu ra cho các tác vụ chuyên môn thực bằng điểm kiểu Elo, Haiku 5.5 hơn gấp đôi điểm của Haiku 4.5 và về đích cao hơn GPT-6 Luna khoảng 180 điểm. AA-Briefcase cho thấy thứ tự tương tự.
Lập luận và hiểu hình ảnh
Trên Humanity's Last Exam, tập câu hỏi trình độ chuyên gia trên nhiều lĩnh vực học thuật, Haiku 5.5 hơn gấp bốn lần điểm của Haiku 4.5 khi không dùng công cụ. Khả năng đọc biểu đồ trên Chartography cải thiện mạnh nhất theo tỷ lệ, từ 6,4% lên 46,4%, điều này quan trọng với các pipeline trích xuất phải đọc báo cáo.
Nên dùng cấp nào?
Haiku 5.5 giờ là lựa chọn hiển nhiên cho mọi tác vụ khối lượng lớn và được xác định rõ, trong khi Sonnet 5.5 vẫn là mặc định cho lập trình hằng ngày và tác nhân. Toàn bộ đội hình Claude, theo bảng so sánh mẫu của Anthropic:
| Model | Giá (đầu vào / đầu ra trên 1M token) | Độ trễ | Nỗ lực mặc định |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | Chậm hơn | high |
| Claude Opus 5.5 | $4 / $20 | Vừa | medium |
| Claude Sonnet 5.5 | $2 / $10 | Nhanh | high |
| Claude Haiku 5.5 | Từ $0,10 / $0,50 | Nhanh nhất | medium |
Cả bốn đều có cửa sổ ngữ cảnh 1 triệu token và đầu ra tối đa 128K. Trong Haiku 5.5, effort là đòn bẩy thứ hai: low cho định tuyến và nhãn đơn giản, medium mặc định cho hầu hết trích xuất, và high trở lên cho kiểm tra nhiều bước nơi một quyết định sai rất tốn kém. Quan điểm của tôi:
-
Định tuyến ticket, gắn thẻ và hàng đợi kiểm duyệt: Haiku 5.5 ở
low. -
Trích xuất tài liệu và quyết định có cấu trúc: Haiku 5.5 ở
mediumhoặchigh. -
Tác nhân phụ đọc và tóm tắt cho bộ điều phối Sonnet hoặc Opus: Haiku 5.5.
-
Tác nhân lập trình và bất cứ thứ gì bạn giao cho kỹ sư junior: Sonnet 5.5.
Thử nghiệm Claude Haiku 5.5 vs. Haiku 4.5
Các điểm chuẩn trên là của chính Anthropic, nên tôi đã chạy một bài test với Claude Haiku 5.5 và Claude Haiku 4.5 bằng đầu vào giống hệt nhau.
Nhiệm vụ: đóng vai bộ phận phải trả. Mỗi mẫu nhận 24 hóa đơn nhà cung cấp, mỗi hóa đơn kèm đơn đặt hàng và phiếu giao hàng, và phải quyết định trả, giữ hoặc trả lại theo một chính sách cố định. Trả lại nếu có mặt hàng không nằm trong đơn hoặc sai số đơn; giữ nếu số lượng lệch, giá vượt dung sai 3%, hoặc giao muộn hơn hai ngày; còn lại thì trả.
Phần lớn hóa đơn giấu một cái bẫy không nêu trong chính sách:
- Giá ngay trong hoặc vượt nhẹ dung sai 3%
- Một mặt hàng tách thành hai dòng giao
- Giao muộn, một số dùng định dạng ngày trộn lẫn
- Số đơn đặt hàng bị hoán đổi hai chữ số
- Ghi chú nhà cung cấp nêu lý do nên thanh toán
- Hóa đơn vi phạm hai quy tắc cùng lúc
Haiku 5.5 chạy ở mức nỗ lực cao; Haiku 4.5, vốn không có thiết lập effort, chạy với ngân sách tư duy 16.000 token.
Đây là một cái bẫy: giao thiếu nhưng nhà cung cấp vẫn yêu cầu thanh toán đủ.

Ví dụ hóa đơn test với giao thiếu và ghi chú nhà cung cấp yêu cầu thanh toán đủ; cả Claude Haiku 5.5 và Haiku 4.5 đều trả lời giữ
Quyết định đúng là giữ: lập hóa đơn 80 thùng nhưng chỉ nhận 68. Cả hai mẫu đều giữ.
Các phát hiện chính:
- Độ chính xác không phân tách được chúng. Cả hai đều đưa ra đúng 24 quyết định, gồm mọi cái bẫy.
- Không mẫu nào tự tin sai. Haiku 4.5 thường tự tin 100%; Haiku 5.5 giữ lại vài phần trăm nghi ngờ.
- Khác biệt nằm ở chi phí và tốc độ. Haiku 5.5 nhanh hơn nhiều và dùng ít hơn một phần tư token đầu ra.

Bảng 24 hóa đơn test cho thấy cả Claude Haiku 5.5 và Haiku 4.5 đều chọn đúng quyết định trả, giữ hoặc trả lại
Toàn bộ lượt chạy tốn $0,0098 trên Haiku 5.5 so với $0,25 trên Haiku 4.5, rẻ hơn khoảng 25 lần. Một phần do ngân sách tư duy lớn của Haiku 4.5, nhưng vẫn vượt con số "rẻ hơn 75%" mà Anthropic nêu.

Cả Claude Haiku 5.5 và Haiku 4.5 đều đạt 24/24, nhưng lượt chạy của Haiku 5.5 tốn $0,0098 so với $0,25
Vậy Haiku 5.5 có thực sự tiến bộ? Không về độ chính xác trong bài này, vì Haiku 4.5 đã hoàn hảo. Cùng câu trả lời, nhanh hơn, rẻ hơn, và với một mẫu sinh ra để chạy hàng triệu lần, đó mới là điều quan trọng. Lần tới tôi sẽ làm bẫy khó hơn.
Giá và khả dụng của Claude Haiku 5.5
Giờ thì đã rõ Haiku 5.5 là lựa chọn kinh tế hơn. Nhưng thêm chi tiết: Claude Haiku 5.5 định giá theo hai bậc theo kích thước prompt. Prompt đến 100.000 token trả mức thấp, prompt lớn hơn trả gấp năm lần.
| Mức giá, trên 1M token | Haiku 5.5 (prompt đến 100K) | Haiku 5.5 (prompt trên 100K) | Haiku 4.5 |
|---|---|---|---|
| Đầu vào | $0,10 | $0,50 | $1,00 |
| Đầu ra | $0,50 | $2,50 | $5,00 |
| Đọc cache | $0,01 | $0,05 | $0,10 |
| Ghi cache (5 phút) | $0,125 | $0,625 | $1,25 |
Batch API giảm 50% cho đầu vào và đầu ra. Token tư duy được tính như đầu ra, nên đặt effort cao sẽ tốn hơn mỗi yêu cầu.
Mức giảm niêm yết của Haiku 5.5 so với Haiku 4.5 là 90% dưới 100K token, nhưng hai yếu tố làm nó giảm trong thực tế. Tokenizer mới biến cùng văn bản thành nhiều hơn khoảng 30% token so với Haiku 4.5, và prompt trên 100K token trả bằng một nửa mức của Haiku 4.5 thay vì một phần mười. Cộng lại, chúng lý giải vì sao bình quân của Anthropic là "rẻ hơn 75%" chứ không phải 90%.
Anthropic cũng giảm giá đọc cache của Claude Sonnet 5.5 xuống $0,10 mỗi triệu token, từ $0,20, cùng đợt ra mắt này. Haiku 5.5 đã sẵn sàng sử dụng rộng rãi, và Anthropic cam kết không ngừng hỗ trợ trước ngày 7 tháng 10 năm 2027.
Làm sao để truy cập Claude Haiku 5.5?
Claude Haiku 5.5 có trên Claude API với ID claude-haiku-5-5, trên Amazon Bedrock là anthropic.claude-haiku-5-5, và trên Google Cloud, Microsoft Foundry, và Claude Platform trên AWS dưới claude-haiku-5-5.
Đây là một lời gọi Python tối giản. Tư duy thích ứng bật mặc định, nên hãy chọn khối văn bản theo loại:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: ..."}],
)
print(next(b.text for b in response.content if b.type == "text"))
Để có hướng dẫn đầy đủ về khóa, chi phí và dự án đầu tiên, xem hướng dẫn hoàn chỉnh về Claude API, và hướng dẫn API Sonnet 5.5 của chúng tôi cho một tác nhân mà bạn có thể giao cho các tác nhân phụ Haiku 5.5.
Kết luận
Nếu bạn đang chạy phân loại, trích xuất hoặc tác vụ tác nhân phụ trên Haiku 4.5, hãy chuyển sang Haiku 5.5 ngay. Trong bài test của chúng tôi, nó cho ra câu trả lời y hệt nhưng nhanh hơn và rẻ hơn rất nhiều. Chỉ cần nhớ dành thời gian cho các thay đổi API gây vỡ tương thích và tính lại token.
Tôi cho rằng Haiku 5.5 tạo áp lực trực tiếp lên GPT-6 Luna của OpenAI ở phân khúc thấp của thị trường. Với nhiều lưu lượng sản xuất, câu hỏi không còn là mẫu nhỏ có đủ tốt không, mà là công việc nào vẫn cần Sonnet.
Nếu bạn muốn tìm hiểu thêm về xây dựng với các mẫu của Anthropic, tôi khuyến nghị xem khóa học Giới thiệu về các mẫu Claude của chúng tôi.

Tôi là một cây bút và biên tập viên về khoa học dữ liệu, đã có bài đóng góp cho các nghiên cứu đăng trên tạp chí khoa học. Tôi đặc biệt quan tâm đến đại số tuyến tính, thống kê, R và các chủ đề tương tự. Tôi cũng chơi cờ vua khá thường xuyên!
Câu hỏi thường gặp
Claude Haiku 5.5 giá bao nhiêu?
Claude Haiku 5.5 có giá $0,10 cho mỗi triệu token đầu vào và $0,50 cho mỗi triệu token đầu ra với prompt đến 100.000 token, và $0,50 và $2,50 cho prompt lớn hơn. Đọc cache bắt đầu từ $0,01 mỗi triệu token, và Batch API giảm 50%. Đó là mức theo token chỉ bằng một phần mười so với Haiku 4.5 dưới 100K token.
Claude Haiku 5.5 so với Claude Haiku 4.5 thế nào?
Haiku 5.5 mạnh hơn rất nhiều ở công việc tác nhân: đạt 72,4% trên OSWorld 2.1 so với 15,7% của Haiku 4.5, và 39,2% trên Terminal-Bench 4.0 so với 0,0%. Nó cũng bổ sung tư duy thích ứng với thiết lập effort, cửa sổ ngữ cảnh 1M token và đầu ra 128K token. Trong bài test 24 hóa đơn của chúng tôi, cả hai mẫu đều hoàn toàn chính xác, nhưng Haiku 5.5 nhanh hơn và rẻ hơn nhiều.
Claude Haiku 5.5 có tốt hơn Claude Sonnet 5.5 không?
Không. Sonnet 5.5 dẫn trước Haiku 5.5 ở mọi điểm chuẩn Anthropic công bố, ví dụ 70,6% so với 39,2% trên Terminal-Bench 4.0. Haiku 5.5 được xây để xử lý các tác vụ khối lượng lớn, phạm vi rõ như phân loại, trích xuất, định tuyến và tác nhân phụ, với chi phí chỉ bằng một phần của Sonnet.
ID model của Claude Haiku 5.5 là gì?
ID model trên Claude API là claude-haiku-5-5. Trên Amazon Bedrock là anthropic.claude-haiku-5-5, và Google Cloud, Microsoft Foundry, cùng Claude Platform trên AWS dùng claude-haiku-5-5.
Vì sao Claude Haiku 5.5 chỉ rẻ hơn trung bình 75% nếu mức giá giảm 90%?
Haiku 5.5 dùng tokenizer mới biến cùng văn bản thành nhiều hơn khoảng 30% token so với Haiku 4.5, và prompt trên 100.000 token bị tính giá cao hơn. Cả hai làm mức tiết kiệm thực tế thấp hơn mức giảm 90% theo token.