Chuyển đến nội dung chính

Claude Fable 5 trong Claude Code: Bài kiểm thử thực tế đối đầu Opus 5

Trải nghiệm thực tế với mô hình Fable 5 của Anthropic trong Claude Code: cách nó xử lý one-shot build, các trường hợp từ chối vì an toàn và fallback sang Opus, cùng thời điểm nên dùng.
Đã cập nhật 20 thg 8, 2026  · 14 phút đọc

Khám phá với AI

ChatGPTClaudePerplexity

Fable 5 là mô hình viết mã tốt nhất tôi đã dùng suốt nhiều tháng làm việc hằng ngày. Gắn bó với nó đòi hỏi chút kiên nhẫn. Chính phủ Mỹ đã buộc gỡ xuống vài tuần, và các điều khoản truy cập liên tục thay đổi sau đó.

Rồi Anthropic phát hành Opus 5. Chi phí chỉ bằng một nửa mỗi token, và đây là mô hình Claude Code sẽ fallback sang khi Fable từ chối yêu cầu. Điều này đặt ra một câu hỏi rõ ràng cho bất kỳ ai đang trả phí cao cho Fable: Mô hình đắt tiền đó còn đáng để đặt làm mặc định không?

Vì thế tôi giao cho cả hai mô hình cùng một bài toán và so sánh chúng về chi phí, tốc độ, độ chính xác, và chất lượng sản phẩm bàn giao. Bài viết này phân tích kết quả.

Fable 5 là gì?

Fable 5 là mô hình tập trung vào viết mã trong họ Claude 5 của Anthropic, ra mắt ngày 9 tháng 6, 2026. Nó phát hành cùng Mythos 5, một mô hình anh em không có bộ phân loại an toàn mà Anthropic chỉ cung cấp cho một nhóm nhỏ tổ chức đã được thẩm định. Để xem chi tiết bản phát hành và Fable 5 thể hiện ra sao trên các benchmark, hãy xem hướng dẫn Fable 5 chuyên sâu của chúng tôi.

Fable 5 có giá cao hơn Opus 5 và nhắm đến các công việc mã hóa khó hơn. Khác biệt chính về cảm nhận là nó luôn bật chế độ suy nghĩ cho mọi yêu cầu và không thể tắt, nên trông chậm hơn và cân nhắc hơn. Opus 5 tự quyết định khi nào một prompt đáng để suy nghĩ thêm.

Thông số và giá

Hai mô hình dùng chung cửa sổ ngữ cảnh và kích thước đầu ra tối đa. Chúng khác nhau về giá và cách cơ chế suy nghĩ hoạt động.

 

Fable 5

Opus 5

Giá input (mỗi 1M token)

$10

$5

Giá output (mỗi 1M token)

$50

$25

Cửa sổ ngữ cảnh

1M token

1M token

Đầu ra tối đa mỗi yêu cầu

128K token

128K token

Suy nghĩ

Luôn bật (không thể tắt)

Thích ứng (tùy chọn)

Hành vi từ chối

stop_reason: "refusal" ở HTTP 200, fallback tùy chọn sang Opus 4.8

Chuẩn

Fable 5 có chi phí khoảng gấp đôi mỗi token so với Opus 5. Vì chế độ suy nghĩ luôn bật, một lần chạy cũng có xu hướng phát sinh nhiều token hơn, nên khoảng cách giá trong thực tế lớn hơn mức giá mỗi token gợi ý. Trong phần đối đầu ở cuối hướng dẫn này, Fable tạo ra số token đầu ra nhiều hơn 74% so với Opus cho một chương trình nhỏ hơn.

Để so sánh sâu hơn, bao gồm khác biệt benchmark, hãy đọc hướng dẫn Claude Opus 5 vs Claude Fable 5.

Hành vi từ chối mà bạn phải lập trình đối phó

Một điểm gây khó chịu phổ biến của Fable 5 là bộ phân loại an toàn tích hợp. Vì mô hình bị coi là quá mạnh, bộ phân loại không cho phép xử lý các yêu cầu chỉ hơi liên quan đến các lĩnh vực như sinh học hoặc an ninh mạng.

Title: Cách Fable 5 xử lý từ chối - Description: Cách Fable 5 xử lý từ chối

Với một nhà miễn dịch học, chỉ riêng từ "cancer" đã kích hoạt bộ lọc an ninh sinh học, khiến Claude Code fallback sang Opus 4.8.

Bản thân tôi cũng gặp phải gần đây với một lỗi đăng nhập trong dự án cá nhân. Luồng dùng Telegram Gateway API cho OTP sign-in, và Fable 5 thẳng thừng từ chối đụng vào. Opus 5 thì xử lý được, và đó là vấn đề: không có gì trong lỗi đó là rủi ro bảo mật.

Fallback tự động, không cần cấu hình chỉ xảy ra trong Claude Code và các ứng dụng Claude. Nếu bạn đang dùng Fable qua API, bạn sẽ nhận được trường stop_reason trong phản hồi dù mã trạng thái vẫn là 200 thành công.

Phản hồi trông như sau:

{
  "stop_reason": "refusal",
  "stop_details": {
	"category": "bio",
	"explanation": "The request was declined by a safety classifier."
  }
}

Vì vậy, bạn phải kiểm tra stop_reason trước khi đụng đến nội dung phản hồi. 

Để bật fallback phía máy chủ, truyền một mảng fallbacks (ví dụ "fallbacks": [{"model": "claude-opus-4-8"}]) và gửi header anthropic-beta: server-side-fallback-2026-06-01. Đặt header này cho mọi yêu cầu; không có công tắc ở cấp tài khoản.

Lưu ý về mô hình fallback

Bạn có thể thắc mắc vì sao một số nguồn nói Fable 5 fallback sang Opus 4.8 trong khi nguồn khác trỏ sang Opus 5. Cả hai đều đúng, vì đích đến phụ thuộc vào hạng mục và bề mặt sử dụng. 

Trong Claude Code, yêu cầu bị gắn cờ sinh học hiện được chạy lại trên Opus 5, trong khi yêu cầu bị gắn cờ an ninh mạng vẫn chạy lại trên Opus 4.8. Trên API, tính năng fallbacks phía máy chủ hiện chỉ hỗ trợ Opus 4.8. 

Sự phân tách này là do thời điểm: khi Fable ra mắt tháng 6, mọi thứ fallback sang Opus 4.8, và nhánh sinh học sau đó được chuyển sang Opus 5 khi mô hình này phát hành ngày 24 tháng 7.

Tranh cãi quanh Fable 5

Fable 5 có màn khởi đầu gập ghềnh, ngay cả khi bỏ qua câu chuyện bộ phân loại an toàn.

Giảm hiệu năng âm thầm và các lần từ chối sai

Vài ngày sau khi ra mắt, Fortune đưa tin rằng Anthropic đã lặng lẽ làm yếu câu trả lời của Fable 5 trên khoảng 0,03% lưu lượng liên quan hạ tầng AI và ML mà không thông báo cho ai.

Nhiều nhà nghiên cứu và cả nhà phát triển phẫn nộ vì họ kỳ vọng một mô hình đầu bảng có thể xử lý mọi tác vụ, nhất là khi họ trả gói 200 đô cho nó.

Anthropic nhượng bộ áp lực cộng đồng chỉ trong một ngày, nói rằng họ "đã đánh đổi sai." Điều họ thay đổi là tính minh bạch, không phải bộ giảm tốc. Các yêu cầu bị gắn cờ giờ được hiển thị giống như một lần từ chối, còn việc suy giảm chất lượng vẫn giữ nguyên. Lập luận của Anthropic là điều khoản của họ vốn đã cấm dùng Claude để xây hệ thống AI cạnh tranh, điều này có thể chấp nhận được. Nhưng làm âm thầm suốt một tháng thì không.

Đình chỉ vì kiểm soát xuất khẩu

Rồi chuyện lớn hơn xảy ra. Một jailbreak đã công khai kích hoạt lệnh kiểm soát xuất khẩu của Bộ Thương mại vào ngày 12 tháng 6, và Anthropic gỡ Fable 5 và Mythos 5 xuống toàn cầu trong 19 ngày.

Anthropic phản đối mạnh mẽ việc thu hồi trong suốt thời gian đó. Họ lập luận jailbreak này hẹp chứ không phổ quát, và các mô hình yếu hơn cũng có thể tìm ra, nên tiêu chuẩn thu hồi trông mù mờ từ góc nhìn của họ. Họ có lý về ngưỡng đánh giá. Chưa ai từng tạo được jailbreak phổ quát, và không mô hình nào hiện tại vượt qua tiêu chuẩn đó. Viện An toàn AI Vương quốc Anh đã báo cáo tiến triển hướng đến một phương pháp như vậy, nhưng chưa có gì thực sự hoạt động.

Họ có lý về ngưỡng đánh giá, nhưng cách diễn đạt thì chưa chính xác. Các jailbreak phổ quát là có thật: Viện An ninh AI Vương quốc Anh báo cáo đã tìm thấy chúng cho mọi hệ thống frontier đã kiểm tra, và đội red-team của viện đã xây được một bản chống lại chính Fable 5, hoàn thành trong một lượt chỉ sau vài giờ và mở rộng sang quy trình đa lượt theo kiểu agent trong vài ngày, theo model card của Fable 5.

Điều thực sự còn tranh cãi là liệu ngưỡng đó có nên kích hoạt thu hồi hay không, chứ không phải chuyện jailbreak như vậy có tồn tại hay không.

Khôi phục, kèm giới hạn mới

Anthropic tung ra bộ phân loại mạnh hơn và báo cáo tỷ lệ chặn trên 99%, và nhờ đó, Bộ Thương mại dỡ bỏ kiểm soát vào khoảng ngày 30 tháng 6.

Quyền truy cập chung trở lại vào ngày 1 tháng 7, nhưng với điều khoản chặt hơn. Cửa sổ hai tuần không hạn chế hứa hẹn rút xuống còn khoảng một tuần, và trần 50% theo tuần mới có nghĩa là khi bạn vượt ngưỡng, phần sử dụng Fable 5 tiếp theo sẽ bị tính bằng credit theo mức $10 và $50 đầy đủ. Điều đó đủ khiến người đăng ký phàn nàn trên Reddit.

Anthropic gia hạn thời hạn hai lần, rồi tách chính sách theo gói vào ngày 20 tháng 7: Max và Team Premium giữ Fable 5 ở mức 50% giới hạn hàng tuần không thời hạn, còn Pro và Team Standard nhận một lần tín dụng $100 và sau đó trả theo mức API. Mythos 5 quay lại với chỉ khoảng 100 tổ chức Mỹ được thẩm định, thu hẹp từ một chương trình quốc tế rộng hơn.

Tất cả điều đó khiến Fable 5 là một mô hình mạnh, nhưng bị bao bọc bởi chính sách truy cập thay đổi theo từng tháng. Hãy chuẩn bị cho các trường hợp từ chối sai lẻ tẻ và đừng kỳ vọng mức giới hạn tháng này sẽ giữ nguyên sang tháng sau.

Claude Fable 5 vs Opus 5 trên cùng một dự án

Để xem hai mô hình hành xử ra sao trong điều kiện giống hệt nhau, tôi giao cho mỗi mô hình cùng một việc trong một phiên Claude Code mới. Sau đó, tôi đọc toàn bộ bản ghi phiên, các tệp JSONL nội bộ, và chấm điểm cả hai ứng dụng hoàn chỉnh trong trình duyệt.

Nỗ lực đầu tiên của tôi cho so sánh này dùng một bộ rút gọn URL. Đó là sai lầm. Cả hai mô hình tạo ra ứng dụng gần như giống hệt nhau, từ chủ đề đến bộ tính năng, vì bộ rút gọn URL có một câu trả lời hiển nhiên nằm sẵn trong dữ liệu huấn luyện của mọi mô hình. Bài kiểm tra chẳng đo được gì.

Thiết lập một hệ sinh thái “one-shot” trong Fable 5 và Opus 5

Vì vậy tôi chọn một nhiệm vụ không có đáp án chuẩn: mô phỏng hệ sinh thái sống. Ba loài trong một mạng lưới thức ăn, các tác tử bầy đàn, săn mồi và chết đói, 5000 tác tử hiển thị cùng lúc trên màn hình, tất cả phải xác định được từ một seed. Prompt cấm dùng thư viện xử lý phần khó, nên mỗi mô hình phải tự viết truy vấn không gian, điều khiển chuyển động, và động lực quần thể.

Đây là prompt cả hai mô hình nhận được, chữ nào ra chữ đó:

Build a living ecosystem simulation that runs in the browser, and ship it end-to-end in one shot, without asking me any questions or pausing for confirmation. Make all decisions yourself and only stop when it is fully built, tested, and pushed to GitHub.
 
Requirements:
 
- A real-time canvas simulation of an ecosystem with at least three species in a food web (for example producers, herbivores, predators). Species interact: they eat, they are eaten, they reproduce, and they die.
- Agents move with steering behaviour — flocking among their own kind, and avoidance or pursuit across species.
- Each agent has an energy budget. Moving and reproducing cost energy, eating restores it, and running out kills the agent. Population levels must emerge from these rules rather than being scripted.
- The simulation must stay stable and interactive at 5000 agents. Show a live FPS counter and a live population graph per species.
- The whole world is generated from a numeric seed. The same seed must always produce the same run.
- Controls to pause, resume, reset, reseed, and tune the key simulation parameters live while it runs.
- Implement the simulation yourself: the steering, the spatial queries, the integration, and the population dynamics. Do not use a physics engine, a flocking library, a game engine, or a charting library. Plain canvas and your own code.
- Tests covering the core simulation logic.
- A README with setup and run instructions.
 
The simulation should run in the browser and be usable by someone who has never seen it before.
 
When it is complete, create a new GitHub repository with the gh CLI (which is already installed and authenticated) and push the project to it.

Quy tắc “không hỏi” chính là trọng tâm. Nó cho thấy mỗi mô hình tự đẩy một build đi xa đến đâu, khi không có ai bên cạnh để bắt lỗi. Mỗi mô hình chạy trong thư mục trống riêng, không có gợi ý rằng còn có mô hình thứ hai đang làm cùng nhiệm vụ.

Nhiệm vụ này cũng ẩn bốn phép thử khách quan bên trong một đầu ra trông có vẻ chỉ là hình ảnh. 

  • Tìm kiếm láng giềng phải dùng chỉ mục không gian, nếu không tốc độ khung hình sẽ sụt ở 5000 tác tử. 
  • Thế giới phải wrap hoặc clamp đúng, nếu không các tác tử sẽ chui qua tường.
  • Tính ngẫu nhiên phải chạy qua bộ sinh số có seed, nếu không cùng một seed sẽ cho ra lần chạy khác nhau.
  • Và tỷ lệ sinh - tử phải cân bằng, nếu không quần thể sẽ rơi về 0 hoặc nổ tung.

Mỗi lỗi như vậy đều nhìn thấy được trên màn hình, đó là lý do một bản demo đẹp có thể chấm điểm.

Cả hai bản build đều đang chạy trực tiếp, nên bạn có thể tự thực hiện so sánh thay vì chỉ nghe lời tôi. Mở song song và reseed từng bản:

Ảnh chụp cả hai ở phần dưới, nếu bạn muốn đọc hơn là bấm. Nhưng lưu ý: ảnh được thu nhỏ để vừa toàn màn hình, nên chi tiết có thể không thật rõ nét.

Mỗi lượt chạy thực sự do mô hình nào phục vụ

Trước khi vào kết quả, có một lưu ý phương pháp quan trọng để đọc chúng.

Claude Code có thể fallback sang Opus khi bộ phân loại an toàn của Fable 5 từ chối yêu cầu, nên một lượt chạy gắn nhãn Fable không đảm bảo 100% là Fable. Thay vì đoán, tôi ghi lại trường model ở mọi sự kiện assistant trong cả hai bản ghi.

May mắn là trong so sánh của tôi, mọi sự kiện ở lượt Fable đều trả về claude-fable-5, tổng cộng 103. Mọi sự kiện ở lượt Opus đều trả về claude-opus-5, tổng cộng 247. Không có fallback theo hướng nào. Các con số dưới đây mô tả đúng mô hình trên nhãn.

Fable 5 và Opus 5 xử lý bài toán ra sao

Fable làm việc lặng lẽ. Nó chạy 56 lần gọi công cụ và in 429 từ bình luận cho toàn bộ build, gói trong 2 khối văn bản.

Opus làm việc công khai. Nó chạy 137 lần gọi công cụ, hơn gấp đôi, và in 4.808 từ trong 110 khối. Cả hai mô hình chỉnh sửa với tỷ lệ tương tự nếu tính theo khối lượng, gần 2 lần sửa cho mỗi tệp được viết.

Chúng cũng khác ở bộ công cụ. Fable bàn giao các ES module thuần với script khởi động python3 -m http.server và không có node_modules nào cả. Opus cài Vite và Vitest và build theo một toolchain thực thụ.

Thời gian build dưới đây đo phần làm việc chủ động. Tôi lấy mỗi lượt từ sự kiện assistant đầu tiên đến cuối cùng và trừ đi khoảng rỗi nơi phiên chờ thay vì build.

Kết quả: tốc độ, chi phí và độ đúng

Khía cạnh

Fable 5

Opus 5

Sự kiện assistant

103

247

Thời gian build chủ động

25 phút

48 phút

Token đầu ra

243.442

139.920

Lượt đọc cache

11,3M

26,4M

Gọi công cụ

56 (24 Bash, 19 Edit, 10 Write)

137 (60 Bash, 51 Edit, 20 Write)

Văn bản hiển thị

429 từ (2 khối)

4.808 từ (110 khối)

Tổng chi phí

$28,70

$20,07

Tệp bàn giao

9, không phụ thuộc

13, Vite + Vitest

Dòng mã

~1.010

~1.746

Bài kiểm thử

16, tất cả đậu

58, tất cả đậu

npm test chạy được

Không

Tốc độ mô phỏng

3,14 ms/tick ở 3.510 tác tử

1,35 ms/tick ở 4.368 tác tử

Đẩy lên GitHub

Fable tốn kém hơn 43% và tạo ra nhiều token đầu ra hơn 74% cho một chương trình nhỏ hơn. Vì không thể tắt suy nghĩ, nó tiếp tục tính phí ngay cả khi công việc không cần đến.

Cả hai mô hình đều vượt qua mọi phép kiểm tra khách quan: 

  • Cùng seed tạo ra cùng thế giới.
  • Seed khác nhau cho kết quả khác nhau.
  • Không có giá trị nào thành NaN.
  • Không tác tử nào thoát khỏi thế giới ở vận tốc tối đa.
  • Đều giữ 60 FPS trong trình duyệt với không lỗi console.

Mô phỏng của Opus nhanh hơn 2,3 lần mỗi tick. Nó lưu tác tử trong typed array, một mảng phẳng cho mỗi thuộc tính, và giữ một lưới không gian riêng cho từng loài. Fable cho mỗi tác tử một object riêng và dùng chung một lưới đồng nhất cho cả ba loài. Cả hai đều đúng, nhưng bố cục dữ liệu của Opus nhanh hơn.

Lỗi mà Fable đã bàn giao

Script npm test của Fable không chạy. Nó bàn giao node --test test/, mà Node 26 diễn giải như một đường dẫn module thay vì thư mục, nên lệnh chết trước khi chạy được một bài test. 16 bài test bên dưới đều ổn và vượt qua khi bạn chỉ rõ tên tệp. Điểm vào trong package.json bị lỗi.

Đó là lỗi nhỏ nhưng cái giá lại lớn, vì lệnh mà người đọc thực sự sẽ gõ là lệnh bị fail. Fable cũng không bao giờ phát hiện ra, và đó mới là điều quan trọng: prompt yêu cầu có test, và nó xác minh bằng một cách mà chính người dùng của nó sẽ không làm.

Opus không có lỗi tương tự. 58 bài test của nó chạy từ npm test và đều đậu. Cả hai bộ test đều kiểm tra những thứ quan trọng ở đây: tính xác định theo seed, bảo toàn năng lượng, wrap theo torus, và sự sống còn của loài trong thời gian dài, nên khoảng cách là về độ sâu chứ không phải loại kiểm thử. Kiểm tra duy nhất chỉ Opus viết là stress test 5000 tác tử, cũng là yêu cầu dễ vỡ nhất.

Ảnh chụp màn hình cho thấy gì

Hai ứng dụng trông chẳng giống nhau, đó chính là lý do thay đổi nhiệm vụ.

Title: Mô phỏng hệ sinh thái của Fable 5, thanh bên trái, tác tử vẽ dạng hình vuông phẳng - Description: Mô phỏng hệ sinh thái của Fable 5, thanh bên trái, tác tử vẽ dạng hình vuông phẳng

Fable 5: điều khiển ở bên trái, tác tử là hình vuông phẳng, các loài tên Plants, Herbivores và Predators.

Title: Mô phỏng hệ sinh thái của Opus 5, bảng bên phải, tác tử vẽ dạng tam giác có hướng - Description: Mô phỏng hệ sinh thái của Opus 5, bảng bên phải, tác tử vẽ dạng tam giác có hướng

Opus 5: điều khiển ở bên phải, tác tử là tam giác chỉ hướng di chuyển, các loài tên Plankton, Grazers và Hunters.

Về UI, đây là khác biệt lớn nhất:

  • Fable đặt bảng điều khiển bên trái và vẽ mỗi tác tử thành hình vuông phẳng, và đặt tên loài là Plants, HerbivoresPredators.
  • Opus đặt bảng bên phải và vẽ tam giác có hướng, nên bạn có thể đọc hướng bầy đang di chuyển. Nó chọn chủ đề thủy sinh và dùng Plankton, GrazersHunters.

Đọc đồ thị quần thể

Đồ thị quần thể là nơi khác biệt về thiết kế trở nên rõ nét.

Title: Đồ thị quần thể của Fable trên thang tuyến tính, đường thực vật lấn át và đường săn mồi dính sát trục - Description: Đồ thị quần thể của Fable trên thang tuyến tính, đường thực vật lấn át và đường săn mồi dính sát trục

Đồ thị của Fable 5, thang tuyến tính. Đường của thực vật chiếm hết chiều cao và đường của thú săn mồi dính sát đáy.

Title: Đồ thị quần thể của Opus trên thang log, cả ba loài đều đọc được và đường săn mồi cắt đường con mồi - Description: Đồ thị quần thể của Opus trên thang log, cả ba loài đều đọc được và đường săn mồi cắt đường con mồi

Đồ thị của Opus 5, thang log. Cả ba loài đều dễ đọc, và đường hunter cắt đường grazer.

Cả hai mô phỏng đều dao động đúng kiểu hệ săn mồi - con mồi. Thực vật của Fable dao động giữa 520 và 7.061 trong 5 phút, trong khi thú ăn cỏ và thú săn mồi chạy vòng phía sau, thú săn mồi đạt đỉnh 248 đúng lúc thú ăn cỏ chạm đáy 119.

Trên thang tuyến tính, đường của thực vật chiếm trọn khoảng dọc, thú ăn cỏ bị nén thành một dải mỏng, và thú săn mồi nằm dẹt sát trục.

Đó là lý do Opus đặt đồ thị trên thang log và ghi nhãn giá trị đỉnh. Cả ba loài đều đọc được, và bạn có thể xem đường hunter tăng, cắt đường grazer, rồi giảm khi grazer phục hồi. Cùng một lớp dữ liệu, nhưng chỉ một trong hai biểu đồ là dễ đọc.

Hai hệ sinh thái vận hành ra sao

Nền tảng hệ sinh thái cũng khác nhau. Opus chặn trần lớp sinh vật sản xuất ở 4.229 plankton, nên quần thể đó dính trần và chỉ hai lớp trên dao động. Fable để cả ba lớp liên thông, tạo dao động rộng hơn và thế giới sống động hơn. Chúng ta nhận được sự ổn định so với sinh động dù prompt không yêu cầu.

Title: Bảng tham số của Fable, 13 thanh trượt với đơn vị được đặt tên - Description: Bảng tham số của Fable, 13 thanh trượt với đơn vị được đặt tên

Bảng tham số của Fable 5: 13 thanh trượt theo đơn vị riêng của mô phỏng.

Title: Bảng tham số của Opus, 9 thanh trượt chuẩn hóa thành hệ số 1,00 - Description: Bảng tham số của Opus, 9 thanh trượt chuẩn hóa thành hệ số 1,00

Bảng tham số của Opus 5: 9 thanh trượt, mỗi cái là một hệ số bắt đầu tại 1,00, nhóm theo World và Behaviour.

Fable phơi bày 13 tham số theo đơn vị thực: tăng trưởng thực vật 5, bán kính cảm nhận 60, tách đàn 1,5, và chuyển hóa theo từng loài. Opus phơi bày 9 tham số, tất cả là hệ số chuẩn hóa bắt đầu ở 1,00, chia thành nhóm WorldBehaviour

Tóm gọn trong một câu: Fable cho bạn nhiều quyền kiểm soát hơn, còn Opus cho bạn một bảng điều khiển khó làm hỏng cân bằng hệ sinh thái.

Bạn nên chọn Fable 5 hay Opus 5?

Hãy dùng Opus 5 làm mặc định. Ở bản build này, nó rẻ hơn 30%, chạy mô phỏng nhanh hơn 2,3 lần mỗi tick, và viết bộ kiểm thử tốt hơn. Fable thắng về tốc độ hoàn thành, xong trong khoảng một nửa thời gian.

Chọn Fable 5 khi bạn muốn một bản build hoàn tất trong một lượt với giám sát tối thiểu, hoặc khi dấu chân phụ thuộc là quan trọng. Fable bàn giao một chương trình không phụ thuộc nhỏ hơn 42% so với phương án kia, và đạt được điều đó với 103 lượt assistant so với 247. Sự ngắn gọn này có giá trị thực trên một nhiệm vụ bạn dự định tự đọc lại sau.

Lời kết

Hai bản build của một loại dự án vẫn chưa phải là benchmark. Hiệu năng thực tế có thể khác biệt lớn, bất chấp những gì các benchmark hiện có nói.

Ví dụ, dù so sánh của chúng tôi cho thấy Fable dùng nhiều token hơn Opus, đa số nhà phát triển lại chia sẻ điều ngược lại: Opus 5 đốt nhiều token hơn hẳn so với Fable hay Sol cho các tác vụ tương tự. Nghi ngờ là giai đoạn tiền huấn luyện RL của Opus 5 khiến nó tối ưu quá mức cho việc tăng chi phí token thay vì hữu ích mà súc tích. Ngoài bài so sánh, tôi cũng cảm nhận điều này trong công việc của mình. Các mô hình họ Opus ngày càng dài dòng hơn bề mặt và khó đọc hơn.

Về cá nhân, tôi sẽ tiếp tục dùng Fable 5 cho hầu hết dự án mã hóa của mình, kể cả cho khách hàng, vì về dài hạn nó thắng về độ chính xác. Tôi đang dùng gói Max mới nhất và vẫn chưa chạm giới hạn sử dụng, kể cả khi dùng Fable trong nhiều phiên (dù tôi không chạy Claude Code liên tục). Tôi sẽ dùng Opus khi hóa đơn token là vấn đề, hoặc khi tôi muốn phần bình luận đang chạy về tác vụ để tự hiểu rõ hơn.

Để biết thêm về các mô hình và công cụ xung quanh chúng, tôi khuyến nghị đọc đầy đủ hướng dẫn Claude Fable 5, cùng các hướng dẫn về Claude Code thực hành tốt với Claude Code.


Bex Tuychiev's photo
Author
Bex Tuychiev
LinkedIn

Tôi là người sáng tạo nội dung về khoa học dữ liệu với hơn 2 năm kinh nghiệm và là một trong những tài khoản có lượng theo dõi lớn nhất trên Medium. Tôi thích viết các bài chuyên sâu về AI và ML với chút giọng điệu mỉa mai, vì bạn cũng phải làm gì đó để chúng bớt nhàm chán. Tôi đã xuất bản hơn 130 bài viết và một khóa học trên DataCamp, và đang ấp ủ thêm một khóa nữa. Nội dung của tôi đã tiếp cận hơn 5 triệu lượt xem, trong đó có 20 nghìn người trở thành người theo dõi trên cả Medium và LinkedIn. 

Chủ đề

Học cách sử dụng Claude Code với DataCamp!

Courses

Nhập môn các mô hình Claude

3 giờ
13.3K
Tìm hiểu cách làm việc với Claude bằng cách sử dụng Anthropic API để giải quyết các tác vụ thực tế và xây dựng các ứng dụng tích hợp AI.
Xem chi tiếtRight Arrow
Bắt Đầu Khóa Học
Xem thêmRight Arrow