Chuyển đến nội dung chính

Claude Fable 5 trong Claude Code: Bài kiểm thử thực tế đối đầu Opus 5

Trải nghiệm trực tiếp với mô hình Fable 5 của Anthropic trong Claude Code: cách nó xử lý one-shot build, cơ chế từ chối vì an toàn và chuyển sang Opus, và khi nào nên dùng.
Đã cập nhật 20 thg 8, 2026  · 14 phút đọc

Khám phá với AI

ChatGPTClaudePerplexity

Fable 5 là mô hình viết mã tốt nhất tôi dùng trong nhiều tháng làm việc hàng ngày. Ở lại với nó đòi hỏi chút kiên nhẫn. Chính phủ Mỹ đã buộc tắt nó vài tuần, và sau đó điều kiện truy cập cũng thay đổi liên tục.

Rồi Anthropic phát hành Opus 5. Chi phí bằng một nửa mỗi token, và đây là mô hình mà Claude Code chuyển sang khi Fable từ chối yêu cầu. Điều đó đặt ra câu hỏi hiển nhiên cho bất kỳ ai đang trả phí cao cho Fable: Mô hình đắt tiền có còn là lựa chọn mặc định đúng đắn không?

Vì vậy tôi giao cho cả hai mô hình cùng một bài toán và so sánh về chi phí, tốc độ, độ đúng đắn, và chất lượng phần chúng xuất xưởng. Bài viết này phân tích kết quả.

Fable 5 là gì?

Fable 5 là mô hình tập trung cho lập trình trong họ Claude 5 của Anthropic, phát hành ngày 9/6/2026. Nó ra mắt cùng Mythos 5, một mô hình cùng họ không có bộ phân loại an toàn, mà Anthropic chỉ cung cấp cho một nhóm nhỏ tổ chức đã được thẩm định. Để xem chi tiết bản phát hành và Fable 5 trên các benchmark, hãy xem hướng dẫn Fable 5 chuyên sâu của chúng tôi.

Fable 5 có giá cao hơn Opus 5 và nhắm đến các tác vụ lập trình khó hơn. Khác biệt lớn nhất về cảm nhận là nó luôn bật tư duy trong mọi yêu cầu và không thể tắt, nên trông chậm rãi và có chủ đích hơn. Opus 5 tự quyết định liệu một prompt có đáng để suy nghĩ thêm hay không.

Thông số và giá

Hai mô hình dùng chung cửa sổ ngữ cảnh và kích thước đầu ra tối đa. Chúng khác nhau về giá và cơ chế tư duy hoạt động.

 

Fable 5

Opus 5

Giá input (mỗi 1M token)

$10

$5

Giá output (mỗi 1M token)

$50

$25

Cửa sổ ngữ cảnh

1M token

1M token

Đầu ra tối đa mỗi yêu cầu

128K token

128K token

Tư duy

Luôn bật (không thể tắt)

Thích ứng (tùy chọn)

Hành vi từ chối

stop_reason: "refusal" ở HTTP 200, tùy chọn chuyển sang Opus 4.8

Tiêu chuẩn

Fable 5 có giá khoảng gấp đôi mỗi token so với Opus 5. Vì tư duy luôn bật, một lượt chạy cũng có xu hướng phát ra nhiều token hơn, nên chênh lệch giá trong thực tế lớn hơn con số theo token gợi ý. Trong phần đối đầu xây dựng ở cuối hướng dẫn này, Fable phát ra số token đầu ra nhiều hơn 74% so với Opus dù chương trình nhỏ hơn.

Để so sánh chi tiết bao gồm khác biệt benchmark, hãy đọc Claude Opus 5 vs Claude Fable 5.

Hành vi từ chối mà bạn phải lập trình xử lý

Một điểm gây khó chịu phổ biến ở Fable 5 là bộ phân loại an toàn tích hợp. Vì mô hình bị coi là quá mạnh, bộ phân loại không cho nó xử lý các yêu cầu chỉ hơi liên quan đến các lĩnh vực như sinh học hay an ninh mạng.

Tiêu đề: Fable 5 xử lý một lần từ chối như thế nào - Mô tả: Fable 5 xử lý một lần từ chối như thế nào

Với một nhà miễn dịch học, chỉ riêng từ "cancer" đã kích hoạt bộ lọc an ninh sinh học, khiến Claude Code chuyển về Opus 4.8.

Tôi cũng gặp chuyện này gần đây với một lỗi đăng nhập trong dự án cá nhân. Luồng sử dụng Telegram Gateway API cho đăng nhập OTP, và Fable 5 kiên quyết từ chối đụng vào. Opus 5 thì hoàn thành công việc, và đó chính là vấn đề: chẳng có gì ở lỗi đó là rủi ro bảo mật cả.

Cơ chế chuyển sang mô hình khác tự động, không cần cấu hình chỉ diễn ra trong Claude Code và các ứng dụng Claude. Nếu bạn đang dùng Fable qua API, bạn sẽ nhận trường stop_reason trong phản hồi dù mã trạng thái là 200 thành công.

Phản hồi trông như sau:

{
  "stop_reason": "refusal",
  "stop_details": {
	"category": "bio",
	"explanation": "The request was declined by a safety classifier."
  }
}

Vì thế bạn phải kiểm tra stop_reason trước khi xử lý nội dung phản hồi. 

Để bật chuyển đổi phía máy chủ, hãy truyền mảng fallbacks (ví dụ "fallbacks": [{"model": "claude-opus-4-8"}]) và gửi header anthropic-beta: server-side-fallback-2026-06-01. Thiết lập ở mọi yêu cầu; không có công tắc ở cấp tài khoản.

Lưu ý về mô hình dự phòng

Bạn có thể thắc mắc vì sao có nguồn nói Fable 5 chuyển sang Opus 4.8 còn nơi khác lại chỉ Opus 5. Cả hai đều đúng, vì đích đến phụ thuộc vào hạng mục và bề mặt sử dụng. 

Trong Claude Code, yêu cầu bị gắn cờ sinh học giờ được chạy lại trên Opus 5, trong khi yêu cầu bị gắn cờ an ninh mạng vẫn chạy lại trên Opus 4.8. Trên API, tính năng fallbacks phía máy chủ hiện chỉ hỗ trợ Opus 4.8. 

Sự phân tách này là do thời điểm: khi Fable ra mắt tháng 6, mọi thứ chuyển sang Opus 4.8, và tuyến sinh học sau đó mới được trỏ lại sang Opus 5 khi mô hình này phát hành ngày 24/7.

Tranh cãi quanh Fable 5

Fable 5 khởi đầu đầy trắc trở, ngay cả khi bỏ qua câu chuyện bộ phân loại an toàn.

Giới hạn âm thầm và những lần từ chối sai

Vài ngày sau khi ra mắt, Fortune đưa tin rằng Anthropic đã âm thầm làm suy yếu câu trả lời của Fable 5 trên khoảng 0,03% lưu lượng liên quan hạ tầng AI và ML mà không thông báo cho ai.

Rất nhiều nhà nghiên cứu và cả nhà phát triển tức giận vì họ kỳ vọng một mô hình tuyến đầu chăm chỉ, có thể xử lý mọi tác vụ khi họ đang trả gói thuê bao $200 cho nó.

Anthropic nhượng bộ trước sức ép cộng đồng chỉ trong một ngày, nói rằng họ "đã chọn đánh đổi sai." Điều họ thay đổi là khả năng hiển thị, không phải việc siết. Các yêu cầu bị gắn cờ giờ hiển thị giống như một lần từ chối, còn sự suy giảm bản thân thì giữ nguyên. Lý do Anthropic đưa ra là điều khoản của họ đã cấm dùng Claude để xây hệ thống AI cạnh tranh, điều này có thể bảo vệ được. Nhưng làm âm thầm suốt một tháng thì không.

Đình chỉ do kiểm soát xuất khẩu

Rồi chuyện lớn hơn xảy ra. Một jailbreak đã công khai kích hoạt lệnh kiểm soát xuất khẩu của Bộ Thương mại ngày 12/6, và Anthropic gỡ cả Fable 5 lẫn Mythos 5 xuống trên toàn thế giới trong 19 ngày.

Anthropic phản đối mạnh mẽ lệnh thu hồi trong suốt thời gian đó. Họ lập luận jailbreak là hẹp chứ không phổ quát, và các mô hình yếu hơn cũng có thể tìm ra, nên tiêu chuẩn thu hồi có vẻ mơ hồ dưới góc nhìn của họ. Họ có lý ở mức tiêu chuẩn. Chưa ai từng tạo được jailbreak phổ quát, và chưa mô hình nào hiện nay vượt qua chuẩn đó. Viện An toàn AI Vương quốc Anh đã báo cáo tiến triển hướng tới điều đó, nhưng chưa có gì thực sự hiệu quả.

Họ có lý về mức tiêu chuẩn, nhưng không phải cách diễn đạt. Jailbreak phổ quát có tồn tại: Viện An ninh AI Vương quốc Anh báo cáo đã tìm thấy chúng cho mọi hệ thống tuyến đầu mà họ kiểm thử, và đội red-team của họ đã xây được một chiếc chống lại chính Fable 5, một lượt trong vài giờ và mở rộng lên quy trình đa lượt có tính tác tử trong vài ngày, theo model card của Fable 5.

Điều thực sự gây tranh cãi là liệu tiêu chuẩn đó có nên kích hoạt thu hồi hay không, chứ không phải việc jailbreak như vậy có khả thi hay không.

Khôi phục, kèm giới hạn mới

Anthropic triển khai bộ phân loại mạnh hơn và báo cáo tỷ lệ chặn trên 99%, và nhờ đó, Bộ Thương mại đã gỡ bỏ kiểm soát vào khoảng 30/6.

Quyền truy cập chung trở lại ngày 1/7, nhưng với điều kiện chặt hơn. Cửa sổ không giới hạn hứa hẹn 2 tuần rút còn khoảng một tuần, và mức trần hàng tuần mới 50% có nghĩa là khi vượt ngưỡng, mọi sử dụng Fable 5 tiếp theo bị tính bằng credit theo đúng mức $10 và $50. Thế là đủ để người dùng thuê bao phàn nàn trên Reddit.

Anthropic gia hạn thời hạn hai lần, rồi tách chính sách theo gói vào ngày 20/7: Max và Team Premium giữ Fable 5 ở mức 50% hạn mức tuần không thời hạn, trong khi Pro và Team Standard nhận một lần credit $100 và sau đó trả theo mức API. Mythos 5 quay trở lại chỉ cho khoảng 100 tổ chức tại Mỹ đã qua thẩm định, thu hẹp so với chương trình quốc tế rộng hơn trước đó.

Tất cả điều này khiến Fable 5 là một mô hình mạnh nhưng bị bao bọc bởi chính sách truy cập thay đổi theo từng tháng. Hãy chuẩn bị cho những lần từ chối sai rác rưởi, và đừng trông chờ hạn mức tháng này sẽ giữ nguyên sang tháng sau.

Claude Fable 5 vs Opus 5 trên cùng một dự án

Để xem hai mô hình cư xử thế nào trong điều kiện giống hệt nhau, tôi giao cho mỗi mô hình cùng một việc trong một phiên Claude Code mới. Sau đó, tôi đọc toàn bộ bản ghi phiên, các tệp JSONL nội bộ, và chấm điểm cả hai ứng dụng hoàn chỉnh trong trình duyệt.

Lần thử đầu tiên cho so sánh này là một bộ rút gọn URL. Đó là một sai lầm. Cả hai mô hình tạo ra ứng dụng gần như giống hệt nhau, đến cả chủ đề và bộ tính năng, vì rút gọn URL có một câu trả lời hiển nhiên nằm trong dữ liệu huấn luyện của mọi mô hình. Bài kiểm tra chẳng đo được gì.

Thiết lập one-shot một hệ sinh thái sống trong Fable 5 và Opus 5

Vì vậy tôi chọn một nhiệm vụ không có câu trả lời chuẩn: mô phỏng hệ sinh thái sống. Ba loài trong một mạng thức ăn, tác tử bầy đàn, săn mồi và chết đói, 5000 cá thể trên màn hình cùng lúc, tất cả mang tính quyết định từ một seed. Prompt cấm các thư viện xử lý phần khó, nên mỗi mô hình phải tự viết truy vấn không gian, điều hướng, và động lực quần thể.

Đây là prompt mà cả hai mô hình nhận, từng chữ một:

Build a living ecosystem simulation that runs in the browser, and ship it end-to-end in one shot, without asking me any questions or pausing for confirmation. Make all decisions yourself and only stop when it is fully built, tested, and pushed to GitHub.
 
Requirements:
 
- A real-time canvas simulation of an ecosystem with at least three species in a food web (for example producers, herbivores, predators). Species interact: they eat, they are eaten, they reproduce, and they die.
- Agents move with steering behaviour — flocking among their own kind, and avoidance or pursuit across species.
- Each agent has an energy budget. Moving and reproducing cost energy, eating restores it, and running out kills the agent. Population levels must emerge from these rules rather than being scripted.
- The simulation must stay stable and interactive at 5000 agents. Show a live FPS counter and a live population graph per species.
- The whole world is generated from a numeric seed. The same seed must always produce the same run.
- Controls to pause, resume, reset, reseed, and tune the key simulation parameters live while it runs.
- Implement the simulation yourself: the steering, the spatial queries, the integration, and the population dynamics. Do not use a physics engine, a flocking library, a game engine, or a charting library. Plain canvas and your own code.
- Tests covering the core simulation logic.
- A README with setup and run instructions.
 
The simulation should run in the browser and be usable by someone who has never seen it before.
 
When it is complete, create a new GitHub repository with the gh CLI (which is already installed and authenticated) and push the project to it.

Quy tắc không đặt câu hỏi là trọng tâm. Nó cho thấy mỗi mô hình tự thân đưa một bản build đi xa đến đâu, khi không có ai ở đó để kịp thời chỉnh hướng. Mỗi mô hình chạy trong thư mục trống riêng, không có gợi ý rằng mô hình thứ hai nhận cùng nhiệm vụ.

Bài toán cũng ẩn bốn phép thử khách quan bên trong một đầu ra trông thuần thị giác. 

  • Tìm láng giềng phải dùng chỉ mục không gian, nếu không tốc độ khung hình sẽ sụt khi 5000 tác tử. 
  • Thế giới phải quấn hoặc chặn đúng cách, nếu không tác tử sẽ chui xuyên tường. 
  • Tính ngẫu nhiên phải chạy qua bộ sinh số có seed, nếu không cùng seed sẽ cho kết quả khác. 
  • Và tỷ lệ sinh tử phải cân bằng, nếu không quần thể hoặc tụt về 0 hoặc bùng nổ. 

Mọi lỗi trong số này đều hiện rõ trên màn hình, đó là lý do một bản demo bắt mắt vẫn có thể chấm điểm.

Cả hai bản build đều đang chạy trực tiếp, nên bạn có thể tự so sánh thay vì chỉ nghe lời tôi. Mở hai bản cạnh nhau và reseed mỗi bản:

Ảnh chụp màn hình của cả hai ở phần sau, phòng khi bạn muốn đọc hơn là bấm. Nhưng lưu ý công bằng: ảnh chụp được thu nhỏ để vừa toàn bộ màn hình, nên chi tiết có thể không thật sắc nét.

Mô hình nào thực sự phục vụ mỗi lượt chạy

Trước khi đến kết quả, cần một ghi chú phương pháp luận quan trọng để bạn đọc cho đúng.

Claude Code có thể chuyển sang Opus khi bộ phân loại an toàn của Fable 5 từ chối yêu cầu, nên một lượt chạy gắn nhãn Fable không đảm bảo hoàn toàn do Fable xử lý. Thay vì đoán, tôi ghi lại trường model ở mọi sự kiện assistant trong cả hai bản ghi.

May mắn thay, trong so sánh của tôi, mọi sự kiện ở lượt Fable đều trả về claude-fable-5, tổng cộng 103. Mọi sự kiện ở lượt Opus đều trả về claude-opus-5, tổng cộng 247. Không có chuyển đổi theo hướng nào. Các con số bên dưới mô tả đúng mô hình theo nhãn.

Fable 5 và Opus 5 xử lý vấn đề như thế nào

Fable làm việc yên ắng. Nó chạy 56 lần gọi công cụ và in 429 từ chú thích cho cả bản build, gói trong 2 khối văn bản.

Opus làm việc công khai. Nó chạy 137 lần gọi công cụ, hơn gấp đôi, và in 4.808 từ qua 110 khối. Cả hai mô hình sửa đổi với tốc độ tương tự nếu xét theo khối lượng, gần 2 lần chỉnh cho mỗi tệp viết ra.

Chúng cũng khác biệt về công cụ. Fable xuất xưởng các ES module thuần với script khởi động python3 -m http.server và không có node_modules nào. Opus cài Vite và Vitest và build trên một toolchain thực thụ.

Thời gian build dưới đây chỉ đo phần làm việc chủ động. Tôi lấy mỗi lượt chạy từ sự kiện assistant đầu tiên đến cuối cùng và trừ đi mọi khoảng chờ khi phiên ngồi im thay vì xây dựng.

Kết quả: tốc độ, chi phí, và độ đúng

Khía cạnh

Fable 5

Opus 5

Sự kiện assistant

103

247

Thời gian build chủ động

25 phút

48 phút

Token đầu ra

243.442

139.920

Đọc cache

11,3M

26,4M

Lần gọi công cụ

56 (24 Bash, 19 Edit, 10 Write)

137 (60 Bash, 51 Edit, 20 Write)

Văn bản hiển thị

429 từ (2 khối)

4.808 từ (110 khối)

Tổng chi phí

$28,70

$20,07

Tệp xuất xưởng

9, không phụ thuộc

13, Vite + Vitest

Dòng mã

~1.010

~1.746

Kiểm thử

16, đều pass

58, đều pass

npm test chạy được

Không

Tốc độ mô phỏng

3,14 ms/tick ở 3.510 tác tử

1,35 ms/tick ở 4.368 tác tử

Đẩy lên GitHub

Fable tốn kém hơn 43% và tạo ra số token đầu ra nhiều hơn 74% cho một chương trình nhỏ hơn. Vì không thể tắt tư duy, nó vẫn tính phí ngay cả khi công việc không cần đến.

Cả hai mô hình đều vượt qua mọi kiểm tra khách quan: 

  • Cùng seed tái tạo cùng thế giới.
  • Seed khác nhau cho kết quả khác nhau.
  • Không có gì thành NaN.
  • Không tác tử nào thoát ra ngoài thế giới ở tốc độ tối đa.
  • Cả hai giữ 60 FPS trong trình duyệt, không lỗi console.

Mô phỏng của Opus nhanh hơn 2,3 lần mỗi tick. Nó lưu tác tử trong typed array, một mảng phẳng cho mỗi thuộc tính, và giữ một lưới không gian riêng cho mỗi loài. Fable cấp cho mỗi tác tử một object riêng và dùng chung một lưới đồng nhất cho cả ba loài. Cả hai đều đúng, nhưng bố cục dữ liệu của Opus nhanh hơn.

Lỗi mà Fable đã xuất xưởng

Script npm test của Fable không chạy. Nó xuất xưởng node --test test/, mà Node 26 hiểu là đường dẫn module chứ không phải thư mục, nên lệnh chết trước khi chạy một bài test nào. 16 bài test bên dưới thì ổn và pass nếu bạn nêu rõ tên tệp. Điểm vào trong package.json bị hỏng.

Đó là lỗi nhỏ nhưng cái giá phải trả lớn, vì lệnh duy nhất mà người đọc thực sự sẽ gõ lại là lệnh bị lỗi. Fable cũng không phát hiện ra, và đó mới là điều quan trọng: prompt yêu cầu có test, và nó xác minh theo một lộ trình mà chính người dùng của nó sẽ không đi.

Opus không có lỗi tương đương. 58 bài test của nó chạy từ npm test và pass. Cả hai bộ đều kiểm thử những điều quan trọng ở đây: tính quyết định theo seed, bảo toàn năng lượng, bọc torus, và sự sống còn của loài trong dài hạn, nên khoảng cách là về độ sâu chứ không phải loại. Kiểm tra duy nhất chỉ Opus viết là stress test 5000 tác tử, cũng là yêu cầu dễ hỏng nhất.

Ảnh chụp màn hình cho thấy gì

Hai ứng dụng trông không hề giống nhau, và đó là lý do phải đổi nhiệm vụ.

Tiêu đề: Mô phỏng hệ sinh thái của Fable 5, thanh bên trái, tác tử là các hình vuông phẳng - Mô tả: Mô phỏng hệ sinh thái của Fable 5, thanh bên trái, tác tử là các hình vuông phẳng

Fable 5: bảng điều khiển bên trái, tác tử là hình vuông phẳng, các loài tên Plants, Herbivores, và Predators.

Tiêu đề: Mô phỏng hệ sinh thái của Opus 5, bảng bên phải, tác tử là các tam giác có hướng - Mô tả: Mô phỏng hệ sinh thái của Opus 5, bảng bên phải, tác tử là các tam giác có hướng

Opus 5: bảng điều khiển bên phải, tác tử là các tam giác chỉ hướng di chuyển, các loài tên Plankton, Grazers, và Hunters.

Về UI, đây là khác biệt lớn nhất:

  • Fable đặt bảng điều khiển bên trái và vẽ mọi tác tử thành hình vuông phẳng, đặt tên loài là Plants, Herbivores, và Predators.
  • Opus đặt bảng bên phải và vẽ tam giác có hướng, nên bạn có thể đọc hướng bầy đang di chuyển. Nó chọn chủ đề thủy sinh và đặt là Plankton, Grazers, và Hunters.

Đọc biểu đồ quần thể

Biểu đồ quần thể là nơi khác biệt thiết kế trở nên rõ nét.

Tiêu đề: Biểu đồ quần thể của Fable trên thang tuyến tính, đường của thực vật áp đảo và đường của thú săn phẳng sát trục - Mô tả: Biểu đồ quần thể của Fable trên thang tuyến tính, đường của thực vật áp đảo và đường của thú săn phẳng sát trục

Biểu đồ của Fable 5, thang tuyến tính. Đường của thực vật chiếm trọn chiều cao và đường của thú săn dính sát đáy.

Tiêu đề: Biểu đồ quần thể của Opus trên thang log, cả ba loài đều dễ đọc và đường của thú săn cắt qua đường con mồi - Mô tả: Biểu đồ quần thể của Opus trên thang log, cả ba loài đều dễ đọc và đường của thú săn cắt qua đường con mồi

Biểu đồ của Opus 5, thang log. Cả ba loài đều dễ đọc, và đường của thợ săn cắt đường của kẻ gặm cỏ.

Cả hai mô phỏng đều dao động đúng kiểu hệ săn mồi - con mồi. Thực vật của Fable dao động từ 520 đến 7.061 trong 5 phút trong khi thú ăn cỏ và thú săn chu kỳ phía sau, thú săn đạt đỉnh 248 đúng lúc thú ăn cỏ chạm đáy 119.

Trên thang tuyến tính, đường của thực vật chiếm trọn dải thẳng đứng, thú ăn cỏ bị nén thành dải mỏng, và thú săn nằm phẳng sát trục.

Đó là lý do Opus đặt biểu đồ trên thang log và gắn nhãn điểm đỉnh. Cả ba loài đều đọc được, và bạn có thể xem đường của thợ săn tăng, cắt đường của kẻ gặm cỏ, rồi giảm khi kẻ gặm cỏ phục hồi. Cùng một lớp dữ liệu, nhưng chỉ một đồ thị là đọc được.

Hai hệ sinh thái vận hành ra sao

Hệ sinh thái nền tảng cũng khác. Opus chặn trần lớp sinh vật sản xuất ở 4.229 plankton, nên quần thể đó dính trần và chỉ hai loài phía trên dao động. Fable để cả ba cùng ghép nối, tạo dao động rộng hơn và thế giới sinh động hơn. Chúng ta nhận được "ổn định" so với "năng động" dù prompt không yêu cầu.

Tiêu đề: Bảng tham số của Fable, 13 thanh trượt với đơn vị đặt tên - Mô tả: Bảng tham số của Fable, 13 thanh trượt với đơn vị đặt tên

Bảng tham số của Fable 5: 13 thanh trượt theo đơn vị riêng của mô phỏng.

Tiêu đề: Bảng tham số của Opus, 9 thanh trượt chuẩn hóa về bội số 1,00 - Mô tả: Bảng tham số của Opus, 9 thanh trượt chuẩn hóa về bội số 1,00

Bảng tham số của Opus 5: 9 thanh trượt, mỗi thanh là hệ số nhân bắt đầu ở 1,00, nhóm theo World và Behaviour.

Fable phơi bày 13 tham số theo đơn vị thực: tăng trưởng thực vật 5, bán kính cảm nhận 60, tách rời 1,5, và chuyển hóa theo từng loài. Opus phơi bày 9 tham số, tất cả là bội số chuẩn hóa bắt đầu ở 1,00, tách thành nhóm WorldBehaviour

Tóm lại trong một câu: Fable cho bạn nhiều quyền kiểm soát hơn, còn Opus cung cấp một bảng điều khiển khó làm vỡ cân bằng hệ sinh thái.

Bạn nên chọn Fable 5 hay Opus 5?

Hãy dùng Opus 5 làm mặc định. Trong bản build này, nó rẻ hơn 30%, chạy mô phỏng nhanh hơn 2,3 lần, và viết bộ kiểm thử tốt hơn. Fable thắng về tốc độ hoàn thành, xong trong khoảng một nửa thời gian.

Chuyển sang Fable 5 khi bạn muốn hoàn thiện bản build trong một lượt với giám sát tối thiểu, hoặc khi dấu chân phụ thuộc quan trọng. Fable xuất xưởng chương trình không phụ thuộc, nhỏ hơn 42% so với phương án còn lại, và đạt được điều đó với 103 lượt assistant so với 247. Sự súc tích đó rất đáng giá cho tác vụ bạn dự định tự đọc sau này.

Lời kết

Hai bản build của một loại dự án vẫn chưa phải benchmark. Hiệu năng thực tế có thể khác biệt lớn dù benchmark hiện có nói gì.

Chẳng hạn, dù so sánh của chúng tôi cho thấy Fable dùng nhiều token hơn Opus, đa số nhà phát triển lại chia sẻ điều ngược lại: Opus 5 đốt nhiều token hơn hẳn Fable hoặc Sol trên các tác vụ tương tự. Nghi ngờ là giai đoạn pre-training RL của Opus 5 khiến nó tối ưu hóa quá mức cho việc tăng chi phí token thay vì hữu ích mà súc tích. Ngoài so sánh này, tôi cũng cảm nhận điều đó trong công việc của mình. Các mô hình họ Opus ngày càng dài dòng bề nổi và khó đọc hơn.

Về cá nhân, tôi sẽ tiếp tục dùng Fable 5 cho hầu hết dự án lập trình của mình, kể cả cho khách hàng, vì về dài hạn nó thắng về độ chính xác. Tôi đang ở gói Max mới nhất, và tôi chưa chạm hạn mức sử dụng, ngay cả khi dùng Fable trong nhiều phiên (dù tôi không chạy Claude Code liên tục). Tôi sẽ dùng Opus khi chi phí token là vấn đề, hoặc khi tôi muốn có thuyết minh đang diễn ra về tác vụ để tự hiểu.

Để tìm hiểu thêm về các mô hình và công cụ xung quanh chúng, tôi khuyến nghị đọc đầy đủ hướng dẫn Claude Fable 5 của chúng tôi, cùng với các hướng dẫn về Claude Code Các thực tiễn tốt nhất cho Claude Code.


Bex Tuychiev's photo
Author
Bex Tuychiev
LinkedIn

Tôi là người sáng tạo nội dung về khoa học dữ liệu với hơn 2 năm kinh nghiệm và là một trong những tài khoản có lượng theo dõi lớn nhất trên Medium. Tôi thích viết các bài chuyên sâu về AI và ML với chút giọng điệu mỉa mai, vì bạn cũng phải làm gì đó để chúng bớt nhàm chán. Tôi đã xuất bản hơn 130 bài viết và một khóa học trên DataCamp, và đang ấp ủ thêm một khóa nữa. Nội dung của tôi đã tiếp cận hơn 5 triệu lượt xem, trong đó có 20 nghìn người trở thành người theo dõi trên cả Medium và LinkedIn. 

Chủ đề
Trí tuệ Nhân tạo
Mô hình Ngôn ngữ Lớn

Học sử dụng Claude Code cùng DataCamp!

Courses

Nhập môn các mô hình Claude

3 giờ
14.2K
Tìm hiểu cách làm việc với Claude bằng cách sử dụng Anthropic API để giải quyết các tác vụ thực tế và xây dựng các ứng dụng tích hợp AI.
Xem chi tiếtRight Arrow
Bắt Đầu Khóa Học
Xem thêmRight Arrow
Có liên quan

blogs

Claude Opus 4.6: Tính năng, Điểm chuẩn, Bài kiểm tra thực hành và hơn thế nữa

Mô hình mới nhất của Anthropic dẫn đầu ở mã hóa tác tử và lập luận phức tạp. Thêm vào đó, nó có cửa sổ ngữ cảnh 1M.
Matt Crabtree's photo

Matt Crabtree

10 phút

Xem ThêmXem Thêm