ข้ามไปยังเนื้อหาหลัก

Claude Opus 5 เทียบกับ Claude Fable 5: ควรใช้โมเดล Anthropic รุ่นใด?

การเปรียบเทียบแบบตัวต่อตัวระหว่าง Claude Opus 5 และ Claude Fable 5 ของ Anthropic ครอบคลุมผลทดสอบ ราคา มาตรการป้องกัน และเวิร์กโหลดจริง
อัปเดตแล้ว 29 ก.ค. 2569  · 12 นาที อ่าน

สำรวจด้วย AI

เปิดใน ChatGPTเปิดใน Claudeเปิดใน Perplexity

หากกำลังตัดสินใจว่าจะใช้โมเดล Anthropic รุ่นใดกับเอเจนต์ของคุณ ตอนนี้มีตัวเลือกระดับเรือธงสองรุ่นที่ความสามารถใกล้เคียงกัน แต่ราคาต่างกันมาก Claude Opus 5 เปิดตัวเมื่อ 24 กรกฎาคม 2026 ที่ $5 ต่อโทเคนอินพุตหนึ่งล้าน ส่วน Claude Fable 5 เปิดตัวเมื่อ 9 มิถุนายน 2026 ที่ราคาเป็นสองเท่าพอดี คำถามชัดเจนคือ ระดับที่สูงกว่าของ Fable 5 ให้สิ่งที่ Opus 5 ยังไม่มีหรือไม่

Anthropic ระบุว่า Opus 5 เป็นมาตรฐานใหม่สำหรับงานเขียนโค้ดและงานความรู้ จากการประเมินอย่าง Frontier-Bench และ GDPval-AA และในบางผลทดสอบมันชนะ Fable 5 แบบขาด นั่นทำให้สมมติฐานเดิมที่ว่ารุ่นแพงกว่าจะชนะเสมอพลิกผันไป

บทความนี้จะเปรียบเทียบ Opus 5 กับ Fable 5 ในมิติงานโค้ด งานเชิงเอเจนต์ การให้เหตุผล มาตรการป้องกัน และราคา เพื่อช่วยให้เลือกให้เหมาะกับเวิร์กโฟลว์ หากต้องการเนื้อหาเชิงลึกของแต่ละรุ่น ดู คู่มือ Claude Opus 5 และ คู่มือ Claude Fable 5 ของเรา

สรุปสั้น (TL;DR)

  • Opus 5 ให้ความฉลาดประมาณระดับเดียวกับ Fable 5 แต่ราคาครึ่งเดียว ($5/$25 ต่อหนึ่งล้านโทเคน เทียบกับ $10/$50) จึงเหมาะเป็นค่าเริ่มต้นสำหรับแทบทุกคน
  • Opus 5 ชนะ Fable 5 บน Frontier-Bench v0.1 (43.3% เทียบกับ 33.7%) และ SWE-bench Verified (96.0% เทียบกับ 95.0%) ขณะที่ Fable 5 นำเล็กน้อยบน SWE-bench Pro (80.3% เทียบกับ 79.2%)
  • Elo ของ Fable 5 บน GDPval-AA v2 อยู่ที่ 1,747 ตามหลัง Opus 5 ที่ 1,861 ดังนั้น Opus 5 จึงนำบนการประเมินงานความรู้ด้วย
  • Fable 5 มาพร้อมมาตรการป้องกันไซเบอร์และชีววิทยาที่เข้มกว่า โดยจะส่งคำขอที่ถูกธงไปยัง Opus 4.8; คลาสซิไฟเออร์ของ Opus 5 แทรกแซงน้อยกว่าประมาณ 85%
  • เลือก Fable 5 เฉพาะเมื่อจำเป็นต้องใช้ตำแหน่งด้านความปลอดภัยที่ควบคุมเข้ม หรือการรูตแบบ Mythos-class; เลือก Opus 5 สำหรับงานทั่วไปด้านการเขียนโค้ด งานเชิงเอเจนต์ และงานความรู้แทบทั้งหมด

Claude Opus 5 คืออะไร?

Claude Opus 5 เป็นโมเดลล่าสุดของ Anthropic ในตระกูล Opus เปิดตัวเมื่อ 24 กรกฎาคม 2026 และตั้งราคาที่เท่ากับรุ่นก่อนหน้า Opus 4.8

Anthropic อธิบายว่าเป็นโมเดลที่รอบคอบและเชิงรุกสำหรับการใช้งานประจำวัน ปัจจุบันเป็นโมเดลเริ่มต้นบน Claude Max และเป็นโมเดลที่แข็งแกร่งที่สุดบน Claude Pro ลักษณะเด่นคือความมุ่งมั่นแบบเอเจนต์: ตรวจสอบงานของตัวเองและวนทำซ้ำจนงานสำเร็จจริง แทนที่จะหยุดที่คำตอบที่ดูสมเหตุสมผล

หากอยากเห็นพฤติกรรมจริง ลองดู บทเรียน API ของ Claude Opus 5 ที่เราสร้างและทดสอบเอเจนต์แก้บั๊กสำหรับงานโค้ดครอบคลุมทั้งห้าระดับความพยายามด้านเหตุผล และอาจสนใจ เทมเพลต Claude Code หากวางแผนจะรัน Opus 5 ในเวิร์กโฟลว์เชิงเอเจนต์

Claude Fable 5 คืออะไร?

Claude Fable 5 เป็นโมเดลระดับ Mythos ที่ Anthropic ทำให้ปลอดภัยต่อการใช้งานทั่วไป เปิดตัวเมื่อ 9 มิถุนายน 2026 ที่ $10 ต่อหนึ่งล้านโทเคนอินพุต และ $50 ต่อหนึ่งล้านโทเคนเอาต์พุต ถูกถอดออกชั่วคราวเมื่อ 12 มิถุนายน 2026 เพื่อปฏิบัติตามคำสั่งควบคุมการส่งออกของสหรัฐฯ และ Anthropic คืนการเข้าถึงเมื่อ 1 กรกฎาคม 2026 หลังคำสั่งถูกยกเลิก

Anthropic จัดวางตำแหน่งเหนือชั้น Opus ในด้านศักยภาพดิบ และตอนเปิดตัวถือเป็นระดับแนวหน้าในแทบทุกผลทดสอบ โดยยิ่งทิ้งห่างเมื่อภารกิจยาวและซับซ้อนขึ้น จุดเด่นคือชุดคลาสซิไฟเออร์ที่รูตคำขอเกี่ยวกับไซเบอร์ซีเคียวริตี้ ชีววิทยา และการดิสทิลเลชันที่ถูกธงไปยัง Opus 4.8 แทนการตอบโดยตรง

Claude Opus 5 เทียบกับ Claude Fable 5: เปรียบเทียบแบบตัวต่อตัว

สรุปย่อก่อนลงรายละเอียด: Opus 5 และ Fable 5 ทำคะแนนใกล้เคียงกันในหลายผลทดสอบ แต่ Opus 5 ทำได้ในราคาครึ่งเดียว

คุณสมบัติ Claude Opus 5 Claude Fable 5
วันเปิดตัว 24 กรกฎาคม 2026 9 มิถุนายน 2026
ราคาอินพุต (ต่อโทเคน 1M) $5 $10
ราคาเอาต์พุต (ต่อโทเคน 1M) $25 $50
SWE-bench Verified 96.0% * 95.0%
SWE-bench Pro 79.2% 80.3% *
Frontier-Bench v0.1 43.3% * 33.7%
ARC-AGI 3 30.2% * ไม่ได้เผยแพร่
GDPval-AA v2 (Elo) 1,861 * 1,747
ท่าทีด้านการป้องกัน คลาสซิไฟเออร์ไซเบอร์แบบเบา คลาสซิไฟเออร์ครอบคลุมไซเบอร์/ชีวะ/ดิสทิลเลชัน
การเปิดให้ใช้งาน ทุกแพลตฟอร์มและทุกระดับ ทุกแพลตฟอร์ม ทยอยเปิดใช้สำหรับผู้บริโภค

* ผู้นำภาพรวมปัจจุบันบนผลทดสอบนี้

เวิร์กโฟลว์การเขียนโค้ดและเชิงเอเจนต์

งานเขียนโค้ดคือที่ที่คนส่วนใหญ่จะนำโมเดลเหล่านี้ไปใช้ และเป็นมิติที่ช่องว่างด้านราคาดูไม่ค่อยมีเหตุผลที่สุด บน SWE-bench Verified Opus 5 ได้ 96.0% เทียบกับ Fable 5 ที่ 95.0% นำอยู่หนึ่งคะแนนด้วยราคาที่ถูกกว่า บน Frontier-Bench v0.1 ซึ่งเป็นการประเมินการโค้ดในเทอร์มินัล Opus 5 ทิ้งห่างไปที่ 43.3% เทียบกับ 33.7%

Fable 5 พลิกกลับมาชนะเฉียดฉิวบน SWE-bench Pro ที่ 80.3% เทียบกับ 79.2% ของ Opus 5 ช่องว่างหนึ่งคะแนนในอีกทิศ บอกเราว่าทั้งสองแทบจะเสมอกันในงานวิศวกรรมระดับรีโพซิทอรี ทีม Cognition รายงานว่า Opus 5 เข้าใกล้ประสิทธิภาพระดับ Fable ที่ครึ่งหนึ่งของต้นทุน บนการประเมิน FrontierCode 1.1 ซึ่งสอดคล้องกับตัวเลขสาธารณะ

ผลทดสอบ Opus 5 Fable 5 หมายเหตุ
SWE-bench Verified 96.0% 95.0% ผู้พัฒนารายงาน
SWE-bench Pro 79.2% 80.3% ชัยชนะด้านโค้ดเพียงรายการเดียวของ Fable 5 ที่นี่
Frontier-Bench v0.1 43.3% 33.7% โค้ดในเทอร์มินัล; Opus 5 นำ +9.6 จุดเปอร์เซ็นต์
Terminal-Bench 2.1 ไม่ได้เผยแพร่ 88.0% ไม่มีคะแนนของ Opus 5 เผยแพร่

ข้อสรุปคือ Opus 5 ทำได้เทียบเท่าหรือดีกว่า Fable 5 บนผลทดสอบงานโค้ดที่เผยแพร่ทั้งหมด โดยมีข้อยกเว้นเพียง SWE-bench Pro ตามกรอบของ Anthropic เอง Opus 5 เพิ่มคะแนน Frontier-Bench จาก Opus 4.8 กว่าเท่าตัวที่ต้นทุนต่อภารกิจต่ำกว่า และยังชนะ Fable 5 บนผลทดสอบนั้นด้วย สำหรับงานโค้ด รุ่นที่แพงกว่าไม่ได้ให้สิ่งเพิ่มเติม

Claude Opus 5 เทียบกับ Claude Fable 5 ในงานโค้ด

งานเชิงเอเจนต์และการใช้งานคอมพิวเตอร์

ทั้งสองถูกออกแบบมาสำหรับงานเชิงเอเจนต์ระยะยาว มิตินี้จึงสำคัญหากใช้งานแบบไปเองอัตโนมัติ ไม่ใช่พรอมป์ตครั้งเดียว ที่นี่ พฤติกรรมการตรวจสอบเชิงรุกของ Opus 5 เป็นตัวแบ่งที่ผลทดสอบจับได้บางส่วน

บน ARC-AGI 3 ซึ่งโมเดลต้องแก้ปัญหาใหม่ Opus 5 กระโดดจาก 1.5% ของ Opus 4.8 ไปที่ 30.2% สูงกว่าโมเดลอันดับถัดไปเกือบสี่เท่า (GPT-5.6 Sol ที่ 7.8%) น่าเสียดายที่ Anthropic ไม่ได้เผยคะแนนของ Fable 5 จึงเปรียบเทียบโดยตรงไม่ได้

บน OSWorld 2.0 ซึ่งเป็นผลทดสอบการใช้งานคอมพิวเตอร์ Opus 5 (70.6%) แทนที่ Fable 5 (66.1%) ขึ้นเป็นผู้นำภาพรวม และบน AutomationBench ของ Zapier มันทำอัตราผ่าน 100% บนลำดับการป้องกันการยกเลิกที่รุ่นก่อน ๆ ทำไม่สำเร็จเลย

Opus 5 ชนะงานเชิงเอเจนต์ต่อหนึ่งดอลลาร์แบบขาดลอย

การให้เหตุผลและงานความรู้

งานความรู้เป็นจุดขายหลักของ Fable 5 จึงคาดว่าจะนำ แต่กลับไม่ใช่ บน GDPval-AA v2 ซึ่งเป็นเกณฑ์ Elo สำหรับงานความรู้ Opus 5 ได้ 1,861 เทียบกับ Fable 5 ที่ 1,747 ช่องว่าง 114 Elo เข้าข้างรุ่นที่ถูกกว่า 

Fable 5 ยังได้เปรียบจริงบนเหตุผลเชิงวิทยาศาสตร์ที่ยากและยาวมาก และ Anthropic ระบุชัดว่าความสามารถระดับ Mythos ยังแข็งแกร่งกว่าสำหรับงานชีววิทยาอัตโนมัติระยะยาว แต่สำหรับงานวิเคราะห์และงานความรู้ที่ทีมส่วนใหญ่ทำ คะแนน GDPval-AA ที่สูงกว่าของ Opus 5 หมายความว่าคุณจ่ายแพงกว่าเพื่อผลลัพธ์ที่แย่กว่า

มาตรการป้องกันและพฤติกรรมการปฏิเสธ

มิตินี้เป็นจุดที่สองรุ่นแตกต่างจริง และเป็นเหตุผลที่ Fable 5 แยกเป็นผลิตภัณฑ์ต่างหาก ทั้งยังเป็นมิติที่มักถูกอ่านผิด เพราะมีสองสิ่งที่ถูกเรียกว่าความปลอดภัย และมันวัดกันคนละปลาย

อย่างแรกคือ ความทนทานต่อการใช้ในทางที่ผิด: ระบบคลาสซิไฟเออร์ภายนอกที่อยู่หน้าโมเดลและรูตคำขออันตรายก่อนถึงโมเดล อย่างที่สองคือ การจัดแนว: พฤติกรรมของตัวโมเดลเอง รวมถึงว่าจะหลอกลวงหรือไม่ ทำการกระทำที่เสี่ยงและย้อนกลับไม่ได้หรือไม่ หรือถูกชักจูงให้ใช้งานผิดได้หรือไม่

โมเดลอาจทำคะแนนดีอย่างหนึ่งแต่ยังต้องพึ่งระบบอีกอย่างหนัก เพราะคลาสซิไฟเออร์ไม่ได้คุมไม่ให้โมเดลหลุดกรอบ แต่คุมไม่ให้ผู้ใช้ดึงสิ่งที่เป็นอันตรายออกมา

Fable 5 เป็นโมเดลระดับ Mythos ที่มีระบบคลาสซิไฟเออร์ที่หนักกว่า ครอบคลุมสามด้าน และเมื่อทริกเกอร์ คำขอจะตกกลับไปที่ Opus 4.8:

  • ไซเบอร์ซีเคียวริตี้: บล็อกทั้งงานเจาะช่องโหว่และงานจู่โจมไซเบอร์ที่กว้างขึ้น ทำให้ประสิทธิภาพของ Fable 5 บนผลทดสอบไซเบอร์กลายเป็น 0% เมื่อคลาสซิไฟเออร์ทำงาน
  • ชีววิทยาและเคมี: คำขอด้านชีววิทยาและเคมีส่วนใหญ่จะตกกลับไปที่ Opus 4.8 โดยปริยาย
  • ดิสทิลเลชัน: คำขอที่ถูกธงว่าเป็นการดึงความสามารถของ Fable 5 จะถูกรูตออก

Anthropic ปรับจูนอย่างระมัดระวัง: ข้อมูลระยะแรกชี้ว่า มากกว่า 95% ของเซสชัน Fable 5 ไม่ทริกเกอร์การตกกลับเลย

Opus 5 มีระบบแบบเดียวกันในเวอร์ชันที่เบากว่า คลาสซิไฟเออร์ด้านไซเบอร์อนุญาตการหาช่องโหว่จากซอร์สโค้ด แต่บล็อกการสแกนแบบไบนารี การทดสอบเจาะระบบ และการสร้างเอ็กซ์พลอยต์ และคาดว่าจะทริกเกอร์น้อยกว่า Fable 5 ประมาณ 85%

บนการตรวจสอบพฤติกรรมอัตโนมัติของมันเอง Opus 5 ได้ 2.3 ในพฤติกรรมไม่สอดคล้อง ซึ่ง Anthropic ระบุว่าเป็นโมเดลที่จัดแนวดีที่สุดจนถึงปัจจุบัน แซง Opus 4.8, Sonnet 5 และ Fable 5

ดังนั้นนี่คือการเลือกเส้นทาง ไม่ใช่ตารางคะแนน สำหรับงานโค้ด งานความรู้ และการใช้คอมพิวเตอร์ทั่วไป Opus 5 เป็นโมเดลที่จัดแนวดีและกีดขวางน้อยกว่า สำหรับแดนหน้าของโดเมนที่มีการป้องกัน เช่น งานวิจัยความปลอดภัยเชิงรุกหรือชีววิทยาระยะยาว Fable 5 (หรือ Mythos 5 ผ่าน Cyber Verification Program) เป็นเครื่องมือที่ทรงพลังกว่า และพฤติกรรมการปฏิเสธที่หนักคือต้นทุนของการไปถึงจุดนั้น

ราคา: สิ่งที่จ่ายจริง

Fable 5 มีราคาแพงกว่า Opus 5 เท่าตัวทั้งอินพุตและเอาต์พุต โหมด Fast ของ Opus 5 ซึ่งรันเร็วกว่าเริ่มต้นราว 2.5 เท่า มีราคา $10 อินพุต และ $50 เอาต์พุต พอดีกับเรตราคามาตรฐานของ Fable 5

อัตรา Opus 5 Fable 5
อินพุต ต่อโทเคน 1M $5.00 $10.00
เอาต์พุต ต่อโทเคน 1M $25.00 $50.00
อินพุตโหมด Fast ต่อโทเคน 1M $10.00 ไม่มี
เอาต์พุตโหมด Fast ต่อโทเคน 1M $50.00 ไม่มี

ต้นทุนเวิร์กโหลดจริง

ทั้งสองใช้ตัวแบ่งโทเคนรุ่นใหม่ของ Anthropic ตั้งแต่รุ่น Opus 4.7 ข้อความเหมือนกันจึงใช้จำนวนโทเคนอินพุตเท่ากัน และยังไม่มีการเผยแพร่การเปรียบเทียบจำนวนโทเคนที่ควบคุมตัวแปรสำหรับงานเดียวกัน

ปริมาณรายเดือน Opus 5 Fable 5 ความต่าง
เบา: อิน 1M / เอาต์ 250K $11.25 $22.50 Opus 5 ประหยัด $11.25 (50%)
หนัก: อิน 100M / เอาต์ 25M $1,125 $2,250 Opus 5 ประหยัด $1,125 (50%)

ในระดับหนัก นั่นคือส่วนต่างรายเดือน $1,125 สำหรับฟีเจอร์โปรดักชันหรือเอเจนต์ที่รันต่อเนื่อง และผลทดสอบยืนยันว่าคุณไม่ได้เสียอะไรในงานโค้ดหรืองานความรู้เพื่อแลกมันมา

อย่างไรก็ดี ให้มองยอดรวมเหล่านี้เป็นการเทียบอัตรามากกว่าการพยากรณ์ที่แม่นยำ Opus 5 อาจมีค่าใช้จ่ายสูงกว่า Opus 4.8 ในทางปฏิบัติ เพราะมักปล่อยโทเคนคิดวิเคราะห์มากกว่า แต่ก็ไม่เปลี่ยนภาพรวมว่า Opus 5 จะถูกกว่ามากเมื่อเทียบกับอีกรุ่นในกรณีส่วนใหญ่

Opus 5 มีค่าครึ่งหนึ่งของ Fable 5ควรเลือก Claude Opus 5 หรือ Claude Fable 5 เมื่อใด

สำหรับผู้อ่านส่วนใหญ่ การตัดสินใจสั้น ๆ คือ Opus 5 คือค่าพื้นฐาน ส่วน Fable 5 คือข้อยกเว้น ตารางด้านล่างครอบคลุมสถานการณ์ที่กลับกัน

กรณีใช้งาน แนะนำ เหตุผล
เอเจนต์โค้ดระดับรีโพซิทอรี Opus 5 เทียบเท่าหรือชนะ Fable 5 บน SWE-bench และนำบน Frontier-Bench ที่ครึ่งต้นทุน
งานความรู้และวิเคราะห์ประจำวัน Opus 5 Elo บน GDPval-AA v2 สูงกว่า (1,861 เทียบกับ 1,747) ที่ครึ่งราคา
เวิร์กโหลดโปรดักชันปริมาณสูง Opus 5 ส่วนลด 50% ทบต้นเป็นมากกว่า $1,000/เดือนในระดับหนัก
การให้เหตุผลกับปัญหาใหม่และนามธรรม Opus 5 คะแนน ARC-AGI 3 ที่ 30.2% สูงกว่ารุ่นถัดไปสามเท่า
งานวิจัยชีววิทยาอัตโนมัติระยะยาว Fable 5 ความสามารถระดับ Mythos ยังแข็งแกร่งกว่าสำหรับงานเฉพาะนี้
เวิร์กโฟลว์ที่ต้องการมาตรการป้องกันกว้าง Fable 5 คลาสซิไฟเออร์ครอบคลุมไซเบอร์ ชีวะ และดิสทิลเลชันอย่างกว้างกว่า

เลือก Opus 5 หาก...

  • กำลังสร้างเครื่องมือโค้ดหรือเอเจนต์ และต้องการประสิทธิภาพต่อหนึ่งดอลลาร์ที่ดีที่สุด เพราะชนะ Fable 5 บน Frontier-Bench และเสมอกันบน SWE-bench
  • รันเวิร์กโหลดปริมาณสูงที่การลดอัตรา 50% แปลงเป็นงบประมาณจริง และผลทดสอบยืนยันว่าไม่เสียคุณภาพ
  • ต้องการโมเดลที่จัดแนวดีที่สุด โดยอิงคะแนนตรวจสอบพฤติกรรมไม่สอดคล้อง 2.3 ซึ่งดีที่สุดของ Anthropic จนถึงปัจจุบัน
  • ต้องการพฤติกรรมปฏิเสธที่เบากว่าสำหรับงานวิจัยความปลอดภัยที่ชอบธรรม เพราะคลาสซิไฟเออร์ทริกเกอร์น้อยกว่า Fable 5 ราว 85%

เลือก Fable 5 หาก...

  • งานเป็นวิจัยชีววิทยาอัตโนมัติระยะยาว พื้นที่เดียวที่ Anthropic ระบุว่าความสามารถระดับ Mythos ยังนำหน้า
  • จำเป็นต้องมีความครอบคลุมของคลาสซิไฟเออร์ที่กว้างขึ้นในไซเบอร์ ชีววิทยา และดิสทิลเลชันตามที่ระบบป้องกันของ Fable 5 จัดให้
    กรณีใช้ Claude Opus 5 เทียบกับ Fable 5

เริ่มต้นใช้งาน Claude Opus 5 และ Claude Fable 5 อย่างไร

ทั้งสองรุ่นเปิดให้ใช้งานกว้างบนแอป Claude, API, แพลตฟอร์มคลาวด์หลัก และเอเจนต์เขียนโค้ดของ Anthropic ความต่างเชิงปฏิบัติมีไม่มากและมักปรากฏในระดับแผนผู้ใช้ทั่วไป

ช่องทาง Opus 5 Fable 5
แอปสำหรับผู้ใช้ทั่วไป แอป Claude (รวมใน Pro, Max, Team, Enterprise; เป็นค่าเริ่มต้นบน Max แข็งแกร่งที่สุดบน Pro) แอป Claude (Max และ Team Premium: รวมให้ จำกัดรายสัปดาห์ 50%; Pro และ Team Standard: ใช้เครดิตการใช้งานเท่านั้น)
API ของผู้พัฒนา Anthropic API Anthropic API
แพลตฟอร์มคลาวด์ Amazon Bedrock, Vertex AI, Microsoft Foundry Amazon Bedrock, Vertex AI, Microsoft Foundry
เอเจนต์เขียนโค้ด Claude Code, Claude Cowork Claude Code, Claude Cowork
รหัสโมเดลบน API claude-opus-5 claude-fable-5

บน API ทั้งสองเป็นแค่การสลับสตริงเดียว โดยใช้ claude-opus-5 และ claude-fable-5 ตามลำดับ

ช่องว่างที่ชัดเจน: บน Pro และ Team Standard Fable 5 ไม่ได้รวมอยู่เลย ต้องใช้เครดิตแบบจ่ายตามการใช้งานที่เรต API ขณะที่ Opus 5 รวมอยู่ในแผนเหล่านั้น

การใช้ Opus 5 และ Fable 5 ในเอเจนต์เขียนโค้ด

ทั้งสองรุ่นเลือกใช้ได้ใน Claude Code และการสลับเป็นเพียงการเปลี่ยนสตริงโมเดลในคำขอหรือการตั้งค่าเอเจนต์ เนื่องจากใช้ SDK เดียวกัน การย้ายเอเจนต์ที่ทำงานได้จากรุ่นหนึ่งไปอีกรุ่นจึงเป็นการแก้หนึ่งบรรทัด

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # swap for "claude-fable-5"
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)

รายละเอียดการใช้งานจากการทดสอบจริง: Opus 5 คืนบล็อกการคิดโดยค่าเริ่มต้น ดังนั้นการเข้าถึง response.content.text โดยตรงอาจเกิด AttributeError เมื่อบล็อกแรกเป็นบล็อกการคิด เราครอบคลุมการตั้งค่าทั้งหมด การปรับระดับความพยายาม และพฤติกรรมแคชพรอมป์ตใน บทเรียน API ของ Claude Opus 5

ข้อคิดส่งท้าย

ขอแนะนำให้ใช้ Opus 5 หากไม่มีเหตุผลเฉพาะเจาะจงที่จะไม่ใช้ มันเทียบเท่าหรือชนะ Fable 5 ในงานโค้ด ชนะเกณฑ์ Elo สำหรับงานความรู้ ทำคะแนนการให้เหตุผลกับโจทย์ใหม่สูงกว่ามาก และทำทั้งหมดนี้ที่ครึ่งราคา พร้อมได้คะแนนการจัดแนวที่ดีที่สุดของ Anthropic

Fable 5 ไม่ใช่โมเดลแย่ เพียงแต่มิได้ถูกออกแบบมาสำหรับสิ่งที่ทีมส่วนใหญ่ทำ มันมีมาตรการป้องกันที่หนักกว่าและได้เปรียบจริงบนแนวหน้าของงานอัตโนมัติระยะยาวอย่างงานชีววิทยา แต่พ้นจากส่วนนั้น การจ่ายแพงกว่าสองเท่าสำหรับ Fable 5 คือการจ่ายเพิ่มเพื่อได้คะแนนต่ำลงเล็กน้อยบนผลทดสอบที่สำคัญต่อการเขียนโค้ดและการวิเคราะห์

สิ่งที่น่าสนใจคือการเปรียบเทียบนี้กลับด้านตรรกะการจัดระดับโมเดลตามปกติ โดยทั่วไป รุ่นใหม่ที่ถูกกว่าจะแลกความสามารถบางส่วนกับการเข้าถึงที่ง่ายขึ้น แต่คราวนี้ Anthropic ปล่อยรุ่นที่ถูกกว่าแต่เป็นตัวเลือกที่ทรงพลังกว่าสำหรับแทบทุกงานกระแสหลัก ซึ่งชี้ว่าราคาของ Fable 5 ซื้อท่าทีด้านการป้องกันและสายเลือด Mythos มากกว่าประสิทธิภาพดิบ

FAQs

Claude Opus 5 ดีกว่า Claude Fable 5 ไหม?

สำหรับงานส่วนใหญ่ ใช่ Opus 5 เทียบเท่าหรือชนะ Fable 5 ในงานโค้ด (96.0% เทียบกับ 95.0% บน SWE-bench Verified, 43.3% เทียบกับ 33.7% บน Frontier-Bench v0.1) นำบนเกณฑ์งานความรู้ GDPval-AA v2 (1,861 เทียบกับ 1,747 Elo) และทำทั้งหมดนี้ที่ครึ่งราคา Fable 5 คงความได้เปรียบไว้เฉพาะบนงานแนวหน้าแคบ ๆ อย่างวิจัยชีววิทยาอัตโนมัติระยะยาว

ทำไม Claude Fable 5 ถึงแพงกว่า Claude Opus 5?

Fable 5 มีราคา $10/$50 ต่อหนึ่งล้านโทเคนอินพุต/เอาต์พุต เทียบกับ Opus 5 ที่ $5/$25 แต่ส่วนต่างนี้ส่วนใหญ่ซื้อท่าทีด้านการป้องกันและตำแหน่งบนแนวหน้ามากกว่าประสิทธิภาพประจำวัน บนผลทดสอบงานโค้ดและงานความรู้กระแสหลัก Opus 5 ทำคะแนนเท่ากันหรือสูงกว่า ดังนั้นสำหรับเวิร์กโหลดเหล่านั้น คุณกำลังจ่ายเพิ่มสองเท่าเพื่อผลลัพธ์ที่แย่ลงเล็กน้อย

ควรเลือก Fable 5 แทน Opus 5 เมื่อใด?

เลือก Fable 5 หากงานคือวิจัยชีววิทยาอัตโนมัติระยะยาว ซึ่ง Anthropic ระบุว่าความสามารถยังนำอยู่ หรือหากจำเป็นต้องใช้ความครอบคลุมของคลาสซิไฟเออร์ที่กว้างขึ้นในด้านไซเบอร์ ชีววิทยา และดิสทิลเลชัน สำหรับงานโค้ดทั่วไป สายงานเอเจนต์ การวิเคราะห์ และเวิร์กโหลดโปรดักชันปริมาณสูง Opus 5 เหมาะกว่า

จะสลับระหว่าง Opus 5 และ Fable 5 ใน API ได้อย่างไร?

ทั้งสองใช้ SDK เดียวกัน การสลับจึงเป็นการเปลี่ยนสตริงโมเดลเพียงบรรทัดเดียว (claude-opus-5 หรือ claude-fable-5) ข้อควรระวัง: Opus 5 คืนบล็อกการคิดโดยค่าเริ่มต้น ดังนั้นการอ่าน response.content[0].text โดยตรงอาจเกิด AttributeError เมื่อบล็อกแรกเป็นบล็อกการคิดไม่ใช่ข้อความ

Opus 5 มีต้นทุนจริงเท่าครึ่งของ Fable 5 หรือไม่?

ต่อโทเคน ใช่ Opus 5 ถูกกว่า Fable 5 ครึ่งหนึ่งทั้งอินพุตและเอาต์พุต ในทางปฏิบัติ บิลขึ้นกับปริมาณโทเคน และ Opus 5 ปล่อยโทเคนคิดวิเคราะห์มากกว่าค่าเริ่มต้นของ Opus 4.8 ดังนั้นให้มองตัวเลข 50% เป็นการเทียบอัตรามากกว่าการรับประกันยอดรวม ถึงอย่างนั้น Opus 5 ก็ยังถูกกว่าอย่างมีนัยสำคัญในหลายสถานการณ์

หัวข้อ

เรียนรู้ AI กับ DataCamp!

Tracks

พื้นฐานของ AI Agent

6 ชม.
ค้นพบว่า AI agents สามารถเปลี่ยนวิธีการทำงานของคุณและสร้างคุณค่าให้กับองค์กรของคุณได้อย่างไร!
ดูรายละเอียดRight Arrow
เริ่มหลักสูตร
ดูเพิ่มเติมRight Arrow