Anthropic ยังไม่ได้เผยเกณฑ์เปรียบเทียบโดยตรงระหว่าง Opus 5 กับ Sonnet 5 โพสต์เปิดตัวแต่ละรุ่นจะเทียบกับรุ่นก่อนหน้าของตนเองและกับ Opus 4.8 ดังนั้นตัวเลขด้านล่างจึงเป็นเพียงส่วนหนึ่งของภาพรวม ที่เหลือคือการตัดสินใจแบบเดียวกับทุกครั้งที่ต้องเลือกคู่ Opus กับ Sonnet: เพดานความสามารถที่ต้องการจริง ๆ อยู่แค่ไหน และยอมจ่ายได้เท่าไร
Claude Opus 5 คืออะไร?
Opus 5 คือโมเดลระดับท็อปของ Anthropic เปิดตัวเมื่อ 24 กรกฎาคม 2026 คิดราคา $5 ต่อหนึ่งล้านโทเค็นขาเข้า และ $25 ต่อหนึ่งล้านโทเค็นขาออก Anthropic ระบุว่าเป็นระดับแนวหน้าบน Frontier-Bench และ GDPval-AA และเข้าใกล้โมเดล Fable 5 ที่ใหญ่กว่าด้วยราคาครึ่งหนึ่ง เป็นโมเดลเริ่มต้นบน Claude Max และเป็นโมเดลที่แข็งแกร่งที่สุดบน Claude Pro
จุดเด่นคือการตรวจสอบตัวเอง: ตรวจเช็คงานของตน สร้าง test harness เมื่อไม่มี data feed และโต้แย้งคำสั่งที่ไม่ดีแทนที่จะทำตาม
Claude Sonnet 5 คืออะไร?
Sonnet 5 คือโมเดลระดับกลางของ Anthropic เปิดตัวเมื่อ 30 มิถุนายน 2026 Anthropic บรรยายว่าเป็น Sonnet ที่มีความเป็นเอเจนต์สูงที่สุดของตน ด้วยประสิทธิภาพที่เข้าใกล้ Opus 4.8 ในราคาที่ต่ำกว่า เป็นโมเดลเริ่มต้นบนแผน Free และ Pro และมีให้ใช้บน Max, Team, Enterprise และ API
ราคา: $2 ต่อหนึ่งล้านโทเค็นขาเข้า และ $10 ต่อหนึ่งล้านโทเค็นขาออก จนถึง 31 สิงหาคม 2026 หลังจากนั้นเป็นมาตรฐาน $3/$15
ความต่างของระดับ ในเชิงปฏิบัติ
ส่วนนี้โพสต์เปิดตัวไม่ได้บอกตรง ๆ เพราะเป็นหลักการรวม ๆ ของไลน์อัปโมเดลของ Anthropic ไม่ได้เฉพาะคู่นี้
Opus คือโมเดลเพดานบน
เลือกใช้เมื่อความผิดพลาดมีราคาแพง งานยาวและทำงานกึ่งอัตโนมัติโดยไม่มีคนเข้ามาตรวจระหว่างทาง หรือเมื่อปัญหาใหม่จริง ๆ ไม่ใช่เพียงรูปแบบแปรของสิ่งที่โมเดลเคยเห็น รีแฟกเตอร์หลายไฟล์เชิงลึก คำถามวิจัยที่คลุมเครือ รันงานเอเจนต์ยาว ๆ ที่ความผิดพลาดทบไปเรื่อย ๆ — นี่คือพื้นที่ของ Opus ที่จ่ายคือให้โมเดลจับผิดพลาดของตัวเองก่อนจะกลายเป็นปัญหาของคุณ
Sonnet คือม้าทำงาน
ออกแบบมาให้เร็วและถูกพอสำหรับการรันต่อเนื่อง: แชตผู้ช่วย จัดหมวดหมู่ปริมาณมาก การโค้ดแบบวนรอบที่คุณรีวิวทุกไม่กี่สเต็ปอยู่แล้ว แอปที่ไวต่อ latency เพดานการตัดสินใจต่ำกว่า แต่สำหรับงานจริงส่วนใหญ่ก็ไม่ชนเพดาน ทีมนส่วนใหญ่ควรใช้ Sonnet เป็นหลัก แล้วเรียก Opus เฉพาะงานที่จำเป็นจริง ๆ
โดยเฉพาะ Sonnet 5 คือความพยายามของ Anthropic ที่จะดันเพดานนั้นให้สูงกว่าปกติสำหรับโมเดลระดับกลาง — จึงมีคำว่า "Sonnet ที่มีความเป็นเอเจนต์มากที่สุด" และการอ้างว่าเข้าใกล้ Opus 4.8 ในบางงาน นี่คือบริบทสำหรับอ่านตัวเลขด้านล่าง: Sonnet 5 ไม่ได้แค่ถูก แต่ถูกและเข้าใกล้ระดับ Opus กว่า Sonnet รุ่นก่อน ๆ
ตัวเลขจากประกาศบอกอะไรจริง ๆ
ราคา
ความต่างที่ชัดและไม่คลุมเครือที่สุด Sonnet 5 อยู่ที่ $2/$10 (ถึง 31 ส.ค.) หรือ $3/$15 (มาตรฐาน) เทียบกับ Opus 5 ที่ $5/$25 คงที่ — Sonnet 5 มีค่าใช้จ่าย 40–60% ของ Opus 5 ตามช่วงราคา
ความสอดคล้อง (Alignment)
ส่วนเดียวที่โพสต์เปิดตัวทั้งสองเอ่ยถึงกันโดยตรง การตรวจสอบอัตโนมัติของ Anthropic พบว่า Opus 5 "ยึดตามรัฐธรรมนูญของ Claude ได้ดีกว่า Opus 4.8, Sonnet 5 หรือ Fable 5" — เป็นผลลัพธ์ที่ระบุชัด ไม่ใช่การอนุมาน Opus 5 ได้คะแนน 2.3 ในการตรวจนั้น ซึ่งปลอดภัยที่สุดของตนแล้ว Sonnet 5 ดีขึ้นจากรุ่นก่อน (เพ้อเจ้อน้อยลง ประจบสอพลอน้อยลง ต้านทาน prompt-injection ได้ดีขึ้น) แต่ Anthropic ระบุว่ายังมีอัตราพฤติกรรมไม่สอดคล้องสูงกว่า Opus 4.8
ความปลอดภัยไซเบอร์
ทั้งสองโมเดลไม่ได้รับการเทรนไซเบอร์โดยเจตนา แต่ผลลัพธ์ไปคนละตำแหน่ง
Opus 5 เข้าใกล้ Mythos 5 ในการค้นหาช่องโหว่ แม้จะด้อยกว่าในการเปลี่ยนเป็นเอ็กซ์พลอยต์ ส่วน Sonnet 5 อยู่ไกลกว่า: Anthropic ระบุชัดว่า Sonnet 5 มีความสามารถไซเบอร์ "แย่กว่ามากเมื่อเทียบกับ Opus 4.8 และ Mythos 5" และในการประเมินพัฒนาเอ็กซ์พลอยต์ของ Firefox มันไม่เคยผลิตเอ็กซ์พลอยต์ที่ทำงานได้ครบถ้วน (สำเร็จ 0.0% มีแต้มเหนือ Sonnet 4.6 เพียงเล็กน้อยในความพยายามแบบบางส่วน)
หากเคสการใช้งานแตะเรื่องไซเบอร์ไม่ทางตรงก็ทางอ้อม ช่องว่างนี้มีจริง และชี้ไปทาง Opus 5 อย่างชัดเจน
การโค้ดและงานความรู้
สองโพสต์ใช้ชุดเกณฑ์ต่างกัน จึงไม่มีสกอร์ไลน์เทียบตรง ๆ
Opus 5 ทำคะแนนมากกว่าเท่าตัวของ Opus 4.8 บน Frontier-Bench v0.1 และอยู่ห่าง Fable 5 เพียง 0.5% บน CursorBench 3.2 ที่ต้นทุนครึ่งเดียว ส่วน Sonnet 5 ถูกอธิบายว่าเข้าใกล้ Opus 4.8 บน BrowseComp และ OSWorld-Verified ที่ระดับความพยายามสูง
เมื่ออ่านร่วมกับตรรกะเรื่องระดับด้านบน: Sonnet 5 เข้าใกล้ในงานเฉพาะที่ Anthropic เลือกเน้น แต่ชัยชนะของ Opus 5 ดูใหญ่และกว้างกว่า ให้มองส่วนนี้เป็นสัญญาณทิศทาง ไม่ใช่ตัวเลขตายตัว
ควรเลือกตอนไหน
เลือก Opus 5 ถ้า
งานมีความเสี่ยงสูง ใช้เวลานาน หรือใหม่จริง ๆ; ทำงานด้านวิทยาศาสตร์ชีวภาพ เคมี หรือเอเจนต์หลายขั้นที่ซับซ้อน; ต้องการโมเดลที่สอดคล้องมากที่สุด; มีงานที่เกี่ยวเนื่องกับความปลอดภัยไซเบอร์อยู่ในขอบเขต
เลือก Sonnet 5 ถ้า
รันปริมาณมาก ความหน่วงสำคัญ หรือขอบเขตงานชัดเจนพอจนไม่ต้องการเพดานการตัดสินของ Opus; อยู่บน Free หรือ Pro ที่ตั้งเป็นค่าเริ่มต้นอยู่แล้ว; ต้นทุนต่อโทเค็นเป็นข้อจำกัดหลัก
ไม่เลือกทั้งคู่ ถ้า
ต้องการงานไซเบอร์ที่ลดข้อจำกัดด้านความปลอดภัย Opus 5 จะถอยไปใช้ Opus 4.8 โดยอัตโนมัติ และ Sonnet 5 อยู่หลัง Opus 4.8 อย่างชัดเจน
ข้อคิดส่งท้าย
ปัจจัยชี้ขาดส่วนใหญ่ที่นี่ก็เหมือนทุกครั้งที่ต้องเลือกระหว่าง Opus กับ Sonnet: งานนี้ต้องการเพดานบน หรือแค่ต้องทำให้เสร็จอย่างน่าเชื่อถือในสเกล? Sonnet 5 ดันเพดานนั้นให้สูงกว่า Sonnet รุ่นก่อน ๆ ซึ่งเป็นข่าวจริงของการเปิดตัว แต่ตรงที่ Anthropic ให้ตัวเลขเปรียบเทียบกัน — การตรวจสอบความสอดคล้อง — Opus 5 ออกมานำ และเรื่องไซเบอร์ก็ชี้ไปทิศเดียวกัน ตั้งค่าเริ่มต้นเป็น Sonnet 5 สำหรับงานปริมาณมาก แล้วเอื้อมหา Opus 5 เมื่องานนั้นรับความผิดพลาดไม่ได้