Courses
เวิร์กโฟลว์เชิงตัวแทน (agentic) กลายเป็นตัวกำหนดทิศทางครึ่งแรกของปี 2026 โดยเฉพาะในงานโค้ดดิ้ง: โมเดลที่รับพรอมป์ตครั้งเดียวแล้วทำงานจนเสร็จ การแข่งขันตอนนี้เดินพร้อมกันสามแกน: ความสามารถ ความเร็ว และราคา ซึ่ง Anthropic และ Google เลือกกลยุทธ์ที่ต่างกันอย่างเห็นได้ชัด
บทความนี้เปรียบเทียบสองรุ่นที่ออกล่าสุด: Gemini 3.5 Flash ของ Google ที่ประกาศในงาน Google I/O และ Claude Opus 4.8 ของ Anthropic ที่เปิดตัวเมื่อ 28 พฤษภาคม ทั้งสองไม่ได้อยู่คลาสเดียวกัน ตัวหนึ่งคือม้าทำงานที่เร็วและราคาถูก อีกตัวคือเรือธงพรีเมียม ช่องว่างนี้เองที่ทำให้การดวลน่าสนใจ เพราะบังคับให้ถามว่าเมื่อไรความสามารถดิบ ๆ จึงคุ้มค่าที่จะจ่ายเพิ่ม
ในบทความนี้จะเปรียบเทียบทั้งสองบนเกณฑ์มาตรฐาน ราคา และความเร็ว จากนั้นสรุปว่าโมเดลไหนเหมาะกับงานแบบใด สามารถดูบทวิเคราะห์เชิงลึกได้ที่ภาพรวม Gemini 3.5 Flash และบทความ Claude Opus 4.8
สรุปสั้น ๆ
- Opus 4.8 เป็นโมเดลที่มีความสามารถโดยรวมสูงกว่า นำหน้า Artificial Analysis Intelligence Index (61.4), GDPval-AA (1,890 Elo) และ Humanity's Last Exam
- Gemini 3.5 Flash ถูกและเร็วกว่าอย่างมาก: $1.50/$9 ต่อหนึ่งล้านโทเค็น เทียบกับ $5/$25 ของ Opus 4.8 และความเร็วเอาต์พุต 192.2 โทเค็นต่อวินาที เทียบกับ 66.8
- Gemini 3.5 Flash รองรับอินพุตแบบมัลติโหมด (วิดีโอ เสียง PDF) ขณะที่ Opus 4.8 รองรับเฉพาะข้อความและรูปภาพ
- เลือก Opus 4.8 เมื่อต้องการคุณภาพงานสูงและต้องลดความเสี่ยงเรื่องหลอนข้อมูล เลือก Gemini 3.5 Flash สำหรับไปป์ไลน์ปริมาณมาก แบบมัลติโหมด และอ่อนไหวต่อค่าใช้จ่าย
Claude Opus 4.8 คืออะไร?
Claude Opus 4.8 เป็นโมเดลเรือธงของ Anthropic ผู้สืบทอดจาก Opus 4.7 ที่สร้างมาเพื่อการให้เหตุผลเชิงซับซ้อนและโค้ดดิ้งแบบตัวแทนในระยะยาว ปัจจุบันอยู่จ่าฝูง Artificial Analysis Intelligence Index ที่ 61.4 คะแนน
มันยังนำตารางจัดอันดับ GDPval-AA ซึ่งให้คะแนนโมเดลบนงานจริงครอบคลุมหลายอาชีพ และเกณฑ์มาตรฐาน ITBench-AA รุ่นใหม่ที่ทดสอบความสามารถของเอเจนต์ในการวินิจฉัยสาเหตุรากของเหตุขัดข้อง Kubernetes จากสแน็ปช็อตเหตุการณ์ที่บันทึกไว้
คุณสมบัติและความสามารถเด่น
สเปกสำคัญ:
- หน้าต่างบริบท 1 ล้านโทเค็น พร้อมเอาต์พุตได้สูงสุด 128K โทเค็น
- โหมดคิดแบบ adaptive เป็นโหมดคิดเดียวที่รองรับ
- พารามิเตอร์ effort ที่ค่าเริ่มต้นเป็นสูงทุกที่ รวมถึง Claude Code
Opus 4.8 ยังเพิ่มโหมดเร็ว ซึ่งตอนนี้เป็นงานวิจัยพรีวิว ให้เอาต์พุตต่อวินาทีสูงขึ้นถึง 2.5 เท่า ที่ราคา $10/$50 ต่อหนึ่งล้านโทเค็นอินพุต/เอาต์พุต ซึ่งแพงเป็นสองเท่าของราคา Opus 4.8 มาตรฐาน แต่ถูกกว่าประมาณหนึ่งในสามเมื่อเทียบกับโหมดเร็วของ Opus 4.7
Messages API ตอนนี้รับ system entries ภายในอาร์เรย์ข้อความได้แล้ว ทำให้ปรับคำสั่งของ Claude ระหว่างงานได้โดยไม่ต้องเริ่มบทสนทนาใหม่ สามารถพุชการอนุญาต งบโทเค็น หรือคอนเท็กซ์ของสภาพแวดล้อมได้โดยไม่ทำให้แคชของพรอมป์ตเสีย
ความยาวพรอมป์ตขั้นต่ำที่แคชได้ลดลงเหลือ 1,024 โทเค็น จาก 4,096 ใน Opus 4.7 ทำให้พรอมป์ตที่สั้นกว่าสามารถแคชได้
เมื่อเทียบกับ Opus 4.7 พบว่ามีการพัฒนาในหลายเกณฑ์ ตามข้อมูลของ Artificial Analysis:
- Terminal-Bench Hard: +6.6 คะแนน
- τ²-Bench Telecom ซึ่งจำลองสถานการณ์ซัพพอร์ตด้านเทคนิค: +5.8 คะแนน
- IFBench ซึ่งวัดความแม่นยำในการทำตามคำสั่ง: +3.6 คะแนน
ยังครองอันดับหนึ่งบน Humanity's Last Exam ทำได้ 49.8% โดยไม่ใช้เครื่องมือ และ 57.9% เมื่อใช้เครื่องมือ
ข้อดีและข้อจำกัด
สำหรับงานเชิงตัวแทน Opus 4.8 คือทางเลือกที่แข็งแกร่งที่สุดในการเปรียบเทียบนี้ ได้อันดับหนึ่งบน Artificial Analysis Agentic Index ซึ่งครอบคลุมงานอย่างการเขียนโปรแกรม
จุดที่ต้องแลกคือค่าใช้จ่าย ราคาเท่าเดิมจาก Opus 4.7 ที่ $5/$25 ต่อหนึ่งล้านโทเค็นอินพุต/เอาต์พุต ซึ่งสูงสำหรับงานปริมาณมาก ตัวเลือกควบคุมการสุ่มตัวอย่างก็ยังไม่เปิดให้ใช้: การตั้งค่า temperature, top_p และ top_k จะทำให้เกิดข้อผิดพลาดหากกำหนดค่า
Gemini 3.5 Flash คืออะไร?
Gemini 3.5 Flash เป็นโมเดลล่าสุดของ Google ที่สร้างมาเพื่อความเร็วควบคู่คุณภาพใกล้ระดับแนวหน้า ตามที่เราอธิบายไว้ในภาพรวม Gemini 3.5 Flash ทำคะแนนได้ 76.2% บน Terminal-Bench 2.1 และทำ Elo 1,656 บน GDPval-AA
คุณสมบัติและความสามารถเด่น
Flash รับอินพุตเป็นข้อความ รูปภาพ วิดีโอ เสียง และ PDF โดยรองรับการตั้งค่าระดับการคิดอย่างครบถ้วน ชุดฟีเจอร์หลัก:
- บริบทอินพุตราว 1 ล้านโทเค็น (1,048,576 โทเค็น) พร้อมขีดจำกัดเอาต์พุต 65,536 โทเค็น
- Batch API และการแคชพรอมป์ต
- การรันโค้ดและเรียกใช้ฟังก์ชัน
- การยึดโยงกับการค้นหาและเอาต์พุตแบบมีโครงสร้าง
บนเกณฑ์มาตรฐาน ทำได้ 83.6% บน MCP Atlas สำหรับการประสานงานเอเจนต์หลายเครื่องมือ และ 84.2% บน CharXiv Reasoning สำหรับความเข้าใจแบบมัลติโหมด อยู่ที่อันดับ 7 บน Artificial Analysis Intelligence Index ซึ่งถือว่าแข็งแกร่งสำหรับโมเดลระดับ Flash และอันดับ 6 บน Agentic Index ใกล้เคียง Opus 4.7
Gemini 3.5 Flash ยังรองรับกรอบทำงานหลายเอเจนต์ Antigravity โดยตรง อินเทอร์เฟซของ Antigravity ถูกปรับใหม่ในรุ่นนี้ให้คล้ายกับแอป OpenAI Codex และ Cursor
ข้อดีและข้อจำกัด
ข้อเสนอของ Flash คือความฉลาดต่อหนึ่งดอลลาร์: คะแนน 55 บน Artificial Analysis Intelligence Index ที่ราคา $1.50 ต่อหนึ่งล้านโทเค็นอินพุต และ $9 ต่อหนึ่งล้านโทเค็นเอาต์พุต ซึ่งถือว่าความสามารถสูงเมื่อเทียบกับราคา
จุดขายอีกข้อคืออินพุตมัลติโหมดแบบเนทีฟ รวมถึงวิดีโอและเสียง ระบบระดับการคิดสี่ระดับ (น้อยที่สุด ต่ำ กลาง สูง) ยังช่วยให้ควบคุมต้นทุนและประสิทธิภาพได้ละเอียดกว่าการตั้งค่า effort เดียวของ Opus 4.8
แต่สิ่งที่โดดเด่นคือการใช้เครื่องมือเชิงตัวแทน Flash ทำคะแนน 83.6% บน MCP Atlas ซึ่งเป็นผลการประสานงานหลายเครื่องมือที่ดีที่สุดในการเปรียบเทียบนี้ และยังแซงหน้า Opus 4.8 ที่ 82.2% ด้วย โมเดลระดับ Flash ขึ้นนำเรือธงรุ่นใหม่ของ Anthropic บนเกณฑ์นี้ถือเป็นผลลัพธ์ที่ปกติแล้วไม่ค่อยเกิดข้ามระดับชั้น
มีข้อควรระวังสองข้อ ในการรันบน Intelligence Index นั้น Flash สร้างเอาต์พุต 73 ล้านโทเค็น เทียบกับค่าเฉลี่ย 35 ล้าน แปลว่าพูดเยอะกว่า และความเยอะนั้นส่งผลต่อต้นทุนเอาต์พุต เวลาถึงโทเค็นแรกอยู่ที่ 18.88 วินาที สูงสำหรับระดับชั้นนี้ ขณะที่โมเดลใกล้เคียงอยู่ราวสองวินาที
เพื่อดูว่า Flash เทียบกับเรือธงของ OpenAI อย่างไร เราเปรียบเทียบไว้ในบทความ Gemini 3.5 Flash vs. GPT-5.5
Claude Opus 4.8 vs Gemini 3.5 Flash: เปรียบเทียบแบบตัวต่อตัว
นี่คือภาพรวมอย่างรวดเร็วก่อนลงรายละเอียดตามหมวดหมู่
| คุณสมบัติ | Claude Opus 4.8 | Gemini 3.5 Flash |
|---|---|---|
| วันเปิดตัว | 28 พฤษภาคม 2026 | 19 พฤษภาคม 2026 |
| หน้าต่างบริบท | 1M โทเค็น | 1M โทเค็น |
| เอาต์พุตสูงสุด | 128K | 65,536 |
| Intelligence Index (AA) | 61.4 | 55 |
| GDPval-AA Elo | 1,890 | 1,656 |
| ความเร็วเอาต์พุต | 66.8 โทเค็น/วินาที | 192.2 โทเค็น/วินาที |
| รูปแบบอินพุต | ข้อความ รูปภาพ | ข้อความ รูปภาพ วิดีโอ เสียง PDF |
| ราคาอินพุต | $5 / 1M โทเค็น | $1.50 / 1M โทเค็น |
| ราคาเอาต์พุต | $25 / 1M โทเค็น | $9 / 1M โทเค็น |
| โหมดการคิด | Adaptive เท่านั้น | Minimal / low / medium / high |
ประสิทธิภาพเชิงตัวแทนและการเขียนโค้ด
Opus 4.8 เป็นเอเจนต์ที่แข็งแรงกว่า แต่ Flash ก็ใกล้เคียงกว่าที่ระดับชั้นของมันบอกไว้ Opus 4.8 นำหน้า GDPval-AA ที่ 1,890 Elo เทียบกับ 1,656 ของ Flash จึงดีกว่างานความรู้
MCP Atlas คือเซอร์ไพรส์ Flash ทำได้ 83.6% บนเกณฑ์การประสานหลายเครื่องมือนี้ เฉือน Opus 4.8 ที่ 82.2% โมเดล Flash แซงเรือธงตัวใหม่ของ Anthropic ด้านการใช้เครื่องมือเชิงตัวแทนถือว่าไม่คาดคิด และเป็นข้อโต้แย้งที่ชัดเจนที่สุดสำหรับ Flash ในการเปรียบเทียบนี้
SWE-bench Pro ไปอีกทาง เกณฑ์นี้ทดสอบการแก้ทิกเก็ตวิศวกรรมซอฟต์แวร์จริง Opus 4.8 ทำได้ 69.2% รองจาก Mythos Preview ภายในของ Anthropic เท่านั้น Flash ทำได้ 55.0% ตามหลัง Opus ในระดับที่คาดหมายข้ามชั้น แต่ก็น่าสนใจในตัวเอง: แซง Gemini 3.1 Pro ที่ 54.2% แปลว่า Flash รุ่นนี้ไล่ทันระดับ Pro ของรุ่นก่อนแล้ว
บน Terminal-Bench Hard Opus 4.8 ทำได้ 58.3% เทียบกับ 40.9% ของ Flash จึงเหมาะกว่าสำหรับงานวิศวกรรมซอฟต์แวร์ผ่านเทอร์มินัล งานดูแลระบบ และการประมวลผลข้อมูล Flash มีที่ทางของมันเมื่อรันลูปโค้ดขนานหลายงาน และความเร็วกับต้นทุนสำคัญกว่าความแม่นยำปลายยอด
การให้เหตุผลและงานเชิงวิทยาศาสตร์
Opus 4.8 เหนือกว่าอย่างชัดเจนในด้านเหตุผลเชิงวิชาการ ทำได้ 57.9% บน Humanity's Last Exam เทียบกับ 40.25% ของ Flash จึงได้เปรียบในงานคณิตศาสตร์ วิทยาศาสตร์ และมนุษยศาสตร์
การรองรับอินพุตมัลติโหมด
ข้อนี้ Flash ชนะขาด Opus 4.8 อ่านได้แค่ข้อความและรูปภาพ ส่วน Flash อ่านได้รวมถึงวิดีโอ เสียง และ PDF หากไปป์ไลน์ของคุณแตะไฟล์เหล่านี้ Flash คือทางเลือกเดียวในสองตัวนี้ที่รองรับ
ความเร็วและความหน่วง
Flash เร็วกว่าในเอาต์พุตราวสามเท่า ตามการวัดของ Artificial Analysis อยู่ที่ 192.2 โทเค็นต่อวินาที เทียบกับ 66.8 ของ Opus 4.8
ต้นทุนและประสิทธิภาพการใช้โทเค็น
เอาต์พุตคือจุดที่ช่องว่างชัด: $25 ต่อหนึ่งล้านบน Opus 4.8 เทียบกับ $9 บน Flash ดังนั้น Opus แพงกว่าราว 2.8 เท่า ในไปป์ไลน์ปริมาณมาก ความต่างนี้ทบต้นอย่างรวดเร็ว
หน้าต่างบริบทและความจุเอาต์พุต
ทั้งสองรับอินพุตได้ 1 ล้านโทเค็น ความต่างจึงอยู่ที่เอาต์พุต Opus 4.8 เขียนได้สูงสุด 128K โทเค็นต่อหนึ่งพาส เทียบกับ 65,536 ของ Flash เกือบสองเท่า สำหรับการสังเคราะห์โค้ดระยะยาว การสร้างเอกสาร หรือเอเจนต์ลูปที่ปล่อยเอาต์พุตจำนวนมากในพาสเดียว พื้นที่เฮดรูมนี้สำคัญ
ควรเลือกโมเดลไหน?
ขึ้นอยู่กับว่าคุณจ่ายเพื่อความสามารถหรือเพื่อปริมาณงาน นี่คือวิธีแบ่ง
เลือก Claude Opus 4.8 ถ้า…
- คุณภาพการปิดงานมีผลโดยตรง คะแนน 1,890 Elo บน GDPval-AA และอัตราหลอนข้อมูลที่ต่ำกว่าโมเดลของ Google และ OpenAI บน AA-Omniscience ทำให้เป็นทางเลือกที่ปลอดภัยกว่าสำหรับงานความรู้ที่ต้องการความแม่นยำสูง
- ต้องการเอาต์พุต 128K โทเค็นสำหรับการสร้างครั้งเดียวขนาดใหญ่ เกือบสองเท่าของ 65,536 บน Flash
- คุณพัฒนาอยู่ในระบบนิเวศ Anthropic ผ่าน Claude Code หรือ API อยู่แล้ว และการสลับแพลตฟอร์มมีต้นทุน
- ลูปเชิงตัวแทนของคุณรันยาวพอที่ข้อความ system ระหว่างบทสนทนาจะมีผล เพราะ Messages API ตอนนี้อัปเดตการอนุญาต งบโทเค็น หรือคอนเท็กซ์ระหว่างงานได้โดยไม่ทำให้แคชพรอมป์ตเสีย
เลือก Gemini 3.5 Flash ถ้า…
- ไปป์ไลน์ของคุณรับวิดีโอ เสียง หรือ PDF
- ต้องการปริมาณเอาต์พุต ที่ซึ่ง $9 เทียบกับ $25 ต่อหนึ่งล้านโทเค็นทำให้สมการเปลี่ยน
- อยากได้คะแนนประสานหลายเครื่องมือที่แข็งแกร่งที่สุด เพราะ Flash นำ MCP Atlas ที่ 83.6% เหนือแม้แต่ Opus 4.8 ที่ 82.2%
- คุณสร้างบนโครงสร้างพื้นฐานของ Google ผ่าน Antigravity หรือ Vertex AI และอยากใช้ผู้ให้บริการรายเดียว
- การควบคุมต้นทุนแบบละเอียดสำคัญ ซึ่งระดับการคิดสี่ระดับของ Flash เหนือกว่าการตั้งค่า effort เดียวของ Opus 4.8
ทิศทางต่อไปของ Flash และโมเดลเรือธง
Flash รุ่นนี้แพงกว่ารุ่น Flash ก่อน ๆ มาก และ Google ก็ถูกวิจารณ์ ช่องว่างด้านความฉลาดระหว่างระดับ Flash และ Opus ยังมีนัยสำคัญ ซึ่งบั่นทอนเหตุผลในการจ่ายราคาที่ใกล้เคียงเรือธงให้กับโมเดล Flash การแข่งขันที่น่าจับตากว่าคือโมเดลขนาดเล็กที่โค้ดดิ้งและงานเชิงตัวแทนได้ดีจริง พร้อมรักษาราคาให้ถูกระดับเดียวกับ Composer 2.5 ของ Cursor Composer 2.5
โหมดเร็วของ Anthropic คือสิ่งที่ควรจับตาสำหรับโค้ดดิ้งเชิงตัวแทน แต่ราคาจะฉุดรั้งไว้ ที่ $10/$50 เป็นเรื่องยากจะโน้มน้าวนักพัฒนาที่รันลูปยาว ๆ และการยอมรับขึ้นกับว่า Anthropic จะทบทวนตัวเลขนี้หรือไม่
Anthropic ยังโฟกัสที่งานโค้ดดิ้ง จึงไม่น่าจะตาม Google ไปด้านอินพุตวิดีโอและเสียงในเร็ววัน นั่นเปิดโอกาสให้ Google แต่มีเงื่อนไขว่าจะต้องปล่อยโมเดล Flash หรือเรือธงที่ชนะ Opus บนงานเชิงตัวแทน ซึ่งจนถึงตอนนี้ยังทำไม่ได้
ข้อคิดส่งท้าย
ถ้าคุณภาพงานและความเสี่ยงเรื่องหลอนข้อมูลมีต้นทุนจริง เช่น ในการเงินหรือการแพทย์ ควรเลือก Opus 4.8 หากต้องการเพิ่มปริมาณงาน ลดต้นทุน หรือใช้อินพุตแบบมัลติโหมด Gemini 3.5 Flash เหมาะกว่า
ความเห็นส่วนตัว: ทั้งสองจริง ๆ แล้วไม่ได้แย่งงานเดียวกัน และส่วนใหญ่ทีมจะรู้ว่าตัวเองอยู่ฝั่งไหนตั้งแต่ประโยคแรกที่อธิบายเวิร์กโหลด คำถามที่ยากกว่าคือ Google จะปิดช่องว่างด้านความสามารถได้โดยไม่เสียข้อได้เปรียบด้านราคาที่ทำให้ Flash คุ้มใช้อย่างไร ขณะนี้ Google ใช้ Gemini 3.5 Pro ภายในแล้ว และรุ่นนั้นมากกว่า Flash ที่มีแนวโน้มจะกดดัน Opus 4.8 ได้จริง
หากต้องการฝึกทักษะที่ทำให้ผู้ช่วย AI ไว้ใจได้มากขึ้นในเวิร์กโฟลว์ของคุณ แนะนำเริ่มจากคอร์ส AI-Assisted Coding for Developers และถ้าต้องการสร้างแอป LLM ด้วยพรอมป์ต เชน และเอเจนต์ คอร์ส Developing LLM Applications with LangChain คือก้าวต่อไปที่แข็งแรง
คำถามที่พบบ่อยเกี่ยวกับ Claude Opus 4.8 vs Gemini 3.5 Flash
โดยรวมแล้ว Claude Opus 4.8 ดีกว่า Gemini 3.5 Flash หรือไม่?
บนเกณฑ์ทดสอบความฉลาดโดยรวม ใช่ Opus 4.8 ทำได้ 61.4 บน Artificial Analysis Intelligence Index เทียบกับ 55 ของ Flash แต่คำว่า “ดีกว่า” ขึ้นกับกรณีใช้งาน Flash เร็วกว่า ถูกกว่า และรองรับอินพุตวิดีโอ เสียง และ PDF ที่ Opus 4.8 ไม่รองรับ
Gemini 3.5 Flash รองรับฟอร์แมตอินพุตอะไรบ้าง?
Gemini 3.5 Flash รองรับอินพุตเป็นข้อความ รูปภาพ วิดีโอ เสียง และ PDF ส่วน Claude Opus 4.8 รองรับเฉพาะข้อความและรูปภาพ
ราคาเปรียบเทียบกันอย่างไรระหว่างสองโมเดลนี้?
Claude Opus 4.8 มีราคา $5 ต่อหนึ่งล้านโทเค็นอินพุต และ $25 ต่อหนึ่งล้านโทเค็นเอาต์พุต ส่วน Gemini 3.5 Flash อยู่ที่ $1.50 ต่อหนึ่งล้านโทเค็นอินพุต และ $9 ต่อหนึ่งล้านโทเค็นเอาต์พุต ราคาสำหรับ cache hit อยู่ที่ $0.50 ต่อหนึ่งล้านบน Opus 4.8 และ $0.15 ต่อหนึ่งล้านบน Flash
GDPval-AA คืออะไร และสำคัญอย่างไรต่อ Opus 4.8 และ Gemini 3.5 Flash?
GDPval-AA คือเกณฑ์หลักของ Artificial Analysis สำหรับประเมินประสิทธิภาพเชิงตัวแทนบนงานความรู้ในโลกจริง ให้คะแนนเป็น Elo Opus 4.8 นำที่ 1,890 Elo เทียบกับ 1,656 ของ Flash จึงมีประโยชน์กว่ามาตรฐานดั้งเดิมในการประเมินโมเดลในบริบทการใช้งานเชิงตัวแทนจริง
โมเดลไหนมีหน้าต่างเอาต์พุตใหญ่กว่า?
Claude Opus 4.8 รองรับเอาต์พุตสูงสุด 128K โทเค็น ซึ่งเป็นสองเท่าของหน้าต่างเอาต์พุต 65,536 โทเค็นของ Gemini 3.5 Flash สำหรับเวิร์กโฟลว์ที่สร้างเอกสารยาว ไฟล์โค้ดขนาดใหญ่ หรือจำเป็นต้องได้เอาต์พุตครั้งเดียวจำนวนมาก Opus 4.8 เป็นตัวเลือกที่ดีกว่า
Gemini 3.5 Flash รองรับการตั้งค่าการคิดหรือไม่?
มี Flash มีระดับการคิดสี่ระดับ: minimal, low, medium และ high โดยค่าเริ่มต้นคือ medium ส่วน Claude Opus 4.8 ใช้การคิดแบบ adaptive เท่านั้น โดยไม่รองรับงบประมาณการคิดแบบขยาย