Tracks
หากกำลังมองหาโมเดลระดับกลางสำหรับรันเบื้องหลังเอเจนต์ตลอดทั้งวัน ตัวเลือกที่เด่นชัดตอนนี้คือ GPT-5.6 Terra และ Claude Sonnet 5 ทั้งคู่เป็นโมเดลเริ่มต้นที่ผู้ให้บริการมอบให้ผู้ใช้ฟรี มีหน้าต่างบริบทประมาณ 1M โทเคน และมีราคาอินพุตโทเคนใกล้เคียงกันต่างกันไม่ถึงหนึ่งดอลลาร์
ในบทความนี้ จะเปรียบเทียบ GPT-5.6 Terra และ Claude Sonnet 5 ในด้านเอเจนต์สำหรับโค้ดและเทอร์มินัล งานความรู้ ท่าทีด้านความปลอดภัยไซเบอร์ พฤติกรรมบริบทยาว พื้นผิวการควบคุมผ่าน API และราคา เพื่อช่วยให้เลือกได้เหมาะกับเวิร์กโหลด สำหรับรายละเอียดเชิงลึกของแต่ละโมเดล ดูคู่มือของเราเกี่ยวกับ ตระกูล GPT-5.6 และ Claude Sonnet 5
สรุปสั้นๆ
- Terra เหมาะกว่าสำหรับเอเจนต์โค้ดดิ้งที่ขับเคลื่อนด้วยเทอร์มินัลและไปป์ไลน์ที่พึ่งพาเครื่องมือมาก ซึ่งฟีเจอร์ด้านประสิทธิภาพโทเคนช่วยได้จริง
- Sonnet 5 เหมาะกับงานบริบทยาวและงานเอกสาร เพราะอัตราคิดค่าบริการคงที่ตลอดทั้งหน้าต่างบริบท
- เลือก GPT-5.6 Terra หากเอเจนต์ทำงานในเชลล์ เรียกใช้เครื่องมือจำนวนมากต่อรอบ หรืออยากได้โทเคนเอาต์พุตที่ถูกลงหลังเดือนสิงหาคม
- เลือก Claude Sonnet 5 หากส่งพรอมป์ตขนาดใหญ่มาก ต้องการการคิดเงินต่อโทเคนที่คาดการณ์ได้ หรือจงใจใช้โมเดลที่ปฏิเสธงานด้านเอ็กซ์พลอยต์
GPT-5.6 Terra คืออะไร?
GPT-5.6 Terra เป็นระดับกลางของ ตระกูล GPT-5.6 ของ OpenAI ที่เปิดให้ใช้งานทั่วไปเมื่อ 9 กรกฎาคม 2026 พร้อมกับรุ่นเรือธง Sol และรุ่นประหยัด Luna OpenAI อธิบาย Terra ว่าเป็นตัวเลือกที่บาลานซ์สำหรับงานประจำวัน และใกล้เคียงกับระดับ mini ของตระกูล GPT-5 รุ่นก่อน มาพร้อมหน้าต่างบริบท 1,050,000 โทเคน เพดานเอาต์พุต 128,000 โทเคน และฐานความรู้สิ้นสุดวันที่ 16 กุมภาพันธ์ 2026
สองสิ่งที่ทำให้ Terra น่าสนใจเกินกว่าจะเป็นแค่ตัวเลือกถูก คือ การสืบทอด Programmatic Tool Calling จาก Responses API ให้โมเดลเขียนและรันโปรแกรมขนาดเล็กในหน่วยความจำเพื่อประสานเครื่องมือ แทนการวนส่งผลเครื่องมือทุกครั้งกลับเข้าโมเดล และเมื่อ 30 กรกฎาคม 2026 OpenAI ปรับลดราคา Terra ลง 20% จาก $2.50/$15 ตอนเปิดตัว เหลือ $2.00/$12 ต่อ 1M โทเคน
เราได้ครอบคลุมภาพรวมของตระกูลนี้ไว้ใน คู่มือ GPT-5.6 Sol, Terra และ Luna และหากอยากเห็นการใช้งานระดับเรือธง ลองอ่านบทความว่า GPT-5.6 Sol ช่วยล้มสมมติฐาน Maxwell อย่างไร รวมถึงการเปรียบเทียบระดับเรือธงใน Claude Opus 5 เทียบกับ GPT-5.6 Sol
Claude Sonnet 5 คืออะไร?
Claude Sonnet 5 เป็นโมเดลระดับกลางของ Anthropic ที่ เปิดตัวเมื่อ 30 มิถุนายน 2026 พร้อมคำโปรยว่าเป็น Sonnet ที่มีความเป็นเอเจนต์สูงที่สุดเท่าที่เคยปล่อยมา อ้างว่าวางแผน ขับเบราว์เซอร์และเทอร์มินัล และรันแบบอัตโนมัติในระดับที่ก่อนหน้านี้ต้องใช้โมเดลระดับ Opus โดยอยู่ใกล้กับ Opus 4.8 ในด้านการให้เหตุผล การใช้เครื่องมือ การเขียนโค้ด และงานความรู้ ด้วยราคาที่ต่ำกว่า
เป็นโมเดลเริ่มต้นบนแผน Free และ Pro และมาพร้อมข้อจำกัดโดยเจตนา: temperature, top_p และ top_k ถูกถอดออก การสั่งคิดแบบขยายด้วยมือจะได้ 400 error และเปิดใช้การคิดแบบปรับอัตโนมัติโดยค่าเริ่มต้น อีกทั้งใช้ตัวตัดคำใหม่ที่สร้างโทเคนมากขึ้นราว 30% สำหรับข้อความเท่าเดิมเมื่อเทียบกับ Sonnet 4.6 ซึ่ง Anthropic ชดเชยด้วยราคาเปิดตัวจนถึง 31 สิงหาคม 2026
เราได้ไล่ดูตัวเลขเปิดตัวใน คู่มือ Claude Sonnet 5 และเปรียบเทียบขึ้นไปกับเรือธงของ Anthropic ใน Claude Opus 5 เทียบกับ Claude Sonnet 5
GPT-5.6 Terra เทียบกับ Claude Sonnet 5: เปรียบเทียบแบบตัวต่อตัว
นี่คือภาพรวมของสองโมเดลแบบเคียงข้างกันก่อนลงรายละเอียดความสามารถแต่ละด้าน
| คุณลักษณะ | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|
| ผู้พัฒนาและวันเปิดตัว | OpenAI เปิดให้ใช้งานทั่วไป 9 กรกฎาคม 2026 | Anthropic, 30 มิถุนายน 2026 |
| การวางตำแหน่ง | ระดับกลาง | ระดับกลาง |
| หน้าต่างบริบท | 1,050,000 โทเคน | 1M โทเคน |
| เอาต์พุตสูงสุด | 128K โทเคน | 128K โทเคน |
| ราคา ต่อ 1M โทเคน | $2.00 อินพุต / $12.00 เอาต์พุต | $3.00 อินพุต / $15.00 เอาต์พุต ($2.00/$10.00 ถึง 31 ส.ค. 2026) |
| ค่าบริการบริบทยาว | อินพุต 2 เท่า เอาต์พุต 1.5 เท่า เมื่อเกิน 272K โทเคนอินพุต | ไม่มีที่เผยแพร่; คงที่ถึง 1M |
| จุดเด่น | Programmatic Tool Calling ใน Responses API | การคิดแบบปรับอัตโนมัติ เลือกระดับความพยายามได้ |
| ท่าทีด้านความปลอดภัยไซเบอร์ | เทรนเพื่อไซเบอร์; ความสามารถเชิงรับอยู่หลัง Trusted Access | ไม่เทรนเพื่อไซเบอร์; เปิดเซฟการ์ดโดยค่าเริ่มต้น |
| ชั้นฟรี | ค่าเริ่มต้นสำหรับผู้ใช้ Free และ Go ใน ChatGPT Work และ Codex | ค่าเริ่มต้นสำหรับแผน Free และ Pro |
| API model ID | gpt-5.6-terra |
claude-sonnet-5 |
เอเจนต์โค้ดดิ้งและเทอร์มินัล
โดยทั่วไป งานเขียนโค้ดในรีโพซิทอรีมักเทไปทาง Anthropic ส่วนงานบนเทอร์มินัลมักเทไปทาง OpenAI
ส่วนหลังยังคงเดิม: บน Terminal-Bench 2.1 Terra ทำได้ 87.4% เทียบกับ 80.4% ของ Sonnet 5 ตามเอกสารเปิดตัวของ Anthropic ช่องว่าง 7 แต้มบนเวิร์กโฟลว์บรรทัดคำสั่ง ทั้งยังน่าสังเกตว่า Terra ทำคะแนนเหนือ Claude Opus 4.8 (78.9%) และ Claude Fable 5 (83.1%) ในชุดประเมินเดียวกันของ OpenAI
แต่ปัจจุบัน โมเดลระดับกลางทั้งสองสูสีกันในการเขียนโค้ดบนรีโพฯ บน SWE-Bench Pro ซึ่งรันการแก้ไขหลายขั้นตอนกับรีโพจริง OpenAI รายงาน Terra ที่ 63.4% และ Anthropic รายงาน Sonnet 5 ที่ 63.2%
| ชุดทดสอบ | GPT-5.6 Terra | Claude Sonnet 5 | หมายเหตุ |
|---|---|---|---|
| SWE-Bench Pro | 63.4% | 63.2% | ผู้ขายรายงานบนฮาร์เนสต่างกัน; ถือว่าเสมอกัน |
| Terminal-Bench 2.1 | 87.4% | 80.4% | ผู้ขายรายงาน; ความได้เปรียบด้านโค้ดดิ้งที่ใหญ่สุดของ Terra ที่เผยแพร่ |
| Artificial Analysis Coding Agent Index v1.1 | 77.4 | ไม่เผยแพร่ | ดัชนีอิสระ; Terra อยู่เหนือ Fable 5 ที่ 77.2 |
กรอบเล่าเรื่องของ Anthropic เองก็สอดคล้องกัน เรื่องโค้ดของ Sonnet 5 เน้นการทำงานจนจบมากกว่าคะแนนสูงสุด: ผู้ทดสอบช่วงแรกบรรยายว่ามันทำงานต่อจากที่ Sonnet 4.6 หยุด และตรวจงานตัวเองโดยไม่ต้องสั่ง
หากเอเจนต์ใช้ชีวิตในเชลล์ Terra ได้เปรียบ หากใช้ชีวิตในโค้ดเบสและต้องให้เหตุผลกับความล้มเหลว เบนช์มาร์กบอกว่ากำลังเลือกสองโมเดลในระดับเดียวกัน

งานความรู้และงานมืออาชีพ
ทั้งสองค่ายรายงาน GDPval-AA v2 ซึ่งเป็นมาตรการแบบ Elo ของคุณภาพงานระดับมืออาชีพ ตัวเลขใกล้กันจนถือว่าไม่ต่าง OpenAI วาง Terra ที่ 1,593 Elo ส่วน Anthropic วาง Sonnet 5 ที่ 1618 OpenAI ให้ Claude Opus 4.8 ที่ 1600 Elo ในการประเมินเดียวกัน ขณะที่ Anthropic ให้รุ่นเดียวกันที่ 1615 ดังนั้นช่องว่าง 25 แต้มระหว่าง Terra กับ Sonnet 5 อยู่ในระดับนอยส์ของวิธีการ
จุดที่ Terra มีเคลมที่ยังไม่ถูกตอบคือ Agents' Last Exam ซึ่งประเมินเวิร์กโฟลว์มืออาชีพระยะยาวใน 55 สาขา Terra ได้ 50.4% นำหน้า GPT-5.5 (46.9%), Claude Opus 4.8 (45.2%) และ Claude Fable 5 (40.5%) ฝั่ง Anthropic ไม่ได้รายงาน Sonnet 5 บนชุดนี้ จึงมองเป็นสมรภูมิที่ OpenAI เลือก มากกว่าบทสรุปเด็ดขาด
ส่วนงานใช้คอมพิวเตอร์เป็นจุดที่ไม่แนะนำให้เทียบตรง OpenAI รายงาน Terra ที่ 50.2% บน OSWorld 2.0 ขณะที่ Anthropic รายงาน Sonnet 5 ที่ 81.2% บน OSWorld-Verified ชุดประเมินและการให้คะแนนต่างกัน และ Anthropic ยังปรับวิธีรัน OSWorld-Verified สำหรับการออกชุดนี้ด้วย การเอาตัวเลขมาวางข้างกันจึงบอกอะไรไม่ได้
ความได้เปรียบเชิงปฏิบัติของ Terra ในด้านนี้คือการคิดโทเคน Notion รายงานว่าเอเจนต์จำนวนมากที่รัน GPT-5.5 ให้ผลงานดีเท่าเดิมบน Terra แต่ต้นทุนครึ่งหนึ่งและใช้โทเคนน้อยลง 16% และ Clio รายงานว่า Programmatic Tool Calling ลดโทเคนพรอมป์ตลง 38% ในงานวิเคราะห์เอกสารหลายขั้นตอนโดยไม่เสียคุณภาพ ทั้งหมดเป็นเคลมจากคู่ค้าของผู้ขาย ไม่ใช่การวัดอิสระ แต่ระบุชัดเจนว่ามีอะไรเปลี่ยน
ความปลอดภัยไซเบอร์: สองทางเลือกที่ตรงข้าม
นี่คือช่องว่างที่กว้างที่สุดในเปรียบเทียบ และเป็นการออกแบบโดยตั้งใจ ไม่ใช่ข้อบกพร่องด้านความสามารถ
OpenAI เทรนตระกูล GPT-5.6 สำหรับงานไซเบอร์: Terra ทำได้ 91.8% บนโจทย์ Capture-the-Flag, 57.7% บน SEC-Bench Pro, 52.9% บน ExploitBench และ 23.2% บน ExploitGym ในจำนวนนั้นสองตัวชนะ GPT-5.5 ซึ่งเป็นเรือธงรุ่นก่อนที่ได้ 45.8% บน SEC-Bench Pro และ 47.9% บน ExploitBench
Anthropic ไปอีกทาง Sonnet 5 ไม่ได้ถูกเทรนด้านงานไซเบอร์โดยตั้งใจ และบนการประเมินพัฒนาเอ็กซ์พลอยต์ที่ร่วมกับ Mozilla ต่อช่องโหว่ Firefox 147 ตัว มันไม่เคยสร้างเอ็กซ์พลอยต์ที่ใช้งานได้เลย ได้ 0.0% Anthropic ส่ง Sonnet 5 พร้อมเปิดเซฟการ์ดไซเบอร์แบบเรียลไทม์ และแนะนำ Opus 4.8 สำหรับงานไซเบอร์ที่ต้องลดข้อกำกับ
สำหรับผู้อ่านส่วนใหญ่ นี่คือจุดเด่นของ Sonnet 5 ไม่ใช่จุดอ่อน หากสร้างผลิตภัณฑ์ที่การที่โมเดลพยายามสร้างเอ็กซ์พลอยต์เป็นความเสี่ยง การใช้โมเดลที่ปฏิเสธอย่างสม่ำเสมอปลอดภัยกว่า หากทำงานความปลอดภัยเชิงรับ Terra อยู่ในโปรแกรม Daybreak Trusted Access for Cyber ของ OpenAI และสมาชิกแต่ละรายต้องเปิดใช้ฮาร์ดแวร์พาสคีย์ภายใน 1 กันยายนเพื่อคงสิทธิ์เข้าถึงโมเดลที่มีความสามารถไซเบอร์สูงสุด
ควรเตือนถึงต้นทุนความฝืดฝั่ง OpenAI ด้วย OpenAI ระบุว่าเซฟการ์ดไซเบอร์ของ GPT-5.6 Sol บล็อกกิจกรรมที่อาจเป็นอันตรายได้มากกว่ารุ่นก่อนราว 10 เท่า และได้เพิ่มตัวเลือกลองใหม่บนโมเดลความสามารถต่ำกว่าใน ChatGPT และ Codex เพราะคำขอที่ไม่เป็นอันตรายก็ถูกจับเช่นกัน กระทู้ Reddit ฝั่ง Anthropic ก็รายงานปัญหาเดียวกัน: Sonnet 5 บล็อกคอนเทนต์สอนความปลอดภัยที่ไม่เป็นอันตราย ดังนั้นยังไม่มีผู้ขายรายใดแก้ปัญหาบล็อกเกินจำเป็นได้
หน้าต่างบริบทและงานบริบทยาว
โดยนิตินัย ทั้งคู่เหมือนกัน: Terra เผยหน้าต่าง บริบท 1,050,000 โทเคน พร้อมเพดานเอาต์พุต 128,000 โทเคน และ Sonnet 5 มาพร้อมหน้าต่าง 1M และเอาต์พุต 128K ความต่างคือเมื่อกรอกบริบทจนเต็มแล้วเกิดอะไรขึ้น
Terra เผยคะแนนกู้ค้นทั่วทั้งหน้าต่าง บน OpenAI MRCR v2 แบบ 8-เข็ม ได้ 89.6% ในช่วง 256K-512K และ 72.5% ในช่วง 512K-1M ใกล้กับ Sol ที่ 91.5% และ 73.8% และสูงกว่ามากเมื่อเทียบกับ Luna ที่ 41.3% นั่นหมายความว่าโดยประมาณคาดได้ว่าโมเดลจะหาเรื่องซ่อนอยู่เจอ 9 ใน 10 ครั้งภายในเอกสาร 512k ซึ่งเป็นเพื่อนที่ไว้ใจได้สำหรับการสกัดความรู้ ฝั่ง Anthropic ไม่ได้เผยตัวเลขกู้ค้นแบบเข็มของ Sonnet 5 ตอนเปิดตัว
พฤติกรรมคิดเงินคือความต่างที่มีนัยยะมากกว่า พรอมป์ตที่เกิน 272K โทเคนอินพุตบน Terra จะคิด 2 เท่าบนอินพุต และ 1.5 เท่าบนเอาต์พุตสำหรับทั้งคำขอ ไม่ใช่เฉพาะส่วนเกิน Sonnet 5 ไม่มีค่าธรรมเนียมบริบทยาวที่เผยแพร่ ดังนั้นอัตราจะคงที่ตลอดหน้าต่าง จะใส่ตัวเลขในส่วนราคา เพราะมันทำให้สลับว่ารุ่นไหนถูกกว่า
พื้นผิวควบคุม: ระดับความพยายาม การคิด และข้อจำกัด API
ทั้งสองโมเดลเปิดสวิตช์ปรับระดับความพยายามในการให้เหตุผล จากนั้นแยกกันชัดเจนว่าคุณแตะอะไรได้แค่ไหน
Sonnet 5 ตัด temperature, top_p และ top_k ออกทั้งหมด และการเรียกที่มีค่าพารามิเตอร์เหล่านี้จะได้ 400 error การคิดแบบขยายด้วยมือก็ได้ 400 เช่นกัน คุณจะได้การคิดแบบปรับอัตโนมัติโดยค่าเริ่มต้น หรือปิดการคิดไปเลย
Sonnet 5 ยังไม่รองรับ Priority Tier บนแพลตฟอร์ม Anthropic ซึ่งสำคัญหากทีมพึ่งสิ่งนี้เพื่อการันตี latency บน Opus หรือ Sonnet 4.6 ในปัจจุบัน Anthropic เพิ่มเพดานอัตราเรียกบน Chat, Cowork, Claude Code และ Claude Platform เพื่อรองรับการใช้โทเคนที่มากขึ้นจากระดับความพยายามที่สูง
พื้นผิวของ Terra กว้างไปอีกทิศ ฟีเจอร์ที่ควรรู้:
-
Programmatic Tool Calling ใน Responses API รันโปรแกรมประสานงานในหน่วยความจำ และเข้ากันได้กับ Zero Data Retention
-
เบต้าแบบหลายเอเจนต์ ใน Responses API ให้โมเดลรันซับเอเจนต์พร้อมกันและสังเคราะห์งานในคำขอเดียว
-
การตั้งค่าแรงพยายาม
maxเปิด/ปิดได้โดยผู้ใช้ที่มีสิทธิ์ GPT-5.6 ใน ChatGPT Work และ Codex -
จุดแบ่งแคชอย่างชัดเจน ด้วยอายุแคชขั้นต่ำ 30 นาที อ่านแคชลด 90% และเขียนแคชคิด 1.25 เท่าของอัตราอินพุตไม่แคช
-
การเรียกฟังก์ชัน เอาต์พุตแบบมีโครงสร้าง เชลล์โฮสต์ ตัวแปลโค้ด และการใช้คอมพิวเตอร์ บน Responses API โดยยังไม่รองรับการปรับจูนละเอียด
จุดไม่สมมาตรที่ควรทราบ: การตั้งค่า ultra ของ OpenAI ประสานเอเจนต์สี่ตัวแบบขนาน แต่ทุกเบนช์มาร์กที่เผยแพร่ของ ultra เป็นของ Sol ไม่ใช่ Terra อย่าคาดว่าโมเดลระดับกลางจะได้ประโยชน์หลายเอเจนต์เท่ากันจนกว่าจะมีตัวเลข Terra Ultra เผยแพร่ออกมา
ราคา: สิ่งที่ต้องจ่ายจริง
ปัจจุบัน Terra และ Sonnet 5 มีราคาอินพุตต่างกันไม่ถึงหนึ่งดอลลาร์ สิ่งที่จะตัดสินบิลคือรูปทรงเวิร์กโหลด ไม่ใช่อัตราพาดหัว
อัตราโทเคนแบบเคียงข้าง
| อัตรา | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|
| อินพุต ต่อ 1M โทเคน | $2.00 | $3.00 ($2.00 ถึง 31 ส.ค. 2026) |
| เอาต์พุต ต่อ 1M โทเคน | $12.00 | $15.00 ($10.00 ถึง 31 ส.ค. 2026) |
| ค่าบริการบริบทยาว | อินพุต 2 เท่า เอาต์พุต 1.5 เท่า เมื่อเกิน 272K โทเคนอินพุต | ไม่มีที่เผยแพร่; คงที่ถึง 1M |
| โทเคนการให้เหตุผล | ไม่มีอัตราแยกที่เผยแพร่ | คิดเงินเป็นเอาต์พุตโทเคน |
| การเข้าถึงชั้นฟรี | ค่าเริ่มต้นสำหรับ Free และ Go ใน ChatGPT Work และ Codex | ค่าเริ่มต้นบนแผน Free และ Pro |
อัตรา $2.00/$12.00 ของ Terra สะท้อนการลดราคา 20% ที่ OpenAI ใช้เมื่อ 30 กรกฎาคม 2026 จาก $2.50/$15.00 ตอนเปิดตัว การอ่านอินพุตจากแคชของ Terra อยู่ที่ $0.20 ต่อ 1M และ Anthropic รองรับการแคชพรอมป์ตสำหรับ Sonnet 5 โดยไม่แยกอัตราเฉพาะ Sonnet ในเอกสารเปิดตัว
เนื่องจาก Anthropic คิดค่าตัดสินใจคิดเชิงลึกเป็นเอาต์พุตโทเคน การรัน Sonnet 5 ที่ความพยายามสูงมากจึงคูณตรงกับบรรทัดที่แพงที่สุดในบิล ซึ่งเป็นวิธีที่เร็วที่สุดที่จะใช้เกินงบที่ตั้งจากปริมาณอินพุต
เวิร์กโหลดจริงมีค่าใช้จ่ายเท่าไร
สูตรง่ายๆ: (ปริมาณ ÷ 1M) × อัตรา แล้วบวกอินพุตกับเอาต์พุตเข้าด้วยกัน เราลองคำนวณ 3 รูปทรงเวิร์กโหลดที่อัตรามาตรฐาน ซึ่งคัดมาเพื่อแยกกลไกที่สองโมเดลนี้ต่างกันจริง
| เวิร์กโหลด | GPT-5.6 Terra | Claude Sonnet 5 | ส่วนต่าง |
|---|---|---|---|
| เน้นการสร้าง: 1M อินพุต / 4M เอาต์พุต | $50 | $63 | Sonnet 5 แพงกว่า +$13 (26%) |
| กู้ค้น ต่ำกว่าเพดาน: 10M อินพุต / 1M เอาต์พุต คำขอแต่ละครั้งต่ำกว่า 272K | $32 | $45 | Sonnet 5 แพงกว่า +$13 (41%) |
| กู้ค้น เกินเพดาน: 10M อินพุต / 1M เอาต์พุต คำขอแต่ละครั้งเกิน 272K | $58 | $45 | Terra แพงกว่า +$13 (29%) |
แถวที่สามคือข้อค้นพบ ปริมาณรวมไม่เปลี่ยนระหว่างแถวสองและสาม เปลี่ยนเพียงขนาดคำขอแต่ละครั้ง และค่าบริการเกิน 272K ของ Terra พลิกจากความได้เปรียบด้านต้นทุน 41% เป็นเสียเปรียบ 29% หากใส่ข้อความสัญญาหรือบริบทรีโพฯ 300K โทเคนในคำขอเดียวเป็นประจำ ป้ายราคา Terra ที่ถูกกว่าจะชวนให้เข้าใจผิด
แถวเน้นการสร้างก็พลิกเช่นกันหากซื้อก่อนกันยายน ที่อัตราเปิดตัว $2.00/$10.00 ของ Sonnet 5 เวิร์กโหลดนั้นอยู่ที่ $42 เทียบกับ Terra $50 ดังนั้น Sonnet 5 ถูกกว่ $8 จนกว่าอัตรามาตรฐานจะเริ่มวันที่ 1 กันยายน 2026 Anthropic ตั้งหน้าต่างเปิดตัวให้การย้ายจาก Sonnet 4.6 มีต้นทุนใกล้เคียงเดิม ควรจำไว้ก่อนจะสร้างงบจากตัวเลขนี้

เหตุใดงานเดียวกันมีค่าใช้จ่ายต่างกัน
อัตราเหล่านี้จะกลายเป็นบิลก็ต่อเมื่อทั้งสองโมเดลใช้โทเคนเท่ากันสำหรับงานเดียวกัน ซึ่งโดยมากไม่เท่ากัน Terra และ Sonnet 5 ใช้ตัวตัดคำต่างผู้ขาย จึงทำให้จำนวนโทเคนอินพุตจากข้อความเดียวกันต่างกันก่อนที่โมเดลจะตอบ
ไม่มีผู้ขายรายใดเผยการนับโทเคนแบบข้ามโมเดล จึงไม่มีตัวเลขชดเชยให้ได้ สิ่งที่มีคือข้ออ้างจากรุ่นก่อนซึ่งไม่บอกอะไรเกี่ยวกับ Terra เทียบกับ Sonnet 5 โดยตรง:
- Anthropic ระบุว่าตัวตัดคำใหม่ของ Sonnet 5 สร้างโทเคนมากกว่า Sonnet 4.6 ราว 30% และ
- Notion รายงานว่า Terra ใช้โทเคนน้อยกว่า GPT-5.5 ราว 16%
คำแนะนำของเราคือมองตารางข้างต้นเป็นการเทียบอัตรา ไม่ใช่พยากรณ์ และวัดจำนวนโทเคนของตัวเองบนชุดตัวอย่างที่เป็นตัวแทนก่อนตัดสินใจเปลี่ยน โดยเฉพาะการเปลี่ยนตัวตัดคำของ Sonnet 5 ทำให้หลายทีมสะดุดตอนเปิดตัว โดย รีวิวของ Simon Willison และบริษัทที่ปรึกษาคลาวด์ชี้ว่าเป็นเรื่องเซอร์ไพรส์หลักของการย้าย
ควรเลือก GPT-5.6 Terra หรือ Claude Sonnet 5 เมื่อใด
สรุปการตัดสินใจตามสถานการณ์ที่คาดว่าผู้อ่านส่วนใหญ่น่าจะเจอ
| กรณีใช้งาน | แนะนำ | เหตุผล |
|---|---|---|
| เอเจนต์โค้ดบนเทอร์มินัลและ CLI | GPT-5.6 Terra | 87.4% บน Terminal-Bench 2.1 เทียบกับ 80.4% ของ Sonnet 5 |
| แก้บั๊กระดับรีโพซิทอรี | อย่างใดอย่างหนึ่ง | 63.4% เทียบ 63.2% บน SWE-Bench Pro คือเสมอ เลือกตามราคาและอีโคซิสเต็ม |
| บริบทใหญ่มาก (300K+ โทเคน) | Claude Sonnet 5 | ไม่มีค่าบริการบริบทยาว ขณะที่ Terra คิดอินพุต 2 เท่าเมื่อเกิน 272K |
| ไปป์ไลน์ที่พึ่งพาเครื่องมือหนัก เรียกหลายครั้งต่อรอบ | GPT-5.6 Terra | Programmatic Tool Calling ลดโทเคนพรอมป์ต 38% ในเวิร์กโฟลว์เอกสารของ Clio |
| ความปลอดภัยเชิงรับและคัดกรองช่องโหว่ | GPT-5.6 Terra | 91.8% บน Capture-the-Flag และเข้าถึงผ่าน Trusted Access for Cyber |
| ผลิตภัณฑ์ที่การสร้างเอ็กซ์พลอยต์เป็นความเสี่ยง | Claude Sonnet 5 | ได้ 0.0% บนการพัฒนาเอ็กซ์พลอยต์ Firefox และเปิดเซฟการ์ดไซเบอร์โดยค่าเริ่มต้น |
| เวิร์กโหลดเน้นการสร้าง ก่อนกันยายน 2026 | Claude Sonnet 5 | อัตราเปิดตัว $2/$10 ทำให้ถูกกว่า Terra $8 บนเดือนที่ 1M อินพุต / 4M เอาต์พุต |
| เวิร์กโหลดที่ต้องการพารามิเตอร์การสุ่มตัวอย่างแบบกำหนดเอง | GPT-5.6 Terra | Sonnet 5 ปฏิเสธ temperature, top_p และ top_k ด้วย 400 error |
เลือก GPT-5.6 Terra หาก...
- เอเจนต์ของคุณทำงานในเชลล์ ช่องว่าง 7 แต้มบน Terminal-Bench 2.1 เป็นความต่างด้านโค้ดดิ้งที่ใหญ่สุดที่เผยแพร่ระหว่างสองโมเดลนี้
- เรียกใช้เครื่องมือจำนวนมากต่อรอบ Programmatic Tool Calling ช่วยกันข้อมูลกลางไม่ให้เข้าไปในบริบทของโมเดล และ PlayCo รายงานว่าโทเคนรวมลดลง 63.5% และจำนวนรอบโมเดลลดลง 50.1% ในงานสร้างฉากแบบมีโครงสร้าง
- ทำงานไซเบอร์เชิงรับ คะแนน 57.7% บน SEC-Bench Pro และ 52.9% บน ExploitBench ของ Terra อยู่คนละชั้นกับการปฏิเสธโดยตั้งใจของ Sonnet 5
- ต้องการเอาต์พุตโทเคนราคาถูกกว่า หลังสิงหาคม 2026 อัตราเอาต์พุตของ Sonnet 5 จะเป็น $15 ต่อ 1M เทียบกับ Terra $12
- ต้องการตัวเลขกู้ค้นบริบทยาวที่มีเอกสารรองรับ เช่น 72.5% บน MRCR v2 ในช่วง 512K-1M
เลือก Claude Sonnet 5 หาก...
- พรอมป์ตหรือไฟล์บริบทมีขนาดใหญ่ อัตราคงที่ถึง 1M โทเคนดีกว่าผาชัน 272K ของ Terra และสร้างความต่าง 29% บนเดือนที่มีอินพุต 10M
- ต้องการโมเดลที่ปฏิเสธงานไซเบอร์โดยออกแบบ การประเมินของ Anthropic เองชี้ว่า Sonnet 5 มีความสามารถไซเบอร์ด้อยกว่า Opus 4.8 และ Mythos 5 อย่างมาก ซึ่งสำหรับทีมผลิตภัณฑ์ส่วนใหญ่คือพฤติกรรมที่ต้องการ
- ใช้อีโคซิสเต็ม Claude อยู่แล้ว Sonnet 5 เป็นค่าเริ่มต้นบน Free และ Pro และทำงานใน Claude Code
- ต้องการปุ่มเดียวแทนแผงตั้งค่า การคิดแบบปรับอัตโนมัติบวกระดับความพยายามเป็นพื้นผิวที่เล็กกว่าการมีทั้ง effort, max, ultra และโหมดเรียกเครื่องมือ
หากต้นทุนเป็นข้อจำกัดหลัก ตารางเวิร์กโหลดที่คำนวณไว้สามแบบคือวิธีเร็วที่สุดในการดูว่าคุณอยู่ฝั่งไหน: $50 เทียบ $63 ในเดือนเน้นการสร้าง, $32 เทียบ $45 ในการกู้ค้นต่ำกว่าเพดาน และ $58 เทียบ $45 เมื่อคำขอแต่ละครั้งเกิน 272K โทเคนอินพุต
เริ่มต้นใช้งาน GPT-5.6 Terra และ Claude Sonnet 5 อย่างไร
ทั้งสองโมเดลพร้อมใช้งานทั่วไปในวันนี้ และต่างก็เป็นโมเดลที่ผู้ขายแจกฟรี จึงลองใช้ได้โดยไม่เสียอะไรนอกจากเวลา
| พื้นผิว | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|
| แอปสำหรับผู้ใช้ทั่วไปและชั้นบริการ | ChatGPT Work: ค่าเริ่มต้นสำหรับ Free และ Go; เลือกได้บน Plus, Pro, Business, Enterprise | แอป Claude: ค่าเริ่มต้นบน Free และ Pro; ใช้ได้บน Max, Team, Enterprise |
| API ของผู้พัฒนา | OpenAI API ผ่าน Responses และ Chat Completions | Claude API บน Claude Platform |
| แพลตฟอร์มคลาวด์ | Amazon Bedrock (GA) และ Microsoft Foundry (GA รวม APAC Data Zone); ยังไม่พร้อมบน Google Vertex | Claude Platform บน AWS และ Claude ใน Microsoft Foundry; Google Vertex ระบุว่าเร็วๆ นี้ |
| เอเจนต์สำหรับโค้ดดิ้ง | Codex: ค่าเริ่มต้นสำหรับ Free และ Go เลือกได้บน Plus ขึ้นไป | Claude Code |
| API model ID | gpt-5.6-terra |
claude-sonnet-5 |
การเรียก API ครั้งแรก
เป็น SDK คนละชุด จึงไม่ใช่แค่สตริงโมเดลที่ต้องเปลี่ยน คำขอทั้งสองสั้นพอให้เห็นความต่างได้ชัด
from openai import OpenAI
client = OpenAI()
response = client.responses.create(
model="gpt-5.6-terra", # swap for gpt-5.6-sol or gpt-5.6-luna
input="Refactor this pytest fixture to avoid module-level state.",
)
print(response.output_text)
from anthropic import Anthropic
client = Anthropic()
message = client.messages.create(
model="claude-sonnet-5", # no temperature/top_p/top_k on this model
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this pytest fixture to avoid module-level state."}],
)
print(message.content.text)
หากพอร์ตโค้ด Anthropic ที่มีอยู่ อย่าลืมลบ temperature, top_p, top_k และการตั้งค่าคิดแบบขยายด้วยมือออกก่อน เพราะ Sonnet 5 จะคืน 400 แทนที่จะเพิกเฉย
สำหรับขั้นตอนตั้งค่าเต็มฝั่ง Anthropic ดู คู่มือครบถ้วนของ Claude API ดีกว่า ส่วนฝั่ง GPT หลักสูตร Working with the OpenAI API คือจุดเริ่มต้นที่ดีที่สุด
บทส่งท้าย
สรุปสั้นๆ หนึ่งประโยค: Terra ดีกว่าสำหรับเอเจนต์เทอร์มินัลและไปป์ไลน์ที่หนาแน่นด้วยเครื่องมือ ส่วน Sonnet 5 ดีกว่าสำหรับพรอมป์ตขนาดใหญ่และทีมที่ต้องการพื้นผิวให้คิดน้อยลง
สิ่งที่น่าสนใจคือทั้งสองค่ายเลือกใช้โมเดลระดับกลางเป็นค่าเริ่มต้นสำหรับผู้ใช้ฟรี แล้วเดิมพันตรงกันข้ามว่าโมเดลระดับกลางควรปฏิเสธอะไร OpenAI เทรน Terra สำหรับงานไซเบอร์และวางความสามารถที่คมที่สุดไว้หลังการยืนยันตัวตนและพาสคีย์ฮาร์ดแวร์ ขณะที่ Anthropic เทรน Sonnet 5 ให้ไม่ทำเลย แล้วเสริมเซฟการ์ดเข้าไปอีก ไม่มีแนวทางไหนที่ถูกต้องชัดเจน และทั้งสองสร้างแรงเสียดทานจริงกับงานที่ชอบธรรม
หากอยากสร้างพื้นฐานเพื่อชั่งน้ำหนักเองแทนการอ่านตารางเบนช์มาร์กของคนอื่น แนะนำให้เริ่มที่ AI Fundamentals skill track ของเรา
คำถามที่พบบ่อย
GPT-5.6 Terra หรือ Claude Sonnet 5 ดีกว่าสำหรับการเขียนโค้ด?
ขึ้นอยู่กับงานโค้ดดิ้ง บน SWE-Bench Pro ทั้งสองโมเดลแทบไม่ต่างกันที่ 63.4% (Terra) และ 63.2% (Sonnet 5) สำหรับการแก้บั๊กระดับรีโพฯ อย่างไรก็ตาม GPT-5.6 Terra นำอย่างมีนัยสำคัญในเวิร์กโฟลว์เทอร์มินัลและ CLI ด้วยคะแนน 87.4% บน Terminal-Bench 2.1 เทียบกับ 80.4% ของ Sonnet 5 เลือก Terra หากเอเจนต์ทำงานในเชลล์; เลือกอย่างใดอย่างหนึ่งสำหรับงานให้เหตุผลในโค้ดเบสทั่วไป
GPT-5.6 Terra และ Claude Sonnet 5 มีค่าใช้จ่ายเท่าไร?
GPT-5.6 Terra มีค่าใช้จ่าย $2.00 ต่อ 1M โทเคนอินพุต และ $12.00 ต่อ 1M โทเคนเอาต์พุต (หลังลดราคา 20% เมื่อ 30 กรกฎาคม 2026) ส่วน Claude Sonnet 5 อยู่ที่ $3.00/$15.00 ตามอัตรามาตรฐาน โดยมีราคาเปิดตัว $2.00/$10.00 ถึง 31 สิงหาคม 2026 Terra มีค่าบริการบริบทยาว (อินพุต 2 เท่า เอาต์พุต 1.5 เท่า) สำหรับคำขอที่เกิน 272K โทเคนอินพุต ขณะที่ Sonnet 5 คิดอัตราคงที่ถึง 1M โทเคน
หน้าต่างบริบทของ GPT-5.6 Terra และ Claude Sonnet 5 คือเท่าไร?
GPT-5.6 Terra มีหน้าต่างบริบท 1,050,000 โทเคน พร้อมเพดานเอาต์พุต 128,000 โทเคน ส่วน Claude Sonnet 5 มีหน้าต่างบริบท 1M โทเคน พร้อมเพดานเอาต์พุต 128K โทเคน ทั้งสองมีขนาดใหญ่พอสำหรับเวิร์กโหลดส่วนใหญ่
Claude Sonnet 5 ทำงานด้านความปลอดภัยไซเบอร์ได้ไหม?
Claude Sonnet 5 ไม่ได้ถูกเทรนสำหรับงานความปลอดภัยไซเบอร์โดยเฉพาะ บนการประเมินพัฒนาเอ็กซ์พลอยต์ที่ร่วมกับ Mozilla ต่อช่องโหว่ Firefox 147 ตัว ได้ 0.0% Anthropic จัดส่งโดยเปิดเซฟการ์ดไซเบอร์แบบเรียลไทม์โดยค่าเริ่มต้น สำหรับทีมผลิตภัณฑ์ส่วนใหญ่ นี่เป็นจุดเด่นมากกว่าจุดอ่อน เพราะโมเดลที่ปฏิเสธการสร้างเอ็กซ์พลอยต์อย่างสม่ำเสมอเป็นการพึ่งพาที่ปลอดภัยกว่า หากต้องการความสามารถเชิงรับด้านไซเบอร์ GPT-5.6 Terra ได้ 91.8% บนโจทย์ Capture-the-Flag และ 57.7% บน SEC-Bench Pro
โมเดลใดถูกกว่าสำหรับพรอมป์ตใหญ่กว่า 300K โทเคน?
แม้ GPT-5.6 Terra จะโดยรวมถูกกว่าสำหรับเวิร์กโฟลว์ส่วนใหญ่ แต่ Claude Sonnet 5 จะถูกกว่าสำหรับพรอมป์ตขนาดใหญ่ GPT-5.6 Terra คิดค่าบริการบริบทยาว อินพุต 2 เท่า และเอาต์พุต 1.5 เท่า สำหรับทั้งคำขอเมื่ออินพุตเกิน 272K โทเคน ขณะที่ Sonnet 5 ไม่มีค่าบริการบริบทยาวที่เผยแพร่ อัตราจึงคงที่ถึง 1M โทเคน