Lewati ke konten utama

Claude Opus 5 vs. Claude Sonnet 5: Memilih yang Tepat untuk Digunakan

Pertimbangkan skor tolok ukur Claude Opus 5 terhadap harga Claude Sonnet 5 untuk memilih model Anthropic yang tepat bagi tim Anda.
Diperbarui 3 Agu 2026  · 5 mnt baca

Jelajahi dengan AI

Buka di ChatGPTBuka di ClaudeBuka di Perplexity

Anthropic belum menerbitkan tolok ukur langsung Opus 5 vs. Sonnet 5. Setiap posting peluncuran membandingkan modelnya dengan pendahulunya sendiri dan dengan Opus 4.8. Jadi angka-angka di bawah ini hanya menceritakan sebagian. Sisanya adalah penilaian yang sama seperti pada pasangan Opus vs. Sonnet mana pun: seberapa tinggi plafon kemampuan yang benar-benar Anda butuhkan, dan berapa yang bersedia Anda bayarkan untuk itu.

Apa Itu Claude Opus 5?

Opus 5 adalah model kelas atas Anthropic, dirilis 24 Juli 2026, dengan harga $5 per satu juta token masukan dan $25 per satu juta token keluaran. Anthropic menyebutnya tercanggih pada Frontier-Bench dan GDPval-AA, serta mendekati model Fable 5 yang lebih besar dengan setengah harga. Ini adalah model default di Claude Max dan model terkuat di Claude Pro.

Ciri menonjolnya adalah verifikasi mandiri: memeriksa hasil kerjanya sendiri, membangun test harness saat tidak ada aliran data, serta menolak instruksi yang buruk alih-alih patuh begitu saja.

Apa Itu Claude Sonnet 5?

Sonnet 5 adalah model kelas menengah Anthropic, dirilis 30 Juni 2026. Anthropic menggambarkannya sebagai Sonnet paling agentic sejauh ini, dengan kinerja mendekati Opus 4.8 pada harga yang lebih rendah. Ini adalah model default pada paket Free dan Pro, serta tersedia di Max, Team, Enterprise, dan API.

Harga: $2 per satu juta token masukan dan $10 per satu juta token keluaran hingga 31 Agustus 2026, lalu standar $3/$15.

Perbedaan Tier, dalam Praktik

Bagian ini tidak dijabarkan di posting rilis, karena ini memang cara lini model Anthropic bekerja secara umum, bukan khusus untuk pasangan ini.

Opus adalah model plafon

Anda memilihnya ketika kesalahan akan berakibat mahal, ketika tugas berjalan lama dan otonom tanpa ada yang memeriksa di tengah jalan, atau ketika masalahnya benar-benar baru, bukan variasi dari sesuatu yang telah ribuan kali dilihat model. Refactor multi-berkas yang dalam, pertanyaan riset yang ambigu, rangkaian agen panjang di mana kesalahan bisa berlipat ganda — itulah ranah Opus. Anda membayar agar model menangkap kesalahannya sendiri sebelum menjadi masalah bagi Anda.

Sonnet adalah kuda kerja

Model ini dirancang cepat dan cukup murah untuk berjalan terus-menerus: asisten chat, klasifikasi volume tinggi, pengodean iteratif saat Anda ikut meninjau tiap beberapa langkah, aplikasi yang sensitif terhadap latensi. Batas penilaiannya lebih rendah, namun untuk porsi besar pekerjaan nyata, Anda jarang menyentuh batas itu. Penggunaan harian sebagian besar tim sebaiknya condong ke Sonnet, dengan Opus dipanggil secara selektif untuk tugas-tugas yang benar-benar membutuhkannya.

Secara khusus, Sonnet 5 adalah upaya Anthropic mendorong batas itu lebih tinggi dari biasanya untuk model kelas menengah — karenanya "Sonnet paling agentic sejauh ini" dan klaim bahwa ia mendekati Opus 4.8 pada beberapa tugas. Itulah konteks membaca angka tolok ukur di bawah: Sonnet 5 bukan sekadar murah, tetapi murah dan lebih mendekati kelas Opus dibanding Sonnet sebelumnya.

Apa yang Sebenarnya Ditunjukkan Angka Rilis

Harga

Perbedaan paling jelas dan tidak ambigu. Sonnet 5 berjalan di $2/$10 (hingga 31 Agustus) atau $3/$15 (standar) dibanding tarif flat Opus 5 $5/$25 — biaya Sonnet 5 adalah 40–60% dari Opus 5 tergantung jendela harga.

Alignment 

Satu-satunya bagian dimana dua posting rilis saling menyebut langsung. Audit otomatis Anthropic menemukan Opus 5 "lebih patuh pada Konstitusi Claude dibanding Opus 4.8, Sonnet 5, atau Fable 5" — hasil nyata yang dinyatakan, bukan inferensi. Opus 5 mencetak 2,3 pada audit tersebut, skor teraman sejauh ini. Sonnet 5 membaik dibanding pendahulunya (halusinasi lebih rendah, tidak gampang menyetujui, lebih tahan terhadap pembajakan prompt-injection) namun Anthropic mencatat tingkat perilaku tidak selarasnya masih lebih tinggi daripada Opus 4.8.

Keamanan siber

Kedua model tidak dilatih secara sengaja pada materi siber, namun hasilnya berbeda.

Opus 5 mendekati Mythos 5 dalam menemukan kerentanan, meski tertinggal dalam mengubahnya menjadi eksploit. Sonnet 5 berada lebih di belakang: Anthropic menyatakan secara gamblang bahwa Sonnet 5 memiliki "kemampuan siber yang jauh lebih buruk daripada Opus 4.8 dan Mythos 5," dan pada evaluasi pengembangan eksploit Firefox, ia tidak pernah menghasilkan eksploit yang berfungsi penuh (0,0% keberhasilan, hanya sedikit unggul atas Sonnet 4.6 pada upaya parsial).

Jika kasus penggunaan Anda menyentuh hal-hal yang beririsan dengan siber, kesenjangan ini nyata dan jelas menguntungkan Opus 5.

Pengodean dan pekerjaan berbasis pengetahuan

Di sini kedua posting menggunakan set tolok ukur yang berbeda, jadi tidak ada garis skor yang bersih.

Opus 5 lebih dari dua kali lipat Opus 4.8 pada Frontier-Bench v0.1 dan berada dalam 0,5% dari Fable 5 pada CursorBench 3.2 dengan setengah biaya. Sonnet 5 digambarkan mendekati Opus 4.8 pada BrowseComp dan OSWorld-Verified pada tingkat upaya tinggi.

Dibaca bersama dengan logika tier di atas: Sonnet 5 mendekat pada tugas-tugas spesifik yang dipilih Anthropic untuk disorot, tetapi keunggulan Opus 5 tampak lebih besar dan lebih luas. Perlakukan bagian ini sebagai indikatif, bukan terukur.

Kapan Memilih yang Mana

Pilih Opus 5 jika 

tugasnya berisiko tinggi, berlangsung lama, atau benar-benar baru; Anda mengerjakan ilmu hayati, kimia, atau pekerjaan agenik multi-langkah yang kompleks; Anda memerlukan model dengan alignment terbaik yang tersedia; hal-hal terkait keamanan siber termasuk dalam cakupan.

Pilih Sonnet 5 jika

Anda menjalankan volume tinggi, latensi penting, atau tugasnya cukup terdefinisi sehingga Anda tidak memerlukan plafon penilaian Opus; Anda menggunakan Free atau Pro di mana ini sudah menjadi default; biaya per token adalah kendala utama.

Tidak keduanya, jika

Anda memerlukan pekerjaan keamanan siber dengan pembatas yang dikurangi. Opus 5 otomatis mundur ke Opus 4.8, dan Sonnet 5 berada di belakang Opus 4.8 secara langsung.

Pemikiran Akhir

Sebagian besar faktor penentu di sini sama dengan yang menentukan pertanyaan Opus vs. Sonnet apa pun: apakah tugas ini membutuhkan plafon kemampuan, atau cukup perlu diselesaikan secara andal dalam skala besar? Sonnet 5 mendorong plafon itu lebih tinggi dibanding Sonnet sebelumnya, yang menjadi kabar utama dalam peluncurannya. Namun pada titik di mana Anthropic memberi angka untuk dua model tersebut — audit alignment — Opus 5 unggul, dan cerita keamanan siber mengarah ke kesimpulan yang sama. Jadikan Sonnet 5 sebagai default untuk volume, gunakan Opus 5 saat tugas tidak boleh salah jawabannya.

Topik