Lewati ke konten utama

Claude Sonnet 5 vs. GPT-5.6: Tolok Ukur, Harga, dan Akses

Sonnet 5 sudah tersedia dengan diskon. GPT-5.6 mencatat angka lebih kuat di Terminal-Bench-2.1 tetapi belum tersedia secara umum. Berikut rincian lengkapnya.
Diperbarui 28 Sep 2026  · 7 mnt baca

Jelajahi dengan AI

ChatGPTClaudePerplexity

Anthropic dan OpenAI sama-sama merilis hal baru minggu ini, tetapi keduanya berada pada tahap peluncuran yang berbeda.

GPT-5.6 telah diumumkan, tetapi masih terkunci di balik pratinjau terbatas. Dan sementara GPT-5.6 belum tersedia secara umum, Claude Sonnet 5 dirilis hari ini dan sudah aktif di semua paket Claude — dengan harga API perkenalan yang, untuk saat ini, bahkan lebih murah daripada model tingkat menengah GPT-5.6, Terra.

Berikut apa yang kami ketahui tentang masing-masing model, bagaimana perbandingannya, dan di mana angka-angkanya tumpang tindih.

Apa Itu Claude Sonnet 5?

Claude Sonnet 5 adalah model tingkat menengah terbaru dari Anthropic, dan perusahaan memposisikannya sebagai model Sonnet paling agentik hingga kini. Intinya, model ini menutup banyak celah terhadap model kelas Opus dalam hal perencanaan dan penggunaan alat, sambil tetap jauh lebih murah.

Anthropic menyatakan Sonnet 5 merupakan lompatan besar dari Sonnet 4.6 dalam penalaran, pengkodean, dan penggunaan alat, serta performanya kini cukup mendekati Opus 4.8 pada sejumlah evaluasi agentik, termasuk BrowseComp (pencarian agentik) dan OSWorld-Verified (penggunaan komputer).

Opus 4.8 masih unggul dalam akurasi mentah, terutama pada setelan upaya tinggi atau tertinggi, tetapi Sonnet 5 memberi pengembang opsi harga versus performa yang lebih menarik. Model tingkat menengah Anthropic punya rekam jejak tampil melebihi kelasknya saat generasi baru hadir sebelum penyegaran Opus berikutnya menyusul. Terasa sudah lama, tetapi Claude Sonnet 3.5 sebenarnya mengungguli Claude Opus 3 yang lebih lama pada beberapa tolok ukur di tahun 2024.

Sonnet 5 juga menggunakan tokenizer yang diperbarui, yang berarti teks masukan yang sama dapat dipetakan ke lebih banyak token daripada sebelumnya (sekitar 1,0–1,35x tergantung konten).

Apa Itu GPT-5.6?

GPT-5.6 bukan satu model tunggal. Ini adalah keluarga berisi tiga model, diorganisasi dengan skema penamaan baru di mana angka menandai generasi dan nama menandai tingkat kapabilitas:

  • Sol adalah andalannya. Ini satu-satunya tingkat yang memiliki akses ke dua kontrol baru: setelan upaya penalaran max dan ultra mode, yang membagi tugas ke kumpulan subagen.

  • Terra adalah model sehari-hari yang seimbang — kurang lebih sebanding dengan GPT-5.5 dalam kualitas keseluruhan dengan harga sekitar setengahnya.

  • Luna adalah tingkat berbiaya rendah, ditujukan untuk beban kerja yang sensitif terhadap latensi.

Dengan kabar ini, OpenAI menyoroti peningkatan dalam pengkodean, biologi, dan keamanan siber. Cerita tolok ukur utamanya adalah performa pada beberapa benchmark menarik, terutama Terminal-Bench 2.1, tetapi juga GeneBench v1, yang merupakan tolok ukur genomik jangka panjang, serta dua tolok ukur pengembangan eksploit (ExploitBench dan ExploitGym).

Perbandingan Tolok Ukur Claude Sonnet 5 dan GPT-5.6

Dari pengumuman masing-masing, Sonnet 5 dan GPT-5.6 tidak berbagi satu pun tolok ukur umum dengan angka dari kedua pihak.

Meski Anthropic telah menerbitkan beberapa angka untuk Sonnet 5 di posting peluncuran dan kartu sistemnya, OpenAI sejauh ini baru mengonfirmasi satu skor tolok ukur untuk GPT-5.6: Terminal-Bench 2.1. Berikut yang benar-benar tercatat untuk masing-masing pihak, disusun bersama:

Tolok ukur Claude Sonnet 5 GPT-5.6 Sol GPT-5.6 Sol Ultra GPT-5.6 Terra GPT-5.6 Luna
Terminal-Bench 2.1 Tidak dipublikasikan 88,8% 91,9% 82,5% 84,3%
SWE-bench Pro 63,2% Tidak dipublikasikan — Tidak dipublikasikan Tidak dipublikasikan
OSWorld-Verified (penggunaan komputer) 81,2% Tidak dipublikasikan — Tidak dipublikasikan Tidak dipublikasikan
Humanity's Last Exam (dengan alat) 57,4% Tidak dipublikasikan — Tidak dipublikasikan Tidak dipublikasikan

Terminal-Bench 2.1 adalah satu-satunya baris di mana GPT-5.6 menerbitkan hasil apa pun, dan Sonnet 5 belum memiliki skor yang bisa ditaruh di sana. Mungkin ini strategis karena GPT-5.6 tampil baik. 

Pada tolok ukur yang memiliki angka untuk Sonnet 5 — SWE-bench Pro, OSWorld-Verified, Humanity's Last Exam — GPT-5.6 belum menunjukkan kartunya, jadi belum ada yang bisa dibandingkan.

Kesimpulan jujurnya: perbandingan tolok ukur Sonnet 5 vs. GPT-5.6 yang sepenuhnya setara belum ada. Masing-masing perusahaan menerbitkan set evaluasi yang berbeda.

Melihat lebih luas: posisi masing-masing model di lanskap yang lebih besar

Karena Sonnet 5 dan GPT-5.6 tidak tumpang tindih secara langsung, ada baiknya mundur selangkah untuk melihat bagaimana skor yang dipublikasikan masing-masing dibandingkan dengan model lain — Opus 4.8, Fable 5 yang ditangguhkan, GPT-5.5, dan Gemini 3.1 Pro. Ini tidak akan menuntaskan Sonnet 5 vs. GPT-5.6, tetapi menunjukkan posisi masing-masing terhadap kumpulan pesaing yang sama:

Tolok ukur Claude Opus 4.8 Claude Fable 5 (sebelum ditangguhkan) GPT-5.5 Gemini 3.1 Pro GPT-5.6 Sol Ultra
Terminal-Bench 2.1 78,9% 83,4% 88,0% 70,7% 91,9%
SWE-bench Pro 69,2% 80,3% 58,6% — Tidak dipublikasikan
Humanity's Last Exam (tanpa alat) 49,8% 59,0% — 44,4% Tidak dipublikasikan

Beberapa hal: Pada Terminal-Bench 2.1, skor 91,9% GPT-5.6 Sol Ultra melampaui semua model Claude yang ada, termasuk Opus 4.8 pada 78,9%. Jadi OpenAI tidak berlebihan saat membanggakan skor GPT-5.6 di Terminal-Bench 2.1.

Fable 5 masih memimpin Opus 4.8 dan GPT-5.5 pada SWE-bench Pro dan Humanity's Last Exam, meski sedang ditangguhkan. Angkanya belum terkalahkan, oleh siapa pun, termasuk GPT-5.6 (yang belum menerbitkan skor SWE-bench atau HLE untuk dibandingkan). Skor 63,2% Sonnet 5 pada SWE-bench Pro (dari tabel di atas) akan berada di atas GPT-5.5 yang 58,6% tetapi di bawah Opus 4.8 dan Fable 5 — proksi yang longgar, karena ini generasi model berbeda yang dibaca lintas dua tabel terpisah.

Harga Claude Sonnet 5 dan GPT-5.6

Model Input (per 1M token) Output (per 1M token)
Claude Sonnet 5 (perkenalan, hingga 31 Agu 2026) $2,00 $10,00
Claude Sonnet 5 (standar) $3,00 $15,00
GPT-5.6 Sol $5,00 $30,00
GPT-5.6 Terra $2,50 $15,00
GPT-5.6 Luna $1,00 $6,00

Pada harga daftar, harga perkenalan Sonnet 5 berada di antara GPT-5.6 Terra dan Luna, dan jauh di bawah Sol. Namun yang lebih menarik adalah harga perkenalannya: di $2/$10, Sonnet 5 sebenarnya lebih murah daripada GPT-5.6 Terra yang $2,50/$15, setidaknya sepanjang musim panas hingga terjadi kenaikan harga.

Perlu diperjelas, cerita harga sedikit lebih kompleks daripada perhitungan kasar. Anthropic mencatat bahwa harga perkenalan Sonnet 5 dikalibrasi agar kurang lebih netral biaya terhadap jumlah token yang lebih tinggi dari tokenizer baru. Sementara itu, OpenAI memperkenalkan caching prompt yang lebih prediktabel untuk GPT-5.6 dan model selanjutnya, dengan penulisan cache ditagih 1,25x dari tarif input tanpa cache dan pembacaan cache mempertahankan diskon 90%. 

Mengapa meluncurkan dengan harga perkenalan yang didiskon, bukan langsung menetapkan tarif standar sejak hari pertama? Penjelasan tokenizer menutup sebagian, tetapi waktunya juga selaras dengan apa yang kami lihat: bidang yang padat dan bergerak cepat. Dalam beberapa minggu terakhir saja, Sakana AI merilis Fugu, sebuah orkestrator yang merutekan ke kumpulan model frontier dan mengklaim mendekati sistem kelas Mythos milik Anthropic sendiri dengan biaya sebagian kecil. Jadi memasang harga Sonnet 5 di $2/$10 hingga akhir Agustus memberi Anthropic model agentik yang benar-benar murah dan luas ketersediaannya untuk ditunjuk, sementara GPT-5.6 masih terkunci di pratinjau. Menjadi model yang benar-benar bisa digunakan orang, dengan harga rendah, adalah keuntungan kompetitif nyata.

Ketersediaan Claude Sonnet 5 dan GPT-5.6

Claude Sonnet 5 tersedia hari ini, di mana saja. Ini adalah model default pada paket Free dan Pro, dapat diakses di Max, Team, dan Enterprise, serta aktif di Claude Code dan di Claude Platform melalui API (string model claude-sonnet-5). Anda mungkin sudah melihat Claude Sonnet 5 di jendela chat bahkan sebelum melihat pengumumannya. 

chat claude sonnet 5

GPT-5.6 belum tersedia secara umum. Selama pratinjau, ini hanya dapat diakses melalui API dan Codex oleh sekelompok mitra terpilih. OpenAI mengatakan ketersediaan yang lebih luas akan datang, tetapi belum memberikan tanggal. 

Penutup

Pada satu tolok ukur yang tumpang tindih, tingkat andalan GPT-5.6 melaporkan skor lebih tinggi daripada andalan Claude saat ini, Opus 4.8, yang mengisyaratkan OpenAI mungkin memiliki keunggulan kapabilitas nyata ketika GPT-5.6 dirilis luas. Namun Sonnet 5 sebenarnya bukan pesaing langsung Sol atau Terra dalam hal kapabilitas — ini model tingkat menengah yang bersaing pada performa agentik per dolar, dan dalam hal itu model ini tersedia, harganya agresif, dan sudah bekerja hari ini.


Josef Waples's photo
Author
Josef Waples

Saya penulis dan editor data science dengan kontribusi pada artikel riset di jurnal ilmiah. Saya sangat tertarik pada aljabar linear, statistika, R, dan sejenisnya. Saya juga cukup sering bermain catur! 

Topik
Kecerdasan Buatan

Belajar dengan DataCamp

Kursus

Pengantar Model Claude

3 Hr
14.6K
Pelajari cara bekerja dengan Claude menggunakan Anthropic API untuk menyelesaikan tugas dunia nyata dan membangun aplikasi berbasis AI.
Lihat DetailRight Arrow
Mulai Kursus
Lihat Lebih BanyakRight Arrow
Terkait

blogs

12 Alternatif ChatGPT Terbaik yang Bisa Anda Coba pada 2026

Artikel ini menyajikan daftar alternatif ChatGPT yang akan meningkatkan produktivitas Anda.
Javier Canales Luna's photo

Javier Canales Luna

14 mnt

blogs

40 Pertanyaan Wawancara DBMS Teratas di 2026

Kuasai pertanyaan wawancara basis data, dari konsep SQL dasar hingga skenario desain sistem tingkat lanjut. Panduan mendalam ini mencakup semua yang Anda perlukan untuk sukses di wawancara DBMS dan meraih peran berikutnya.
Dario Radečić's photo

Dario Radečić

15 mnt

blogs

Tutorial Korelasi di R

Dapatkan pengenalan dasar-dasar korelasi di R: pelajari lebih lanjut tentang koefisien korelasi, matriks korelasi, plotting korelasi, dan sebagainya.
David Woods's photo

David Woods

13 mnt

blogs

Spaghetti Plot dan Jalur Badai

Temukan alasan mengapa Anda sebaiknya (tidak) menggunakan spaghetti plot untuk menyampaikan ketidakpastian jalur prediksi badai serta dampaknya terhadap interpretasi.
Hugo Bowne-Anderson's photo

Hugo Bowne-Anderson

13 mnt

Lihat Lebih BanyakLihat Lebih Banyak