Anthropic Rilis Claude Sonnet 5.5: Performa Mendekati Opus, Tapi Boros Token
Baca dalam 60 detik
- Anthropic resmi meluncurkan Claude Sonnet 5.5 dengan klaim kecepatan 30% lebih tinggi dan biaya per tugas hingga 30% lebih murah, meski harga per token tetap sama seperti Sonnet 5.
- Uji independen Artificial Analysis menemukan model ini membutuhkan sekitar 193 ribu token output per tugas pada upaya maksimal—60% lebih banyak dari Opus 5.5 dan tujuh kali lipat GPT-6 Astra.
- Ketergantungan pada volume token besar berpotensi menggerus efisiensi biaya jangka panjang, memaksa perusahaan menimbang ulang strategi adopsi AI di tengah persaingan model yang semakin ketat.

Anthropic memperkenalkan Claude Sonnet 5.5 pada 28 September 2026 dengan harga resmi yang tidak berubah dari pendahulunya, Sonnet 5. Perusahaan mengklaim model ini berjalan lebih dari 30% lebih cepat dan menekan biaya per tugas hingga 30% untuk sebagian besar pekerjaan. Namun, temuan awal dari lembaga benchmark independen menunjukkan sisi lain: model ini jauh lebih boros token ketika dipacu hingga batas maksimalnya.
Sonnet 5.5 merupakan model kedua dalam keluarga Claude 5.5, menyusul peluncuran Opus 5.5 pada 22 September. Pada hari yang sama, OpenAI juga merilis GPT-6 Sol dan Luna, menandai persaingan model bahasa besar yang semakin panas. Anthropic mempertahankan tarif $2 per juta token input dan $10 per juta token output—sama seperti Sonnet 5. Perusahaan melaporkan skor 70,6% pada Terminal-Bench 4.0, tes pengkodean agentik, melonjak dari Sonnet 5 yang hanya 10,3%, dan sedikit di atas Opus 5.5 yang mencapai 66,4%.
Meski demikian, Artificial Analysis, firma benchmark yang juga meranking Grok 4.7 di posisi keempat, memberikan skor 56 untuk Sonnet 5.5 pada Intelligence Index. Peringkat itu menempatkannya di posisi kedua secara keseluruhan, hanya terpaut dua poin dari Opus 5.5 pada upaya maksimal. Pada Terminal-Bench 4.0 versi firma tersebut, Sonnet 5.5 mencatat 64%, mengungguli Opus 5.5 (60%) dan GPT-6 Astra. Untuk tugas pengetahuan seperti GDPval-AA, performanya dinilai setara dengan Opus 5.5.
Perbedaan mencolok muncul pada konsumsi token. Artificial Analysis mencatat bahwa pada upaya maksimal, Sonnet 5.5 memakai sekitar 193 ribu token output per tugas Intelligence Index. Angka itu sekitar 60% lebih tinggi dari Opus 5.5 dan Sonnet 5 pada upaya maksimal, serta sekitar tujuh kali lipat dari GPT-6 Astra. Temuan ini kontras dengan klaim Anthropic yang menyebut penghematan biaya hingga 30% untuk sebagian besar beban kerja.
"Pada upaya maksimal, saat performanya mendekati Opus 5.5, Claude Sonnet 5.5 menggunakan ~193k Output Token per Tugas Intelligence Index," tulis Artificial Analysis dalam unggahannya.
Di sisi lain, pelanggan akses awal yang dikutip Anthropic melaporkan tren sebaliknya ketika dibandingkan dengan Sonnet 5, meski pada beban kerja berbeda. Balyasny Asset Management, misalnya, mencatat penggunaan token yang jauh lebih rendah untuk tugas keuangan. "Pada suite privat kami yang berisi 2.441 tugas keuangan meliputi tanya jawab, ekstraksi, analisis, dan peramalan, Claude Sonnet 5.5 unggul dari Sonnet 5 dan menggunakan sekitar 121 ribu token per jawaban, sedangkan Sonnet 5 memakai 497 ribu," ujar Joe Poirier, Senior AI Engineer di Balyasny Asset Management.
Anthropic menegaskan bahwa Sonnet 5.5 tidak memperluas batas kemampuan model. Karena itu, tinjauan penyelarasan difokuskan pada risiko seperti menyesatkan pengguna dan membantu penyalahgunaan berisiko tinggi. Model ini juga dilengkapi pengaman siber dan pengklasifikasi anti-distilasi yang memblokir upaya mengekstrak penalaran model untuk melatih sistem pesaing. Claude Haiku 5.5 dijadwalkan menyusul dalam beberapa pekan ke depan.
Sementara itu, OpenAI menunda model GPT-6.1 Astra dengan alasan keamanan. CNBC mengonfirmasi pada Senin bahwa model tersebut tidak memenuhi standar internal perusahaan. Artificial Analysis menguji versi pra-rilis Sonnet 5.5 yang membawa bug output terstruktur, yang menurut Anthropic telah diperbaiki. Firma itu berencana menjalankan ulang evaluasi terkait dalam waktu dekat.
Konteks Indonesia
Bagi pelaku industri digital di Indonesia, rilis Sonnet 5.5 menawarkan opsi menarik: performa mendekati model kelas atas dengan harga yang lebih terjangkau. Namun, temuan boros token pada upaya maksimal menjadi peringatan bagi startup dan perusahaan yang mengandalkan API untuk aplikasi berskala besar. Efisiensi biaya tidak hanya ditentukan oleh tarif per token, tetapi juga oleh seberapa banyak token yang dikonsumsi untuk menyelesaikan satu tugas. Organisasi dengan beban kerja kompleks—seperti analisis data keuangan atau otomasi dokumen—perlu menguji secara mandiri sebelum mengadopsi model ini secara luas.
Di tengah gelombang adopsi AI generatif di Indonesia, keputusan memilih model tidak lagi sekadar soal akurasi, tetapi juga total cost of ownership. Persaingan antara Anthropic, OpenAI, dan pemain lain diprediksi terus menekan harga, namun pengguna dituntut lebih cermat menghitung konsumsi token riil. Apakah efisiensi biaya yang dijanjikan akan bertahan ketika model dipacu untuk tugas-tugas paling menantang? Jawabannya akan menentukan lanskap adopsi AI di kawasan ini dalam 12 bulan ke depan.



