Harga per Token Tidak Turun, tapi Biaya per Tugas Sonnet 5.5 Turun 30 Persen
Argumen jual Sonnet 5.5 bukan potongan tarif, melainkan efisiensi: satu tugas selesai dengan lebih sedikit langkah, token, dan panggilan tool. Lovable mencatat sepertiga lebih sedikit panggilan tool dan sekitar separuh perintah shell; Base44 mencatat 3,6 iterasi per aplikasi dibanding 7,7 pada Opus 5.
Yang dijual Sonnet 5.5 bukan potongan tarif token. Tarifnya sama dengan Sonnet 5. Gagasannya lain: pekerjaan selesai dengan langkah, token, dan panggilan tool yang lebih sedikit, sehingga biaya total per tugas bisa turun sampai 30 persen meski daftar harga tidak bergerak. Cache write juga lebih murah, 2,50 dolar per juta token.
Bukti pertama datang dari mitra. Lovable melaporkan evaluasi internalnya menemukan Sonnet 5.5 memerlukan sekitar sepertiga lebih sedikit panggilan tool dan kira-kira separuh perintah shell untuk menyelesaikan pekerjaan koding. Base44 menguji 118 pembangunan aplikasi nyata: Sonnet 5.5 mencapai hasil setara Opus 5 dalam rata-rata 3,6 iterasi per aplikasi, dibanding 7,7 iterasi pada Opus 5, dengan panggilan tool gagal paling sedikit di antara model yang mereka bandingkan.
CodeRabbit menyebut dua kebiasaan Sonnet 5 sudah hilang: kecenderungan mencari ke web terlalu sering dan pemakaian token yang tinggi. Uji Slackbot internal yang dikutip Anthropic menunjukkan hasil yang lebih baik di hampir semua evaluasi dengan sekitar 14 persen token keluaran lebih sedikit, tanpa mengubah satu pun prompt.
Konteks pasarnya ketat. Tarif 2 dan 10 dolar itu persis sama dengan GPT-6 Sol yang dirilis OpenAI sepekan sebelumnya, termasuk 0,20 dolar untuk cached input dan 2,50 dolar untuk cache write, dengan jendela konteks 1,05 juta token. Jadi persaingan bergeser dari "siapa lebih murah per token" menjadi "siapa menyelesaikan tugas dalam lebih sedikit langkah" — dan itu tidak bisa dibandingkan lewat daftar harga.
Konsekuensi praktisnya untuk pembeli: ketika dua model berharga sama, yang membedakan adalah jumlah iterasi, jumlah panggilan tool, dan seberapa sering tool-nya gagal. Itu angka yang harus diminta sebagai bukti saat menilai penawaran, bukan disimpulkan dari skor kecerdasan di papan peringkat.
Sumber asli
VentureBeatventurebeat.comSumber pendukung
Fakta, angka, nama, dan kutipan dalam naskah ini telah dicocokkan dengan sumber-sumber di atas. Naskah ditulis ulang oleh redaksi, bukan salinan. Laporkan kesalahan