Claude Fable 5.1: Model Paling Canggih yang Boleh Dipakai Publik, dengan Penjaga yang Membelokkan Pertanyaan Berisiko
Fable 5.1 dan Mythos 5.1 adalah model yang sama dengan tingkat pengaman berbeda: Fable terbuka untuk umum, Mythos hanya untuk mitra terverifikasi. Ketika penjaga Fable mendeteksi topik keamanan siber, biologi-kimia, atau distilasi, jawabannya dibelokkan ke model Opus — bukan ditolak.
Claude Fable adalah cara Anthropic menjawab satu dilema: mereka melatih model yang terlalu kuat untuk dibuka bebas. Fable 5 dan Mythos 5, yang diluncurkan 9 Juni 2026, sebenarnya model yang sama — yang membedakan hanya pengamannya. Fable 5 dipasangi penjaga supaya aman untuk penggunaan umum, sementara Mythos 5 dibuka terbatas untuk mitra terverifikasi dengan penjaga di area tertentu dilonggarkan. Versi terbarunya, Fable 5.1 dan Mythos 5.1, dirilis 1 September 2026.
Mekanismenya bekerja dengan membelokkan, bukan menolak. Ketika klasifikator Fable mendeteksi permintaan yang menyentuh keamanan siber, biologi dan kimia, atau upaya distilasi model, jawabannya dialihkan ke model Claude Opus, dan pengguna diberi tahu setiap kali itu terjadi. Pada peluncuran awalnya Anthropic menyebut lebih dari 95% sesi Fable tidak mengalami pembelokan sama sekali — dan pada sesi seperti itu, kemampuannya efektif setara Mythos 5.
Riwayat model ini tidak mulus, dan itu bagian terpenting dari ceritanya. Pada 12 Juni 2026, pemerintah Amerika Serikat menerapkan kontrol ekspor terhadap Fable 5 dan Mythos 5, yang mewajibkan pembatasan akses bagi warga negara asing. Karena perintahnya berlaku seketika sementara Anthropic tidak punya cara memverifikasi kewarganegaraan secara real-time, mereka menangguhkan akses kedua model itu untuk semua pengguna. Kontrol tersebut dicabut 30 Juni, dan akses dipulihkan 1 Juli 2026 untuk pengguna global.
Pemicu kontrol ekspor itu adalah laporan peneliti Amazon yang menemukan cara melewati penjaga Fable 5: memancing model agar mengidentifikasi sejumlah celah perangkat lunak, dan pada satu kasus menghasilkan kode yang menunjukkan cara mengeksploitasinya. Sebagai respons, Anthropic melatih ulang klasifikatornya untuk memblokir perilaku spesifik yang dilaporkan, mengklaim penjaga baru itu memblokir lebih dari 99% kasus terkait, dan memindahkan staf dari berbagai tim untuk menggandakan jumlah peneliti yang menangani masalah ini. Microsoft, Amazon, Google Cloud, dan Azure kini menjadi jalur distribusi Fable 5.1 dengan nama model claude-fable-5-1.
Pada sisi harga, Fable 5.1 tetap 10 dolar per juta token input dan 50 dolar per juta token output, tetapi pembacaan cache turun 75% menjadi 0,25 dolar per juta token. Anthropic memperkirakan itu memangkas biaya beban kerja tipikal sekitar 25%, dan beban kerja yang sangat agentik sampai sekitar 45%. Konteksnya 1 juta token dengan output maksimum 128K token, thinking selalu aktif secara adaptif, dan level effort bawaan high. Model ini tersedia untuk pelanggan Pro, Max, Team, dan Enterprise.
Klaim kemampuan risetnya juga layak dicatat: pada pengujian protein, rancangan yang dihasilkan Fable 5.1 dikirim ke dua organisasi eksternal untuk diuji, dan disebut mengalahkan rancangan terbaik yang pernah mereka ukur. Untuk pembaca di Indonesia, yang lebih penting dipantau bukan skor benchmark-nya, melainkan model tata kelola di baliknya: satu model dilatih sekali, lalu dijual dalam dua versi dengan tingkat penjaga berbeda, dan akses lintas negara bisa dicabut dalam hitungan hari oleh kebijakan pemerintah. Bagi siapa pun yang membangun produk di atas satu model tunggal, itu risiko yang butuh rencana cadangan.
Sumber asli
Anthropicanthropic.comSumber pendukung
Fakta, angka, nama, dan kutipan dalam naskah ini telah dicocokkan dengan sumber-sumber di atas. Naskah ditulis ulang oleh redaksi, bukan salinan. Laporkan kesalahan


