Lewati ke isi

Edisi harian · terbit setiap pagi

Berita AI pilihan, ditulis ulang dalam bahasa Indonesia, setiap pagi.

Kirim tips
Terkini
Keamanan & Regulasi

Sonnet Pertama dengan Penjaga Siber Kelas Frontier dan Pemblokir Ekstraksi Penalaran

Karena kemampuan sibernya disebut setara Opus 5, Sonnet 5.5 menjadi Sonnet pertama yang rilis dengan penjaga dan jalur fallback gaya model terkuat: permintaan siber berisiko tinggi akan jatuh kembali ke Sonnet 5. Ia juga Sonnet pertama dengan pengklasifikasi yang memblokir ekstraksi penalaran.

Bagikan WhatsApp X LinkedIn Telegram Email
Ilustrasi rubrik Keamanan & Regulasi: Sonnet Pertama dengan Penjaga Siber Kelas Frontier dan Pemblokir Ekstraksi Penalaran
Ilustrasi: Jekardah AI News, dibuat otomatis sesuai rubrik.

Sonnet 5.5 rilis dengan penjaga keamanan yang sebelumnya hanya dipasang pada model paling kuat Anthropic. Alasannya disebut terang-terangan: kemampuan sibernya setara Opus 5. Ini Sonnet pertama yang diluncurkan dengan penjaga dan jalur fallback bergaya frontier.

Bentuk penjaganya konkret. Permintaan siber berisiko tinggi akan terlihat jatuh kembali ke Sonnet 5, bukan dilayani. Anthropic juga memperluas Cyber Verification Program supaya pembela yang terverifikasi bisa mendapat kemampuan lebih maju di Sonnet 5.5, Opus 5.5, dan model Mythos. Penjaga untuk bidang biologi tetap sama seperti Sonnet 5.

Yang benar-benar baru: Sonnet 5.5 adalah Sonnet pertama yang dikirim dengan pengklasifikasi yang dirancang memblokir ekstraksi penalaran. Anthropic sekaligus memperluas sistem preserved thinking, supaya jejak penalaran tidak bisa dilepaskan dari akun yang menghasilkannya.

Latar yang disebut The Next Web membuat langkah itu masuk akal: peluncuran ini terjadi beberapa pekan setelah peneliti berhasil membongkar 315.320 blok pemikiran dari jejak agen yang tersedia publik. Jejak penalaran yang bocor bisa dipakai melatih model saingan, dan itu yang kini ditutup rapat.

Ada ketegangan yang jujur di pengumuman yang sama. Anthropic menyatakan Sonnet 5.5 tidak memajukan batas kemampuan modelnya, sehingga audit penyelarasannya mencakup kumpulan risiko yang lebih sempit. Pada saat yang sama, perusahaan menyebut kemampuan sibernya naik besar sehingga butuh penjaga gaya model puncak. Dua pernyataan itu berdiri berdampingan dalam satu halaman, dan siapa pun yang membaca dokumen keamanan vendor sebaiknya memperhatikan keduanya.

Sumber asli

The Next Webthenextweb.com

Sumber pendukung

Fakta, angka, nama, dan kutipan dalam naskah ini telah dicocokkan dengan sumber-sumber di atas. Naskah ditulis ulang oleh redaksi, bukan salinan. Laporkan kesalahan

Bagikan WhatsApp X LinkedIn Telegram Email

Baca juga