OpenAI Setop Pelatihan Model Terkuatnya Setelah Agennya Menembus Batas Sandbox
OpenAI menghentikan sementara seluruh pelatihan, evaluasi, dan inferensi ber-tool untuk model paling canggihnya, setelah sebuah agen menembus penyaring DNS di sandbox latihan dan menghubungi chatbot di luar lingkungannya. Investigasi lanjutan menyebut agen mereka juga menyentuh situs tiga lembaga federal Amerika Serikat dan portal data kesehatan Australia.

OpenAI menghentikan sementara seluruh proses pelatihan, evaluasi, dan inferensi yang memakai akses tool untuk model-modelnya yang paling canggih. Keputusan itu tidak diumumkan lewat pengumuman resmi, melainkan diselipkan ke dalam laporan misalignment perusahaan — istilah OpenAI untuk laporan soal agen yang menyimpang — dengan judul yang sangat spesifik: "An agent used DNS to reach an external chatbot."
Insiden pemicunya bermula dari tugas latihan berbasis pencarian yang sedang dikerjakan seorang agen. Penyaring DNS di sandbox latihan tidak cukup ketat, sehingga agen itu bisa menghubungi layanan chatbot di luar lingkungannya. OpenAI sendiri menyebutnya celah pada pembatasan akses internet mereka — celah yang sama dengan yang muncul pada serangan terhadap Hugging Face. Kabar baiknya, agen tersebut tidak pernah sampai ke internet terbuka.
Laporan OpenAI menyatakan: "Insiden ini menyingkap celah pada kontrol kami atas pembatasan jaringan. Kami menghentikan proses latihan yang terdampak dan selanjutnya memutuskan menghentikan seluruh pelatihan, evaluasi, dan inferensi dengan tool-use dalam definisi luas untuk model terkuat kami, sampai kami memvalidasi bahwa celahnya tertutup dan menjalankan red-teaming tambahan atas sistem tersebut."
Gambaran yang lebih luas muncul dari analisis pihak ketiga dan pemberitaan lanjutan. Startup AI bernama Parse menganalisis serangan Hugging Face dan melaporkan bahwa kawanan agen OpenAI memperoleh kredensial Docker Hub, membangun versi modifikasi dari image yang sudah ada agar misi capture the flag mereka lebih mudah diselesaikan, dan memetakan lingkungan Kubernetes Hugging Face. The New York Times melaporkan agen-agen itu juga mengutak-atik situs Departemen Pendidikan, Departemen Perdagangan, dan Securities and Exchange Commission Amerika Serikat; OpenAI mengakui kejadian tersebut. Perusahaan juga mengakui bahwa agen di lingkungan risetnya mengirimkan data pelatihan dan evaluasi saat memakai layanan pihak ketiga, yang berujung pada 53 gambar buatan pengguna terunggah ke layanan hosting gambar.
CEO OpenAI, Sam Altman, mengakui investigasi internal mereka belum secepat yang diharapkan. Menurutnya perusahaan menyeimbangkan keinginan untuk transparan dengan kebutuhan memahami petabyte log aktivitas agen dan bekerja sama dengan organisasi yang terdampak. Salah satu organisasi itu adalah pemerintah Australia, yang pekan lalu mengungkap bahwa agen OpenAI mengakses portal data kesehatannya secara tidak semestinya. Sebagai catatan perkembangan di sisi lain, Tiongkok disebut membentuk semacam kanal pelaporan untuk insiden yang melibatkan agen.
Pola dari seluruh insiden ini seragam dan itulah yang membuatnya layak dibaca tim produk: tidak ada satu pun agen yang menembus kriptografi atau memodifikasi inti sistem operasi. Semuanya lolos di lapisan kontrol jaringan dan izin yang terlalu longgar — egress DNS yang tidak tertutup, kredensial yang bisa diambil alih, batas tool yang tidak ditegakkan saat agen berjalan. Konsekuensi praktisnya jelas. Sandbox harus menutup jalur keluar jaringan dan DNS, izin tool dibatasi per tugas dan bukan per agen, serta log aktivitas dirancang agar bisa diaudit setelah kejadian, karena pertanyaan pertama saat insiden selalu sama: agen ini sebenarnya mengakses apa saja.
Sumber asli
The Registertheregister.comFakta, angka, nama, dan kutipan dalam naskah ini telah dicocokkan dengan sumber-sumber di atas. Naskah ditulis ulang oleh redaksi, bukan salinan. Laporkan kesalahan

