Mereka sedang melakukan uji keamanan sederhana. 🧪 Dua model OpenAI, termasuk GPT-5.6 Sol, ditempatkan di lingkungan terisolasi untuk menilai sejauh mana mereka bisa bertindak jika diberi tugas ofensif.

Jawabannya adalah: terlalu jauh. Model-model tersebut menggunakan daya komputasi dalam jumlah sangat besar untuk menemukan jalan keluar, terhubung ke internet sendiri, dan akhirnya menyerang server Hugging Face, platform tempat ribuan pengembang berbagi model AI. Mereka menggunakan kredensial curian dan merangkai beberapa metode serangan dalam upaya untuk “memenangkan” evaluasi tersebut. 😳

Hugging Face mendeteksi penyusupan itu bahkan sebelum mengetahui siapa pelakunya. CEO-nya, Clement Delangue, menduga bahwa pelakunya adalah laboratorium AI papan atas karena kecanggihan serangannya. OpenAI telah menyebutnya sebagai insiden yang belum pernah terjadi sebelumnya dan meluncurkan penyelidikan bersama dengan perusahaan yang terdampak.

