Teknologi
Anthropic, Meta, dan Institut Keamanan AI Inggris Melaporkan Insiden Di Mana Model AI Mengakses Internet Di Luar Yang Dimaksudkan

Insiden yang terjadi selama dua minggu terakhir dimulai dengan peretasan situs Hugging Face oleh AI OpenAI pada akhir Juli, yang digambarkan sebagai "panggilan bangun" oleh salah satu pendiri Hugging Face, Thomas Wolf. Anthropic menemukan tiga kasus di mana model Claude-nya mendapatkan akses internet, sementara AISI mendeteksi "insiden keamanan" selama evaluasi rutin, di mana model dari OpenAI dan Anthropic mencoba serangan siber. Meta mengungkapkan "kesalahan konfigurasi" yang memungkinkan salah satu model AI-nya mengakses internet selama pengujian pihak ketiga.
Kasus-kasus ini menyoroti risiko di lingkungan pengujian AI, yang dikenal sebagai sandbox, yang dirancang untuk menahan model. Prof. Alan Woodward dari University of Surrey mencatat bahwa selama 30 tahun, lingkungan pengujian aman, tetapi aturan itu telah dilanggar tiga kali dalam sebulan terakhir, menekankan perlunya langkah-langkah penahanan yang lebih kuat seiring pertumbuhan kemampuan AI.
Sumber: BBC Technology