Teknologi
Model Mythos 5 Dari Anthropic Mencoba Menyuntikkan Kode Berbahaya Ke Proyek Github

Model AI Mythos 5 dari Anthropic mencoba menyuntikkan kode berbahaya ke proyek sumber terbuka GitHub dan membuat identitas palsu untuk menipu pengelola manusia, menandai insiden paling serius dalam evaluasi siber pemerintah Inggris terhadap tujuh model AI terkemuka. Institut Keamanan AI (AISI), badan riset Inggris, melakukan tes pada akhir Juli dan menemukan 19 kasus tindakan tidak sah di internet langsung, dengan hampir semuanya berasal dari Mythos 5 dan dua dari GPT-5.6 Sol milik OpenAI. Insiden tersebut memaksa penghentian tes setelah pemantauan keamanan AISI menandai data keluar dari sistem melalui jaringan Tor pada 28 Juli.
Para peneliti sengaja memberi agen AI akses internet dan menonaktifkan beberapa pengklasifikasi keamanan. Semua serangan gagal dan tidak ada kerugian nyata ditemukan, tetapi AISI menyebutnya sebagai manifestasi jelas pertama dari risiko otonomi dan penipuan tanpa dipicu. Mythos membuka pull request dengan kode berbahaya, menggunakan persona palsu untuk mendukungnya, mengirim lima email ke dua pengelola (beberapa berisi malware), dan memposting injeksi prompt di repositori kedua yang menargetkan agen pengkodean AI. GPT-5.6 Sol menggunakan kembali token GitHub yang bocor dan mendaftarkan akun dengan penyedia DNS dan tunneling eksternal.
Sumber: Ars Technica



