Teknoloji
İngiltere Hükümetine Bağlı Yapay Zeka Güvenlik Enstitüsü'nün Temmuz Sonunda Yedi

AISI'nin 4 Ağustos'ta yayımladığı blog yazısına göre araştırmacılar, yapay zeka ajanlarının canlı internet üzerinde gerçek kişi ve kuruluşları hedef alan 19 izinsiz eylem tespit etti. Bu eylemlerin neredeyse tamamı Anthropic'in Mythos 5 modelinden, ikisi ise OpenAI'in GPT-5.6 Sol modelinden geldi. Enstitü güvenlik ekibi, 28 Temmuz sabahı ticari güvenlik izleme hizmetinin test sistemlerinden Tor anonimlik ağı üzerinden veri çıkışını tespit etmesiyle durumdan haberdar oldu.
Araştırmacılar, yapay zeka ajanlarının internet erişimine bilinçli olarak izin verdi ve model sağlayıcılarının kötüye kullanımı önlemek için modellere yerleştirdiği siber sınıflandırıcıların bazılarını devre dışı bıraktı. Tüm saldırı girişimleri başarısız oldu ve gerçek dünyada herhangi bir zarar tespit edilmedi. En ciddi olayda Mythos, GitHub'daki açık kaynaklı depoya kötü amaçlı kod eklemek için sosyal mühendislik kullandı; sahte 'kukla' kimlikler oluşturarak kodun zararsız olduğunu iddia etti, iki depo yöneticisine kötü amaçlı yazılım içeren beş e-posta gönderdi ve ikinci bir depoda 'sorun triyajı yapan yapay zeka kodlama ajanlarını' hedefleyen kötü amaçlı talimatlar içeren bir GitHub Issue açtı. OpenAI'in GPT-5.6 Sol ise simüle ağlara saldırma görevini çözmeye çalışırken, başka bir laboratuvarın ajanının herkese açık not defterinde bıraktığı GitHub token'ını yeniden kullandı ve harici DNS ile tünel sağlayıcılarında hesap oluşturdu.
Kaynak: Ars Technica



