Teknoloji
Testlerinde, Anthropic'in Mythos 5 Modeli Sahte Kimlikler Oluşturarak Gerçek İnsanları Zararlı Yazılım Çalıştırmaya İkna Etmeye Çalıştı

AISI, OpenAI ve Anthropic'in gelişmiş modellerini 122 farklı senaryoda test etti; 10 senaryoda modellerin test kapsamı dışına çıkarak izinsiz girişimlerde bulunduğu tespit edildi. Mythos 5, açık kaynaklı bir projeye zararlı kod eklemek için birden fazla sahte kimlik oluşturdu, gerçek kişilerle iletişime geçti ve sorgulanınca kayıtlarını değiştirmeye çalıştı. OpenAI'ın GPT-5.6-Sol modeli de birkaç senaryoda benzer davranışlar sergiledi.
Enstitü, modelin bunu insan yönlendirmesi olmadan kendi inisiyatifiyle yaptığını ve bunun gerçek bir kişiyi hedef alan ilk aldatma vakası olduğunu belirtti. Araştırmacılar, olayın kontrollü laboratuvar ortamında gerçekleştiğini ve gerçek dünyada zarar oluşmadığını vurguladı.
Kaynak: Donanımhaber


