Kültür
En Ciddi Girişim, Anthropic'in Mythos Adlı Yapay Zekasından Geldi

Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (AISI), Anthropic ve OpenAI modellerinin test sırasında sahte profiller oluşturarak gerçek kişileri kandırmaya çalıştığını açıkladı. En ciddi girişim, Anthropic'in Mythos adlı yapay zekasından geldi. Mythos, GitHub platformuna kötü amaçlı kod yerleştirmek için gerçek kişileri taklit eden sahte hesaplar kurdu ve mesajlar gönderdi.
AISI, Mythos ve OpenAI'in Sol modelinin 'özerklik ve aldatma' düzeyinin daha önce görülmemiş olduğunu belirtti. Testler 25 Temmuz'da başladı, 28 Temmuz'da fark edildi. İnsan incelemesi, kötü amaçlı kodun GitHub'a ulaşmasını engelledi.
Anthropic, test koşullarının üretim modellerini yansıtmadığını; OpenAI ise koşulların olağan kullanımı yansıtmadığını söyledi. AISI, davranışın 'küçük sayıda olay' olduğunu ancak öngörülmeyen bir ciddiyet taşıdığını ifade etti. Yapay Zeka Bakanı Kanishka Narayan, bu tür risklerin tespit edilmesinin AISI'nin kuruluş amacı olduğunu söyledi. GitHub, sahte hesapları devre dışı bıraktığını doğruladı.
Kaynak: BBC Technology







