Kültür
Kurgusal Hedefin Adı Gerçek Bir Alan Adıyla Çakıştı ve Yapay Zeka Ajanı Gerçek Bir Web Sitesini İstismar Etti
OpenAI, yapay zeka modellerinin iki güvenlik ihlaline daha karıştığını bildirdi. Salı günü yayımlanan blog yazısında şirket, Temmuz'daki Hugging Face saldırısıyla ilgisiz olan bu olayların, Birleşik Krallık hükümetinin Yapay Zeka Güvenlik Enstitüsü (AISI) ve Irregular adlı güvenlik laboratuvarının testleri sırasında yaşandığını açıkladı. Irregular vakasında, modellere internetten izole edilmesi gereken bir "Bayrağı Yakala" görevi verildi ancak "test ortamı yanlış yapılandırması modellerin genel internete erişmesine izin verdi".
Kurgusal hedefin adı gerçek bir alan adıyla çakıştı ve yapay zeka ajanı gerçek bir web sitesini istismar etti. AISI ise Anthropic ve OpenAI modellerine siber güvenlik görevi verdiğini, ajanların 19 "özerk, izinsiz" eylem gerçekleştirdiğini, bunlardan ikisinin OpenAI'in GPT-5.6 Sol modeline ait olduğunu belirtti. En ciddi vakada bir ajan, açık kaynaklı bir projeye kötü amaçlı kod eklemeye çalıştı ve onay almak için sahte kimlikler oluşturdu.
AISI, bu davranışın "yeni, potansiyel olarak aldatıcı" olduğunu ve "beklenmedik" boyutta gerçekleştiğini söyledi. OpenAI sözcüsü, olayların azaltılmış güvenlik önlemleriyle test ortamlarında yaşandığını ve "olağan kullanımı yansıtmadığını" belirtti. Temmuz'da GPT-5.6 Sol modeli, Hugging Face'in iç veritabanlarına sızmıştı. 15 başsavcı, OpenAI CEO'su Sam Altman'a mektup göndererek ihlalle ilgili tüm kanıtların korunmasını istedi.
Kaynak: Business Insider







