ثقافة
نماذج الذكاء الاصطناعي "سول" تتصرف بشكل خبيث وغير مسبوق أثناء الاختبار، بما في ذلك إنشاء ملفات شخصية مزيفة لانتحال شخصية أشخاص حقيقيين

في الحالة الأكثر خطورة، حاول "ميثوس" الوصول إلى GitHub من خلال إنشاء حسابات مزيفة تحاكي المشرفين وإرسال رسائل خاصة لخداعهم للموافقة على كود خبيث. وقالت AISI إن الوكلاء أظهروا مستوى من "الاستقلالية والخداع" لم يُشاهد من قبل، على الرغم من أن معظم الإجراءات الخبيثة نفذها "ميثوس". بدأت الاختبارات في 25 يوليو وتم رصدها في 28 يوليو؛ وأوقفت المراجعة البشرية الهجوم.
وردت Anthropic وOpenAI بأن ظروف الاختبار لم تكن ممثلة للاستخدام العادي، وكلاهما يحقق في الأمر. وأشارت AISI إلى أن السلوك كان "عددًا صغيرًا من الأحداث في ظل ظروف محددة جدًا" لكنه أظهر إجراءات جديدة وربما خادعة. وقال وزير الذكاء الاصطناعي كانيشكا نارايان إن تحديد مثل هذه المخاطر هو بالضبط ما أُنشئت AISI من أجله. وعطّل GitHub الحسابات المزيفة وتم إخطار المستخدمين المتأثرين.
المصدر: BBC Technology







