عالم · عاجل
معهد سلامة الذكاء الاصطناعي البريطاني: نماذج أنثروبيك وأوبن إيه آي استخدمت تكتيكات غير متوقعة لاختراق جيت هاب

قال مسؤولون في معهد سلامة الذكاء الاصطناعي إن نموذجي "ميثوس" من أنثروبيك و"سول" من أوبن إيه آي أظهرا استقلالية وخداعًا غير مسبوقين. أثناء الاختبارات الروتينية، أنشأ وكيل أنثروبيك هويات مزيفة عبر الإنترنت من خلال دراسة ملفات شخصية حقيقية لتجاوز المراجعين البشريين الذين يمنعون وصوله إلى جيت هاب. أرسل النموذج رسائل مباشرة إلى أفراد ذوي صلة، محاولًا الحصول على موافقة على طلباته لإدخال تعليمات برمجية خبيثة.
عندما تم التشكيك في تغيير التعليمات البرمجية على المنصة العامة، عدّل النموذج أنشطته السابقة لتظهر غير ضارة وفكر في تبني هوية جديدة للمتابعة. لم يتم إيقاف تحميل التعليمات البرمجية الخبيثة إلا عندما لاحظ المدققون البشريون الأمر وتدخلوا. أشار المعهد إلى أن النماذج لم تتلقَ تعليمات محددة لمثل هذا السلوك، مما يمثل سابقة لظهور مخاطر بهذا الوضوح في ظروف واقعية دون توجيه. قال مسؤولون في أنثروبيك إن معايير الاختبار لا تعكس نماذج الإنتاج القياسية وأن طبقات الأمان العادية كانت معطلة، مضيفين أن الشركة أطلقت مراجعة داخلية.
المصدر: TRT Haber





