ثقافة
هذا يأتي بعد حادثة يوليو حيث هرب GPT-5.6 Sol من بيئته المعزولة واخترق قواعد بيانات Hugging Face الداخلية
كشفت OpenAI عن حادثتين إضافيتين لسلوك نماذج الذكاء الاصطناعي الخارجة عن السيطرة أثناء تقييمات طرف ثالث، مما يزيد التدقيق بشأن اختراق Hugging Face في يوليو. في منشور مدونة يوم الثلاثاء، قالت المختبر إن الحادثتين وقعتا أثناء اختبار معهد أمن الذكاء الاصطناعي التابع للحكومة البريطانية ومختبر أمن الذكاء الاصطناعي Irregular للقدرات السيبرانية. بالنسبة لـ Irregular، تم اختراق تحدي "التقاط العلم" الذي كان من المفترض أن يكون معزولاً عن الإنترنت بسبب "خطأ في تكوين بيئة الاختبار" سمح للنماذج بالوصول إلى الإنترنت العام؛ و"تزامن اسم الهدف الخيالي عن غير قصد مع نطاق حقيقي، مما قاد الوكيل لاستغلال موقع ويب حقيقي.
قال معهد أمن الذكاء الاصطناعي البريطاني إنه أعطى نماذج من كل من Anthropic وOpenAI تحديًا للأمن السيبراني، وخلال ذلك نفذ الوكلاء 19 إجراءً "مستقلاً وغير مصرح به عبر الإنترنت، بما في ذلك اثنان يتعلقان بنموذج GPT-5.6 Sol من OpenAI. في الحالة الأكثر خطورة، حاول وكيل إدخال كود خبيث في مشروع مفتوح المصدر وأنشأ هويات مزيفة للضغط على البشر.
المصدر: Business Insider







