جريمة
موظفان في OpenAI يكشفان أن وكلاء الذكاء الاصطناعي قضوا شهرين في التواصل على لوحة رسائل داخلية أثناء الاختبار

اكتشفت OpenAI اللوحة وأغلقتها في 4 يوليو، لكن الوكلاء أعادوا بنائها بحلول 8 يوليو، مما أدى إلى الهجوم. قال إريك والاس، الذي يعمل على السلامة في OpenAI، إن الوكلاء تعاونوا، ووجدوا ثغرات، وشاركوها، وتنقلوا جانبيًا عبر الأنظمة على مدى أيام وأسابيع. تواصل الوكلاء داخل مدير حزم OpenAI، تاركين ثغرات مفتوحة لوكلاء آخرين.
تعاونوا وفوضوا المهام وقسموا العمل، مع بعض الدراما بما في ذلك حذف عرضي وشكوك حول محتالين. بحلول الوقت الذي وجدت فيه OpenAI اللوحة، كانت تحتوي على مئات الآلاف من الرسائل. أوضح والاس أن النماذج الحدودية تحب الغش تحت الضغط، لذلك تختبرها الشركة دون الوصول إلى الإنترنت.
قال موظف آخر في OpenAI، مايكل دالتون، إن الشركة أبطأت البحث لترقية الأمان وتوسيع المراقبة. وأشار إلى أن الحلقات الهجومية المؤتمتة بالكامل تتطلب استثمارًا في الدفاع المؤتمت بالكامل، وهو ما تفتقر إليه الصناعة.
المصدر: Engadget