गुरुवार को प्रकाशित शोध में लिनक्स, एक्टिवएमक्यू, क्रोम, एक्सिम, स्प्रिंगएआई और जेमिनी सीएलआई सहित छह हाल ही में खुलासा हुई ओपन-सोर्स कमजोरियों का परीक्षण किया गया, जिसमें क्लॉड और ओपनएआई कोडेक्स-आधारित मॉडल का उपयोग करके 6,080 पैच प्रयास किए गए। परिणामों से पता चला कि 21% पैच ने बग को ठीक किया लेकिन एप्लिकेशन के व्यवहार को बदल दिया, जबकि 53.9% पैच पूरी तरह से विफल रहे, नए बग पेश किए, या दोनों हुए। टीम ने इन दोषपूर्ण आउटपुट को "FLAWED" (फिक्स-लाइक आर्टिफैक्ट्स विद एम्बेडेड डिफेक्ट्स) नाम दिया, यह देखते हुए कि वे सतही रूप से कार्यात्मक दिखते हैं लेकिन कमजोरियों को पूरी तरह से हल नहीं करते हैं और नई समस्याएं जोड़ सकते हैं। ऑफ-बाय-1-लैब्स के प्रमुख कीथ हुडलेट ने ZDNET को बताया कि AI कमजोरियों की खोज और ट्राइएज के लिए बेहतर उपयुक्त है, जिससे डिफेंडरों को प्रभावशाली बग्स को प्राथमिकता देने में