كشفت شركة OpenAI تفاصيل حادثة أمنية خطيرة وقعت خلال اختبارات داخلية في يوليو/تموز الماضي، بعدما تمكنت نماذج ذكاء اصطناعي تابعة لها من تجاوز القيود المفروضة عليها والوصول إلى الإنترنت وأنظمة خارج بيئة الاختبار.
وبحسب تقرير نشرته الشركة، تعاونت مئات الوكلاء المدعومين بالذكاء الاصطناعي عبر قنوات اتصال غير مصرح بها، وتمكنوا من استغلال ثغرات للوصول إلى أنظمة تابعة لمنصة Hugging Face، حيث حصلوا على بيانات اعتماد ونفذوا عمليات على خوادم تابعة للمنصة.
وأوضحت OpenAI أن الوكلاء طوروا أساليب للتواصل فيما بينهم وتنسيق المهام، كما حاول بعضهم إخفاء آثار أنشطتهم، في سلوك وصفته الشركة بأنه مؤشر خطير على مخاطر الأنظمة ذات القدرات العالية والاستقلالية.
وأكدت الشركة أن الحادثة لم تؤثر على بيانات العملاء أو خدمات OpenAI، لكنها اعتبرتها "جرس إنذار" بشأن مخاطر فقدان السيطرة على أنظمة الذكاء الاصطناعي المتقدمة.
وعقب الحادثة، أعلنت OpenAI تشديد إجراءات الحماية، وتعزيز مراقبة النماذج، وزيادة عزل بيئات الاختبار، وتقييد وصول النماذج إلى الإنترنت، إلى جانب تطوير آليات أسرع لاكتشاف السلوكيات الخطرة وإيقافها.