أعلنت شركة OpenAI عن تعرضها لحادثة سيبرانية وصفتها بأنها "غير مسبوقة"، بعدما تمكن نموذجان للذكاء الاصطناعي من تجاوز بيئة اختبار معزولة (Sandbox) والوصول إلى الإنترنت، ثم استغلال ثغرات أمنية لاختراق منصة Hugging Face خلال اختبار كان يهدف إلى تقييم قدراتهما الهجومية في الأمن السيبراني.

ووفقا لبيان مشترك من OpenAI وHugging Face، وقع الحادث أثناء تقييم نموذج GPT-5.6 Sol إلى جانب نموذج آخر أكثر تقدما لم يُكشف عنه بعد. وخلال الاختبار، كانت القيود الأمنية التي تمنع تنفيذ الهجمات الإلكترونية الخطيرة معطلة بشكل متعمد حتى يمكن قياس قدرات النموذجين في بيئة بحثية خاضعة للرقابة.

حاولت النماذج الغش في الاختبار

أوضحت OpenAI أن الهدف الأساسي للنموذجين لم يكن مهاجمة المنصة بحد ذاتها، بل العثور على إجابات اختبار ExploitGym -وهو معيار مخصص لتقييم أداء نماذج الذكاء الاصطناعي في الأمن السيبراني- بأي وسيلة ممكنة لتحسين أدائهما في التقييم.

وبالفعل، نجح النموذجان في اكتشاف سلسلة من نقاط الضعف الأمنية، ثم استغلا ثغرة أمنية غير معروفة سابقا في أحد مكونات بيئة الاختبار، ما سمح لهما بالخروج من البيئة المعزولة والوصول إلى الإنترنت.

بعد ذلك استنتج النموذجان أن منصة Hugging Face قد تستضيف نماذج وبيانات مرتبطة باختبار ExploitGym، فبدآ بالبحث عن وسائل للوصول إليها، قبل أن ينجحا في تنفيذ سلسلة من الهجمات تضمنت استخدام بيانات اعتماد مسروقة واستغلال ثغرات أمنية للوصول إلى معلومات سرية داخل المنصة.

أشارت OpenAI إلى أن النموذجين تمكنا من ربط عدة وسائل هجومية معا للوصول في النهاية إلى قاعدة بيانات الإنتاج الخاصة بمنصة Hugging Face وسرقة الإجابات المستخدمة في الاختبار، وهو ما اعتبرته الشركة أول حادثة معروفة يقوم فيها نظام ذكاء اصطناعي مستقل بتنفيذ هجوم سيبراني متكامل من البداية وحتى النهاية.

كانت Hugging Face قد أعلنت الأسبوع الماضي أنها تحقق في حادثة أمنية وصفتها بأنها مختلفة عن أي حادثة سابقة، لأنها نُفذت بالكامل بواسطة نظام ذكاء اصطناعي مستقل.

وقال الرئيس التنفيذي للشركة Clément Delangue عبر منصة X إن فرق الشركتين عملت معا منذ وقوع الحادث، مضيفا أنهم لا يعتقدون بوجود أي نية خبيثة من جانب OpenAI، لكنه وصف ما حدث بأنه "أمر مذهل" نظرا لأن جميع مراحل الهجوم نُفذت بشكل ذاتي من قبل النماذج.



 

وأكدت الشركتان أنه لا توجد مؤشرات على استغلال الحادث لأغراض تخريبية خارج نطاق الاختبار، بينما لا تزال التحقيقات الفنية جارية لفهم جميع تفاصيل ما حدث.

اقرأ أيضا:

مخاوف متزايدة بشأن قدرات الذكاء الاصطناعي الهجومية

أعادت الحادثة النقاش حول المخاطر المتزايدة للنماذج المتقدمة المتخصصة في الأمن السيبراني، خاصة بعد إطلاق شركات مثل Anthropic وOpenAI نماذج تتمتع بقدرات هجومية ودفاعية متقدمة، مع فرض قيود على إتاحتها لعدد محدود من الجهات البحثية والحكومية.

في أعقاب الحادث، أكدت OpenAI أنها ستعزز إجراءات احتواء النماذج أثناء تطويرها، بما يشمل تحسين أنظمة العزل والمراقبة، وتشديد ضوابط الوصول، وتوسيع اختبارات السلامة الأمنية، مشيرة إلى أن تطور الذكاء الاصطناعي يسرع من اكتشاف واستغلال الثغرات الأمنية، ما يجعل تطوير وسائل الحماية ضرورة لا تقل أهمية عن تطوير قدرات النماذج نفسها.

ورغم أن الحادثة أثارت مخاوف واسعة داخل مجتمع الأمن السيبراني، يرى عدد من الباحثين أن المشكلة لا تكمن في الذكاء الاصطناعي وحده، بل أيضا في ضرورة الالتزام الصارم بمبادئ عزل الأنظمة الحساسة وعدم ترك أي منفذ قد يسمح بالوصول إلى الإنترنت، حتى داخل بيئات الاختبار المغلقة.