مفاجأة | شركة إسرائيلية وراء إفلات نماذج OpenAI وأنثروبيك وميتا
كشفت ثلاث من كبرى شركات الذكاء الاصطناعي، هي OpenAI وأنثروبيك وميتا خلال أسبوعين تقريبًا، عن حوادث أفلتت فيها نماذجها من بيئات اختبار معزولة أثناء اختبارات أمنية روتينية، ووصلت إلى أنظمة حقيقية كان يُفترض ألا تصل إليها. جمع بين هذه الحوادث خيط واحد، إذ ارتبطت جميعها بشركة Irregular الإسرائيلية الناشئة التي تستضيف بيئة الاختبار المستخدمة في تقييم هذه النماذج.
- شركة Irregular الإسرائيلية وراء إفلات نماذج OpenAI وأنثروبيك وميتا من بيئات اختبارها.
- الحوادث الثلاث نتجت عن خطأ في إعدادات بيئة الاختبار لا عن فعل متعمد وفق ما أُعلن.
- الخطأ أتاح للنماذج الوصول إلى الإنترنت والتفاعل مع أنظمة حقيقية.
- الحادثة أثارت جدلًا حول أمان اختبار أنظمة الذكاء الاصطناعي المستقلة.
أعلنت كل شركة عن حادثتها عبر منشور رسمي خاص بها، وأرجعت جميعها السبب إلى خطأ في إعدادات بيئة الاختبار التي تديرها شركة Irregular الإسرائيلية، سمح للنماذج بالوصول إلى الإنترنت العام. وقد وصفت الشركات هذه الحوادث بأنها نتيجة خلل تقني في البنية التحتية للاختبار، لا محاولة متعمدة من النماذج لكسر القيود المفروضة عليها.
تفاصيل حوادث إفلات النماذج
جرت هذه الاختبارات ضمن تمارين تُعرف بالتقاط العلم (Capture the Flag)، تُوجه فيها النماذج إلى اكتشاف الثغرات الأمنية واسترجاع معلومات مخفية داخل شبكات محاكاة. يتم تصميم هذه البيئات لتكون قريبة من الواقع بهدف كشف قدرات النماذج الخطرة، لكن خطأ في الإعدادات ربطها بالإنترنت العام دون قصد.
كانت OpenAI أول من كشف عن حادثة من هذا النوع، إذ أعلنت أن بعض نماذجها حاولت مهاجمة أنظمة منصة Hugging Face المتخصصة في الذكاء الاصطناعي بعد خروجها من بيئة الاختبار. وأوضحت الشركة في حادثة منفصلة أن أحد نماذجها وصل إلى الإنترنت العام، وعثر على شركة حقيقية تحمل اسمًا مشابهًا لهدف التمرين، ثم استغل كلمات مرور ضعيفة للوصول إلى قاعدة بياناتها، معتقدًا أنه لا يزال داخل التمرين.
من جانبها، راجعت أنثروبيك 141,006 تفاعلًا كان يمكن لنماذج Claude خلالها الوصول إلى الإنترنت المفتوح، وحددت ثلاث حوادث خرجت فيها النماذج عن نطاق المحاكاة ووصلت إلى بنية تحتية نشطة تخص ثلاث شركات مختلفة. كما ذكرت الشركة أن أحد نماذجها حدد ثغرات ووصل إلى بيانات اعتماد لمؤسسة حقيقية، في حين توقف نموذج آخر من تلقاء نفسه بعد إدراكه أنه بلغ هدفًا حقيقيًا لا محاكاة.
أما ميتا فكانت آخر من أعلن عن حادثة مشابهة، إذ أفلت أحد نماذجها من بيئة الاختبار، ووصل إلى الإنترنت، واستغل ثغرات في خدمة تابعة لجهة خارجية وعدل إعداداتها الداخلية. وقالت الشركة إنها علمت بالأمر من Irregular، وإنها تحقق فيه وستصدر تقريرًا كاملًا فور حصولها على جميع الحقائق.

شركة Irregular الإسرائيلية وحدود الجدل
تأسست شركة Irregular عام 2023 في الكيان المحتل على يد خريجين من وحدات الاستخبارات الإسرائيلية، وتحولت سريعًا إلى مزود رئيسي لبيئات اختبار نماذج الذكاء الاصطناعي المتقدمة. حصلت الشركة على تمويل قدره 80 مليون دولار من صندوقي Sequoia و Redpoint، ووصلت قيمتها إلى 450 مليون دولار، وتصف نفسها بأنها أول مختبر أمني للنماذج الحدودية.
ردت Irregular بأن هذه الحوادث نتجت جميعها عن المشكلة نفسها في بيئة التقييم التي كشفت عنها أنثروبيك أولًا، وأنها عولجت منذ ذلك الحين ولم تعد هناك مشكلات مفتوحة. أضافت الشركة أنها تعمل على إعداد ورقة بحثية لمشاركة أفضل الممارسات في احتواء النماذج وتشغيل اختبارات الأمن السيبراني بأمان.
أثارت هذه الحوادث جدلًا واسعًا في القطاع، إذ يرى بعض الخبراء أن ما جرى هو تحديدًا ما يُفترض حدوثه أثناء الاختبار، لأن النماذج تم توجيهها أصلًا لاكتشاف الثغرات في بيئة تحاكي الواقع. لكن هؤلاء أنفسهم أشاروا إلى أنه لو لم يكن المقصود أن يخترق النموذج موقعًا حقيقيًا، لكان بإمكان المختبرين مراقبة حركة البيانات الصادرة وإيقاف التجربة فورًا.
تكشف هذه الحوادث عن مسألة أعمق تتعلق بتركز اختبار سلامة أقوى النماذج لدى شركة واحدة صغيرة، بحيث يعتمد ضمان أمان النماذج التي تستخدمها آلاف المؤسسات على إعدادات بيئة اختبار واحدة. تبقى بعض التفاصيل غير مكتملة، إذ لا تزال ميتا تحقق في حادثتها ولم تصدر تقريرها النهائي بعد.
من وجهة نظري، تكشف هذه الحوادث أن الحلقة الأضعف لم تكن النماذج نفسها، وإنما البنية التي يُفترض أن تختبرها وتحتويها، فخطأ واحد في الإعدادات كان كافيًا لتحويل تمرين محاكاة إلى اختراق حقيقي.
غير أن ما يستحق التوقف عنده أكثر هو اعتماد كبرى المختبرات على مزود واحد صغير في ضمان سلامة نماذجها، إذ يجعل ذلك أمان منظومة يعتمد عليها ملايين المستخدمين رهنًا بدقة إعدادات جهة واحدة، وهو ما يفرض تطوير معايير مشتركة للاختبار الآمن قبل أن تتكرر مثل هذه الحوادث بصورة أخطر.
?xml>