أطلقت OpenAI نموذج الذكاء الاصطناعي GPT-6 Astra باعتباره أحدث نماذجها الموجهة للمهام المعقدة واستخدام الحاسوب والبرمجة والأمن السيبراني. يأتي الإطلاق مع قدرات أعلى في تنفيذ الأعمال متعددة الخطوات، لكنه يفتح في الوقت نفسه نقاشًا جديدًا حول سلامة النماذج المتقدمة بعد وصول Astra إلى المستوى الحرج في القدرات السيبرانية وصعوبة مراقبة بعض مسارات استدلاله.

  • OpenAI تصف GPT-6 Astra بأنه أقوى نموذج نشرته حتى الآن.
  • النموذج يصل إلى المستوى الحرج في قدرات الأمن السيبراني.
  • OpenAI تبدأ الإتاحة تدريجيًا لمشتركي الخطط المدفوعة وواجهة API.
  • تقنية الاستدلال الجديدة أثارت مخاوف بسبب صعوبة مراقبة خطوات النموذج.

بحسب إعلان OpenAI الرسمي، بدأ طرح النموذج لمجموعة محدودة من المؤسسات في 3 سبتمبر، على أن يصل خلال الأيام التالية إلى المشتركين والمطورين. ركزت الشركة على قدرات استخدام الحاسوب والبرمجة، بينما خصصت جزءًا كبيرًا من إعلانها لتوضيح إجراءات الحماية الجديدة المرتبطة بالمهام السيبرانية الحساسة.

قدرات أقوى للعمل على الحاسوب

تقدم OpenAI نموذج GPT-6 Astra باعتباره أكثر نماذجها قدرة في المهام التي تجمع بين الاستدلال واستخدام الحاسوب والبرمجة والبحث. أوضحت الشركة أن النموذج يستطيع تنفيذ أعمال متعددة الخطوات من بدايتها حتى النتيجة النهائية، مثل التعامل مع المتصفح، وتطوير البرمجيات، وإعداد المستندات، والبحث عبر مصادر مختلفة باستخدام الأدوات المتاحة له.

تظهر نتائج OpenAI الداخلية تقدمًا كبيرًا في عدة اختبارات. فقد سجل النموذج 98% في FrontierMath Tier 4 و99.9% في ARC-AGI-3، كما وصل إلى 100% في ExploitBench المخصص لبعض مهام الأمن السيبراني. تبقى هذه النتائج صادرة عن الشركة، لذلك يحتاج الحكم على موقع النموذج أمام المنافسين إلى اختبارات مستقلة تعمل تحت ظروف موحدة.

ركزت OpenAI أيضًا على سرعة تنفيذ المهام العملية. أشار عرض للشركة إلى أن مهمة للبحث عن شخص لرعاية قطة استغرقت 5 دقائق و27 ثانية باستخدام النموذج، مقارنة بنحو 30 دقيقة لدى الإنسان، بينما أنجز مهمة للبحث عن وظيفة خلال دقيقتين و51 ثانية مقابل نحو 5 ساعات في المثال البشري المستخدم للمقارنة.

بدأ طرح نموذج GPT-6 Astra لمجموعة محدودة من المؤسسات، مع خطة لإتاحته خلال الأيام التالية لمشتركي ChatGPT Plus و Pro و Business و Enterprise، إضافة إلى المطورين عبر واجهة OpenAI API وخدمات Microsoft Azure و AWS Bedrock. يبلغ السعر القياسي لواجهة API نحو 10 دولارات لكل مليون رمز إدخال و50 دولارًا لكل مليون رمز إخراج.

يعكس هذا التوجه محاولة OpenAI زيادة اعتماد الشركات على الوكلاء القادرين على تنفيذ أعمال طويلة ومتعددة الأدوات. تتمثل القيمة العملية هنا في نقل النموذج من تقديم إجابة واحدة إلى التعامل مع سلسلة كاملة من الخطوات مع الحفاظ على السياق ومراجعة نتائج العمل أثناء التنفيذ.

OpenAI تطلق أقوى نماذجها حتى الآن GPT-6 Astra بقدرات متقدمة

القوة الجديدة ترفع مخاوف السلامة

يحمل نموذج GPT-6 Astra في المقابل مستوى جديدًا من المخاطر التي أقرت بها OpenAI نفسها. فقد صنفت الشركة النموذج عند المستوى الحرج في قدرات الأمن السيبراني ضمن إطار Preparedness Framework، ما يعني أنه يستطيع، عند تزويده بالأدوات والصلاحيات المناسبة، العثور على ثغرات أمنية غير معروفة وتطوير طرق لاستغلالها في أنظمة محمية دون توجيه بشري لكل خطوة.

يرتبط جزء آخر من الجدل بتقنية استدلال تعرف باسم التكرار غير الشفاف Opaque Recurrence. تسمح هذه التقنية للنموذج بتنفيذ بعض عمليات التفكير دون التعبير عنها كاملة في صورة رموز لغوية يمكن للباحثين مراجعتها، ما يجعل مراقبة سلسلة الاستدلال أكثر صعوبة مقارنة بالنماذج التي تعرض آثارًا لغوية أوضح أثناء حل المهمة.

أوضح جاكوب باتشوكي، كبير العلماء في OpenAI، أن مراقبة النماذج تصبح أكثر صعوبة مع ارتفاع قدراتها، لأن بعض المهام يمكن تنفيذها باستخدام عدد أقل من الرموز اللغوية. جاء الإطلاق أيضًا بعد تدقيق أمني مرتبط بحادثة اختراق أنظمة Hugging Face بواسطة وكلاء تابعين لـ OpenAI خلال اختبارات سابقة، وفق تقارير Reuters و TechCrunch.

أضافت OpenAI طبقات حماية جديدة تشمل مراقبة مسارات العمل كاملة، وعزلًا أقوى أثناء التطوير، وتشفير نقاط حفظ النماذج، إلى جانب فحوص يمكنها إبطاء أو إيقاف بعض المهام السيبرانية عند ظهور مؤشرات خطر. قد تؤثر هذه الإجراءات أحيانًا في أعمال دفاعية مشروعة، وهو ثمن تقبله الشركة حاليًا لتقليل احتمالات إساءة الاستخدام.

في رأيي، قوة GPT-6 Astra تجعل الإطلاق حدثُا تقنيًا هامًا، لكن صعوبة مراقبة طريقة استدلاله تستحق اهتمامًا أكبر من نتائج الاختبارات القياسية وحدها. إذا أصبحت النماذج قادرة على تنفيذ مهام حساسة بصورة أكثر استقلالًا، فإن القدرة على فهم قراراتها وإيقافها عند الضرورة تصبح جزءًا أساسيًا من جودة المنتج نفسه، وسيحدد نجاح OpenAI في هذا الجانب مدى الثقة التي يمكن أن يحصل عليها Astra داخل الشركات.