أطلقت جوجل نموذجها الجديد Gemini 3.7 Flash بعد 3 أسابيع فقط من إصدار الإصدار السابق "Gemini 3.6 Flash" ليعكس مدى اشتعال المُنافسة في سوق نماذج الذكاء الاصطناعي، ورغم قصر الفترة الفاصلة بين الإصدارين؛ إلا أنّ النموذج الجديد يجمع بين أداء الفئات الاحترافية وسرعة المعالجة العالية، إلى جانب خفض ملحوظ في التكلفة مُقارنةً بسابقه.

تستهدف جوجل بشكل خاص المطورين الباحثين عن أدوات برمجة قادرة على اتخاذ قرارات مُستقلة داخل مهام مُعقدة ومُتعددة الخطوات، فلم تعد السرعة وحدها كافية دون وجود دقة في التنفيذ.

  • يقدّم Gemini 3.7 Flash أداءً مُتقدمًا وسرعة عالية مع خفض ملحوظ في التكلفة.
  • يدعم النموذج نافذة سياق تصل إلى مليون رمز، مع استقبال النصوص والصور والفيديو والصوت وملفات PDF.
  • يتيح للمطورين 3 درجات مرنة للتفكير بحسب تعقيد المهام وسرعة التنفيذ المطلوبة.
  • يرفع دقة البرمجة وفهم الفيديو، مع استخدامات مُتقدمة في المال والقانون والعلوم البيولوجية.

اقرأ أيضًا: Mythos 5 و Fable 5...الجيل الجديد من نماذج الذكاء الاصطناعي من Claude!

Gemini 3.7 Flash: قفزة في الأداء

تكشف نتائج الاختبارات الأخيرة عن اعتماد جوجل على تحسينات خوارزمية شاملة رفعت كفاءة المعالجة الأساسية دون الحاجة لإعادة تدريب النموذج من الصفر، ونتيجةً لذلك؛ يدعم جيميناي 3.7 فلاش نافذة سياق تصل إلى مليون رمز إدخال، بجانب قدرة توليد تبلغ 64 ألف رمز إخراج في الطلب الواحد.

أمّا من ناحية استقبال البيانات، فتتعامل بنيته مع أنواع مُتعددة منها كالنصوص والصوت والفيديو والصور، كما تعالج ملفات PDF مُباشرةً دون الحاجة لخطوات تحويل إضافية، وهو ما يوفر وقتًا وجهدًا حقيقيين على المُطورين.

مواصفات Gemini 3.7 Flash التقنية

  • تمنح إعدادات التفكير القابلة للضبط 3 مُستويات مُعالجة تتراوح بين المنخفض والمُرتفع بحسب طبيعة المُهمة.
  • تبلغ التكلفة التمهيدية 0.75 دولار لكل مليون رمز إدخال و3.75 دولار لكل مليون رمز إخراج، وذلك حتى نهاية عام 2026.
  • تسجل الاختبارات المرجعية نسبة نجاح بلغت 85.8% في مهام الأوامر التنفيذية عبر الطرفية.
  • تصل دقة فهم الفيديوهات الطويلة إلى 85.4%، وذلك وفق معيار LVBench العالمي.

تفوق واضح في البرمجة وفهم الفيديو

بفضل هذه التحسينات، يحل النموذج الجديد المشكلات البرمجية المُعقدة بدقة أعلى من إصداره السابق، بل وينتج تطبيقات ويب كاملة الوظائف باستخدام عدد أقل من الأوامر البرمجية، ولا يقتصر التطور على البرمجة فقط، حيث تستفيد أيضًا قطاعات المال والقانون والعلوم البيولوجية من قدراته التحليلية المُتقدمة، حيث يستخرج البيانات المُترابطة من المستندات الطويلة بدقة ملحوظة.

وعند مُقارنته بالإصدار السابق، تظهر نتائج التقييم تحسنًا واضحًا في التعامل مع مهام العمل المؤسسية مُتعددة الخطوات، وهو ما يمنحه ميزة تنافسية حقيقية في أنظمة العمل المُعقدة.

يوظّف النموذج الجديد أيضًا في تطوير الألعاب بطريقة لافتة، حيث يحوّل وصفًا نصيًا بسيطًا إلى لعبة 3D قابلة للتشغيل الفعلي. ويعمل جيميناي 3.7 فلاش هنا جنبًا إلى جنب مع أداة Nano Banana لتوليد الشخصيات والعناصر والخامات البصرية بشكل مبُاشر وأثناء اللعب نفسه دون الحاجة لتجهيزها مُسبقًا.



 

أرى أنّ إتاحة خيارات تفكير مرنة بهذا الشكل تمنح المُطورين توازنًا حقيقيًا بين سرعة الاستجابة وتكلفة التشغيل، خصوصًا أن هذا التوازن هو ما يسهّل على الشركات الناشئة توسيع مشاريعها دون أن تتحمل أعباء مالية كبيرة في المراحل الأولى.

تحكم مرن في التفكير وأسعار تتغير مُستقبلًا

من الناحية العملية، توفر واجهة برمجة التطبيقات آليات ضبط دقيقة توازن بين جودة الاستجابة وسرعة المعالجة وذلك بحسب طبيعة كل مُهمة مُنفردة، غير أنّ هذا السعر التمهيدي لن يستمر طويلًا، إذ ترتفع الأسعار الرسمية اعتبارًا من بداية 2027 لتصل إلى 1.50 دولار لرموز الإدخال و7.50 دولار لرموز الإخراج.

وفي الوقت نفسه، تتيح جوجل الوصول إلى النموذج عبر منصة AI Studio للمُطورين، وعبر Gemini Enterprise للشركات الراغبة في دمج الوكلاء الذكيين ضمن أنظمة عملها الرقمية.

في النهاية، تؤكد هذه الخطوة استمرار جوجل في تسريع تطوير سلسلة نماذجها الذكية سعيًا منها لتعزيز حضورها في سوق تقني تشتد فيه المُنافسة يومًا بعد يوم -نحن نرى ما تقدمه OpenAi و Anthropic وغيرها.

ولم تنتظر جوجل طويلًا لتطبيق ذلك عمليًا، فقد استخدمت النموذج الجديد بالفعل داخل مساعدها الشخصي "Gemini Spark" المُتاح لمشتركي الباقات المدفوعة، وهو ما يمنحه فرصة اختبار واسعة قبل أن يتوسع استخدامه تدريجيًا في تطبيقات ومنتجات أخرى تابعة للشركة خلال الأشهر القادمة.