أعلنت AMD عن شراكة جديدة مع شركة Cerebras (تطور أشباه موصلات) لتطوير منصة استدلال "Inference" موجهة لتطبيقات الذكاء الاصطناعي التي تتطلب زمن استجابة منخفضًا للغاية، إلى جانب الكشف عن منصة ROCm.AI الجديدة التي تعتمد على الذكاء الاصطناعي لتحسين أداء النماذج تلقائيًا على عتاد الشركة.

وأوضحت AMD أن الطلب المتزايد على إنتاج الرموز "Tokens" بزمن استجابة فائق السرعة يدفع الصناعة نحو الاعتماد على بنى حوسبة مفصولة "Disaggregated Compute"، باعتبارها الحل الأمثل لتلبية هذه المتطلبات.

وفي هذا السياق، انضمت Cerebras إلى AMD لتطوير منصة تجمع بين بنية Helios ومسرّع Wafer-Scale Engine الذي تطوره Cerebras، بهدف تسريع عمليات الاستدلال الخاصة بنماذج الذكاء الاصطناعي الضخمة.

ومن المقرر إتاحة الحل الجديد عبر سحابة Cerebras في وقت لاحق من العام الجاري، قبل طرحه لاحقًا للعملاء الراغبين في نشره داخل بنيتهم التحتية.

وفي جانب البرمجيات، استعرض فامسي بوبانا أحدث تطورات منصة ROCm، مؤكدًا أن AMD تعتمد دورة تطوير سريعة مع إصدار تحديثات كل ستة أسابيع لتسريع وتيرة الابتكار وتحسين تجربة المطورين.

وأشار إلى أن ROCm تواصل التركيز على البرمجيات مفتوحة المصدر، مع توفير مكتبات وأدوات ولغات برمجة متخصصة لدعم تطوير تطبيقات الذكاء الاصطناعي مفتوحة المصدر، مع ضمان توافق النماذج مع منصات AMD منذ اليوم الأول.

وكشفت الشركة أيضًا عن منصة ROCm.AI الجديدة، التي تستخدم وكلاء ذكاء اصطناعي لفهم مكونات منصات AMD وتحسين النماذج تلقائيًا من خلال اختيار أفضل المكتبات والإعدادات وأساليب الضبط لكل معالج أو مسرّع رسومي.

وأوضحت AMD أن المنصة تستطيع، على سبيل المثال، تحسين نموذج MiniMax M3 للعمل بكفاءة على مسرّع MI355X دون تدخل يدوي، إذ يتولى وكيل الذكاء الاصطناعي إدارة عملية التحسين بالكامل، بدءًا من الإعداد وحتى النشر.

ووفقًا للشركة، نجحت منصة ROCm.AI في زيادة إنتاجية الرموز بنسبة 38% عبر التحسين التلقائي، كما يمكنها تحقيق أداء أعلى يصل إلى 3.3 أضعاف مقارنة بعمليات النشر التقليدية، فضلًا عن تحسين كفاءة تدريب نماذج الذكاء الاصطناعي.