أعلنت شركة Rebellions، وهي شركة كورية جنوبية لتصنيع أشباه الموصلات الخاصة بالذكاء الاصطناعي، أنها نجحت في تشغيل نموذجها الضخم للذكاء الاصطناعي A.X K1 الخاص بـ SK Telecom على خوادم وحدة المعالجة العصبية المحلية (NPU). وأوضحت الشركة، في 23 من الشهر، أنها استخدمت خادمها المملوك للذكاء الاصطناعي "Rebel Server" لتنفيذ النموذج بثبات وبأكثر من 500 مليار معلمة، كما عرضت خدمة لوكيل AI تتعامل مع طلبات متعددة من المستخدمين في الوقت نفسه. وتُظهر هذه الإنجازات جدوى تشغيل خدمات ذكاء اصطناعي واسعة النطاق باستخدام نماذج ذكاء اصطناعي محلية وبنية تحتية لـ NPU فقط، ما يجعلها مثالاً عملياً على قدرات الذكاء الاصطناعي السيادية. وتعد Rebellions عضواً في تحالف تابع لـ SK Telecom ضمن مشروع مؤسسة نماذج الأساس المستقل للذكاء الاصطناعي في وزارة العلوم وتكنولوجيا المعلومات، وهي مسؤولة عن تقديم عرض لبنية تحتية للذكاء الاصطناعي مبنية على وحدات NPU محلية.
تعمل Rebellions على تحسين البرمجيات لهندسة MoE والمعالجة المتوازية
يطبق A.X K1 بنية "خليط الخبراء" (Mixture of Experts - MoE) التي تستخدم انتقائياً فقط النماذج المتخصصة اللازمة لتعزيز كفاءة الحوسبة للنماذج واسعة النطاق. وقد قامت Rebellions بتحسين برمجيات مخصصة لنموذج MoE، وتطبيق تقنيات لتوزيع عمليات مختلفة عبر وحدات NPU من أجل المعالجة المتوازية. وقد مكّن ذلك خادماً واحداً من معالجة طلبات متعددة للمستخدمين في الوقت الفعلي. وذكرت الشركة أن خادماً واحداً من Rebel Server يؤمّن أداء بنية تحتية مماثلاً لخوادم وحدات معالجة الرسوميات (GPU) عالية الأداء عالمياً، ما يقلل عبء إنشاء مراكز البيانات والتكاليف التشغيلية.
Rebel Server يعرض خدمة وكيل AI متعددة المستخدمين في الوقت الفعلي
في العرض، عرضت Rebellions خدمة وكيل يمكن للمستخدمين من خلالها طرح أسئلة مثل "ما الصيدليات المتاحة في عطلة نهاية الأسبوع"، والحصول على النتائج المعروضة على خريطة. وقد عالج النظام الردود في الوقت الفعلي حتى في البيئات التي يطرح فيها عدة مستخدمين في الوقت نفسه أسئلة مختلفة. وجرى التحقق من قدرات الخادم على التعامل مع أحمال عمل متعددة المستخدمين المتزامنة مع الحفاظ على أداء ثابت.
Rebellions تشارك في مشروع نماذج الأساس للذكاء الاصطناعي الحكومي
قال Park Sung-hyun، الرئيس التنفيذي لـ Rebellions: "هذه حالة عملية للذكاء الاصطناعي السيادي تُظهر أنه يمكن تشغيل خدمات ذكاء اصطناعي واسعة النطاق باستخدام نماذج فائقة الضخامة محلية ووحدات NPU محلية فقط." وتشارك Rebellions كعضو في تحالف تابع لـ SK Telecom ضمن مشروع مؤسسة نماذج الأساس المستقل للذكاء الاصطناعي في وزارة العلوم وتكنولوجيا المعلومات، حيث تتولى مسؤولية تقديم عرض لبنية تحتية للذكاء الاصطناعي مبنية على وحدات NPU محلية.
الأسئلة الشائعة
ما الذي حققته Rebellions باستخدام نموذج A.X K1 من SK Telecom؟
نجحت Rebellions في تشغيل نموذج الذكاء الاصطناعي A.X K1 من SK Telecom، الذي يضم أكثر من 500 مليار معلمة، على Rebel Server الخاص بها المعتمد على NPU محلي. وقد عرضت الشركة خدمة وكيل AI تتعامل مع طلبات متعددة من المستخدمين في الوقت الفعلي بشكل متزامن.
كيف يتعامل Rebel Server لدى Rebellions مع النماذج الكبيرة للذكاء الاصطناعي بكفاءة؟
يقوم Rebel Server بتحسين البرمجيات لهندسة "خليط الخبراء" (Mixture of Experts - MoE) المستخدمة في A.X K1، عبر توزيع عمليات مختلفة عبر وحدات NPU من أجل المعالجة المتوازية. وهذا يمكّن خادماً واحداً من تحقيق أداء بنية تحتية مماثل لأداء خوادم وحدات GPU عالية الأداء عالمياً، مع معالجة طلبات متعددة للمستخدمين في الوقت الفعلي.