في خطوة مبتكرة نحو تحسين الأداء والبنية التحتية للتطبيقات التي تعتمد على الذكاء الاصطناعي، تم تقديم كاسكاديا (Cascadia) كنظام جديد لخدمة نماذج اللغة الكبيرة (Large Language Models) على أسطول من أجهزة الكمبيوتر المصممة من قبل شركة إنتل (Intel). هذا النظام يستخدم موارد المعالجة المتاحة بالشكل الأمثل، حيث يعتمد على المعالجات المركزية (CPU) والرسومية (Integrated-GPU) ونظم المعالجة العصبية (NPU) الموجودة في هذه الأجهزة.

يتميز كاسكاديا بالقدرة على ربط العقد بشكل مرن، حيث تتصل الكتل المختلفة في شبكة (libp2p QUIC) من خلال شهادات قبول تصدرها جهات معتمدة، مما يسهل تبادل الأحمال بشكل مباشر وتوجيه الطلبات المتوافقة مع OpenAI بين الأقران. تم تصميم النظام ليكون بسيطًا، حيث لا يحتاج إلى وحدة تحكم مخصصة للإشراف على الاتصالات، مما يُسرع عملية استجابة الطلبات.

عرضت التجارب العملية أداء النظام، حيث أظهرت اختبارات على نموذج Phi-3.5-mini NPU ثلاثة أضعاف سرعة الاستجابة مقارنةً بالنشر الأحادي، مما يشير إلى كفاءة كاسكاديا على نطاق واسع. بنظام دعم متعدد الوظائف، يقدم كاسكاديا ثلاثة أوضاع لخدمة البيانات: تنفيذ نموذج كامل على عقدة واحدة، نسخ موزعة بأحمال متوازنة، وسلاسل مجزأة.

عند إجراء مقارنة مع منصات مثل IBM وNutanix وVMware وHPE، أظهرت كاسكاديا تفوقًا في متطلبات الأجهزة، الأبعاد النشر، والجدولة. تُعتبر هذه المقارنات مفيدة للمطورين والشركات التي تسعى إلى اعتماد تقنيات الذكاء الاصطناعي في بيئاتها.

تقدم كاسكاديا رؤية جديدة لتكنولوجيا الذكاء الاصطناعي وتساهم في فتح آفاق متجددة للنمو والابتكار. إن كنت مطورًا أو مهتمًا بالتكنولوجيا، فالفرصة أمامك لاستكشاف هذا النظام الحديث والآثار العميقة التي يمكن أن يحدثها.