تواجه الشركات تحديات كبيرة عند تشغيل نماذج اللغات الضخمة (Large Language Models) في بيئاتها، حيث تُخزَّن البيانات في مكان واحد بينما يتواجد قوة الذكاء الاصطناعي في مكان آخر. هذا التباعد يؤدي إلى مشكلات فعلية تتعلق بالتأخير، والأمان، والتعرض التنظيمي. لكن IBM، من خلال بطاقة تسريع Spyre المخصصة لنظام LinuxONE، تعيد صياغة هذا المعادلة تمامًا.
في أحدث أبحاثها، تقدم IBM معمارية جديدة تتكون من ستة نظم فرعية (subsystems) تعتمد بالكامل على LinuxONE، مستخدمةً Spyre لإجراء استنتاجات توليدية، ومسرع Telum II المدمج للمهام التصنيفية الخفيفة، وRed Hat OpenShift لتنظيم الحاويات. وهذا يعني أن كل جزء من عملية الإدخال، استرجاع المتجهات، تجميع الطلب، استنتاج نماذج اللغات الكبيرة، تصفية المطابقة، وتوصيل الاستجابة يتم ضمن نفس النظام، مما يحافظ على سرية البيانات داخل حدود الأجهزة.
تستعرض الورقة البحثية الخيارات التصميمية لكل نظام فرعي، وتتناول نظام تجميع وخدمة Spyre، وتوضح كيف تضمن تقنية التشغيل الآمن في LinuxONE ضمانات الحوسبة السرية للمهام الذكية، كما تقارن هذه المعمارية مقارنة مع بدائل السحابة GPU والمحلية.
تشير التحليلات الأولية إلى إمكانية تقليل زمن الوصول لنظام RAG (استرجاع مدعوم بالتوليد) لأقل من ثانيتين، مع تقليص تصل نسبته إلى 20 مرة مقارنة بالاستنتاجات التي تتم خارج المنصة، كل ذلك مع الحفاظ على تشفير قوي وإمكانية تدقيق تتماشى مع احتياجات الصناعات المنظمة.
هذا التقدم يعيد تعريف كيفية تعامل المؤسسات مع البيانات الحساسة، مما يفتح الأبواب لتحسينات هائلة في الأداء والأمان. ما رأيكم في هذا التطور؟ شاركونا في التعليقات.
ثورة جديدة في الذكاء الاصطناعي: IBM تكشف النقاب عن معمارية سحابية آمنة لزيادة الأداء مع Spyre
تقدم IBM نظامًا ثوريًا يجمع بين قوة الذكاء الاصطناعي وسرعة الأداء، مع الحفاظ على سرية البيانات في بيئات العمل. هذه المعمارية الجديدة تعد بتقليص التأخير وزيادة الكفاءة بشكل غير مسبوق.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
