تواجه الشركات تحديات كبيرة عند تشغيل نماذج اللغات الضخمة (Large Language Models) في بيئاتها، حيث تُخزَّن البيانات في مكان واحد بينما يتواجد قوة الذكاء الاصطناعي في مكان آخر. هذا التباعد يؤدي إلى مشكلات فعلية تتعلق بالتأخير، والأمان، والتعرض التنظيمي. لكن IBM، من خلال بطاقة تسريع Spyre المخصصة لنظام LinuxONE، تعيد صياغة هذا المعادلة تمامًا.

في أحدث أبحاثها، تقدم IBM معمارية جديدة تتكون من ستة نظم فرعية (subsystems) تعتمد بالكامل على LinuxONE، مستخدمةً Spyre لإجراء استنتاجات توليدية، ومسرع Telum II المدمج للمهام التصنيفية الخفيفة، وRed Hat OpenShift لتنظيم الحاويات. وهذا يعني أن كل جزء من عملية الإدخال، استرجاع المتجهات، تجميع الطلب، استنتاج نماذج اللغات الكبيرة، تصفية المطابقة، وتوصيل الاستجابة يتم ضمن نفس النظام، مما يحافظ على سرية البيانات داخل حدود الأجهزة.

تستعرض الورقة البحثية الخيارات التصميمية لكل نظام فرعي، وتتناول نظام تجميع وخدمة Spyre، وتوضح كيف تضمن تقنية التشغيل الآمن في LinuxONE ضمانات الحوسبة السرية للمهام الذكية، كما تقارن هذه المعمارية مقارنة مع بدائل السحابة GPU والمحلية.

تشير التحليلات الأولية إلى إمكانية تقليل زمن الوصول لنظام RAG (استرجاع مدعوم بالتوليد) لأقل من ثانيتين، مع تقليص تصل نسبته إلى 20 مرة مقارنة بالاستنتاجات التي تتم خارج المنصة، كل ذلك مع الحفاظ على تشفير قوي وإمكانية تدقيق تتماشى مع احتياجات الصناعات المنظمة.

هذا التقدم يعيد تعريف كيفية تعامل المؤسسات مع البيانات الحساسة، مما يفتح الأبواب لتحسينات هائلة في الأداء والأمان. ما رأيكم في هذا التطور؟ شاركونا في التعليقات.