في خطوة غير مسبوقة، كشفت الأبحاث الأخيرة عن تقديم QuArch، المعايير الأول لـنماذج اللغة الكبيرة (Large Language Models) في مجال هندسة الحاسوب. يعتمد هذا المعيار على الجمع بين الجوانب العليا للبرمجيات والتطبيقات المنخفضة للعتاد، مما يعكس الفجوة الحالية في تقييمات نماذج الذكاء الاصطناعي.

**ما هو QuArch؟**

QuArch، والذي ينطق ككلمة "كوارك"، هو المعيار الأول من نوعه الذي يهدف إلى تسهيل تطوير وتقييم قدرات المعرفة والتفكير في نماذج اللغة الكبيرة ضمن مجال هندسة الحاسوب. حيث يقدم الإصدار الأول QuArch v1.0 مجموعة شاملة تضم 2,671 زوجاً من الأسئلة والأجوبة المعتمدة من خبراء، تغطي مختلف جوانب هندسة الحاسوب بما في ذلك تصميم المعالجات وأنظمة الذاكرة والشبكات البينية.

تظهر نتائج التقويم أن النماذج المتطورة تمتلك معرفة ضمن هذا المجال، لكنها تواجه صعوبة في تطبيق مهارات التفكير العالي عند التعامل مع الأسئلة المعقدة المتعلقة بهندسة الحاسوب، حيث تفاوتت دقتها في الإجابات بشكل كبير (من 34% إلى 73%).

**التميز من خلال التحسين**

عبر أساليب التحسين، يظهر QuArch نتائج مثيرة على مهام تصميم hierarchies ذاكرة واقعية، تمكن من تحقيق حلول أكثر كفاءة في المساحة تصل حتى 1.99 ضعف، بالإضافة إلى زيادة تصل إلى 40% في الحلول القابلة للتطبيق.

بجوانبه المتعددة، يمثل QuArch أساساً قوياً لبناء وقياس قدرات نماذج اللغة الكبيرة، مما يمكنها من تسريع الابتكارات في أنظمة الحوسبة. المعيار وقائمة التفوق متاحة للجمهور على موقع QuArch الذي يعد مرجعاً جديداً في صناعة الذكاء الاصطناعي.