في خطوة غير مسبوقة، كشفت الأبحاث الأخيرة عن تقديم QuArch، المعايير الأول لـنماذج اللغة الكبيرة (Large Language Models) في مجال هندسة الحاسوب. يعتمد هذا المعيار على الجمع بين الجوانب العليا للبرمجيات والتطبيقات المنخفضة للعتاد، مما يعكس الفجوة الحالية في تقييمات نماذج الذكاء الاصطناعي.
**ما هو QuArch؟**
QuArch، والذي ينطق ككلمة "كوارك"، هو المعيار الأول من نوعه الذي يهدف إلى تسهيل تطوير وتقييم قدرات المعرفة والتفكير في نماذج اللغة الكبيرة ضمن مجال هندسة الحاسوب. حيث يقدم الإصدار الأول QuArch v1.0 مجموعة شاملة تضم 2,671 زوجاً من الأسئلة والأجوبة المعتمدة من خبراء، تغطي مختلف جوانب هندسة الحاسوب بما في ذلك تصميم المعالجات وأنظمة الذاكرة والشبكات البينية.
تظهر نتائج التقويم أن النماذج المتطورة تمتلك معرفة ضمن هذا المجال، لكنها تواجه صعوبة في تطبيق مهارات التفكير العالي عند التعامل مع الأسئلة المعقدة المتعلقة بهندسة الحاسوب، حيث تفاوتت دقتها في الإجابات بشكل كبير (من 34% إلى 73%).
**التميز من خلال التحسين**
عبر أساليب التحسين، يظهر QuArch نتائج مثيرة على مهام تصميم hierarchies ذاكرة واقعية، تمكن من تحقيق حلول أكثر كفاءة في المساحة تصل حتى 1.99 ضعف، بالإضافة إلى زيادة تصل إلى 40% في الحلول القابلة للتطبيق.
بجوانبه المتعددة، يمثل QuArch أساساً قوياً لبناء وقياس قدرات نماذج اللغة الكبيرة، مما يمكنها من تسريع الابتكارات في أنظمة الحوسبة. المعيار وقائمة التفوق متاحة للجمهور على موقع QuArch الذي يعد مرجعاً جديداً في صناعة الذكاء الاصطناعي.
انطلاقة مثيرة في عالم الذكاء الاصطناعي: QuArch المعيار الجديد لتقييم قدرات نماذج اللغة الكبيرة في هندسة الحاسوب
تقديم QuArch كأول معيار لتعزيز قدرات نماذج اللغة الكبيرة في مجال هندسة الحاسوب يفتح آفاقاً جديدة. يضم المعيار أكثر من 2,600 زوج من الأسئلة والأجوبة المعتمدة من خبراء.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
