في تطور مثير لعالم الذكاء الاصطناعي، تم تقديم مفهوم "آلة الزمن للكتب الإلكترونية" (Workbook Time Machine)، وهي طريقة جديدة تعتبر ثورية في كيفية تقييم نماذج الذكاء الاصطناعي (AI) في إنشاء جداول البيانات. هذه الأداة المتطورة تعمل كقناة تلقائية لإنشاء معايير تقييم تقيس فعالية نماذج اللغات الضخمة (Large Language Models) في إنتاج عناصر مشتقة ضمن جداول البيانات مثل المعادلات، والمخططات، والجداول المحورية، والتنسيقات الشرطية.
تم تطبيق هذه التقنية على مجموعات عامة من الكتب الإلكترونية، مما أدى إلى إنتاج ما يسمى بـ "مجموعة WTM" (wtmcorpus)، والتي تتضمن ثلاثيات من (المدخلات، المخرجات، والأسئلة) تغطي أربعة أنواع من العناصر مع تعقيدات متفاوتة. ومن خلال هذه المجموعة، تم إعداد مجموعة "WTM Bench" (wtmbench) المكونة من 150 مهمة تقييم، مقسمة ومرتبة حسب مستويات معينة من التفاصيل.
تم تنفيذ اختبارات شاملة لتقييم فعالية الوكلاء القائمين على معالجة جداول البيانات على مجموعة WTM Bench، مع الأخذ بعين الاعتبار أنواع العناصر، تعقيد الخطوات، ودرجة تفصيل التعليمات.
كشفت التقييمات عن أن تنوع الأسئلة وطريقة تنظيم الوكلاء، وكذلك واجهة API المستخدمة للتحكم في جداول البيانات، تلعب دورًا حاسمًا في أداء نماذج الذكاء الاصطناعي على مهام Excel.
إن الابتكارات المقدمة تعكس إمكانية تحسين مدى قدرة نماذج الذكاء الاصطناعي على معالجة البيانات، مما يقدم آفاق جديدة لتطورات مستقبلية مثيرة في هذا المجال.
آلة الزمن للكتب الإلكترونية: نقلة نوعية في تقييم أداء نماذج الذكاء الاصطناعي لإنشاء جداول البيانات!
تم الكشف عن آلة الزمن الخاصة بالكتب الإلكترونية التي تتيح تقييم أداء نماذج الذكاء الاصطناعي في إنشاء العناصر المشتقة بجداول البيانات. بمزيد من الدقة، تم تطوير مجموعة من الاختبارات المتنوعة لتقيس قدرة هذه النماذج على التعامل مع مختلف بيانات الجداول.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
