في عالم الذكاء الاصطناعي، تعتبر نماذج الواجهات الرسومية (GUI) من العناصر الحيوية التي تُستخدم لتوجيه وكالات الذكاء الاصطناعي نحو تقديم تجارب مستخدم سلسة. ومع ذلك، هناك مشكلة كبيرة عند الاعتماد على هذه النماذج: تتخلف تقييماتها عن الاستخدام الحقيقي، حيث غالبًا ما يتم تجربة النماذج كنموذج صالح للعرض الوحيد للشاشة التالية دون التحقق من أدائها في بيئات متعددة الخطوات.
لذلك، تم تقديم منصة جديدة تُدعى GUI-CC، والتي تهدف إلى تقييم دقة الاتساق السياقي لنماذج الواجهات الرسومية بوصفها بيئات لوكالات الذكاء الاصطناعي. تحتوي GUI-CC على مسارين تكامليين: الأول هو مسار مرجعي خارج الخط الذي يتتبع النماذج خلال مسارات حقيقية لتطبيقات الهواتف المحمولة، والثاني هو مسار حلقة الوكيل على الإنترنت الذي يسمح لوكالات محددة بالتفاعل مع واجهات المستخدم التي تولدها النماذج.
اختبرت GUI-CC 500 مهمة مسار خارج الخط و200 مهمة عبر محاكي تم التحقق منها في 30 تطبيقا للهواتف المحمولة, وتم تقييم معايير مختلفة مثل دقة الانتقال، وصلاحية الانتقال، والاتساق السياقي، وتقدم المهام. مما أظهر التجارب أن إنشاء نموذج ذو مظهر مقبول لا يضمن محاكاة موثوقة للبيئة: حيث غالبًا ما تؤدي النماذج الحالية إلى شاشات تبدو صالحة بينما تفشل في الحفاظ على السياق المهم أو دعم النواتج القابلة للتنفيذ متعددة الخطوات.
هذه النتيجة تعكس الحاجة الملحة لتطوير نماذج أكثر ذكاءً ومرونةً في التعامل مع متطلبات التطبيقات الحقيقية، مما يسهم في تحسين تفاعل المستخدم بكفاءة.
اختبار دقة نماذج الواجهات الرسومية: قياس الاتساق السياقي في بيئات الذكاء الاصطناعي
تم إطلاق منصة GUI-CC التي تهدف إلى تقييم نماذج الواجهات الرسومية للذكاء الاصطناعي. تُركز هذه المنصة على أهمية الحفاظ على اتساق المفاهيم أثناء التفاعل المستمر مع النماذج المعقدة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←# نموذج واجهة المستخدم# اختبارات الذكاء الاصطناعي# تطبيقات الهواتف المحمولة# اتساق السياق# تقييم الأداء
جاري تحميل التفاعلات...
