تستمر التحديات المرتبطة بأتمتة واجهات المستخدم الرسومية (GUI) في إثارة القلق لدى المطورين، خاصة عندما يتعلق الأمر بالتعامل مع تراكم الأخطاء خلال تسلسلات التفاعل الطويلة. ولكن، مع تقديم نموذج GUI-PRA، يبدو أن الأمور بدأت تتغير.

هذا النموذج الجديد، المعتمد على نظرية نماذج مكافآت العمليات (Process Reward Models)، يوفر إشرافاً مكثفاً على مستوى الخطوات، مما يساعد بشكل كبير في تقليل الأخطاء. ومع ذلك، كانت النماذج القياسية لمكافآت العمليات تعاني من نقص القدرة على التحقق الوظيفي، حيث كانت تعتمد غالبًا على التوافق البصري السطحي، مما أدى إلى فجوة في المعرفة التقييمية بسبب افتقارها إلى منطق التحكيم القائم على المعرفة بالموضوع.

يوفر GUI-PRA حلاً لهذا التحدي من خلال تحويل تقييم العمليات في واجهات المستخدم من تقييم سلبي إلى تحقيق نشط. حيث يجمع بين توليف معايير التجربة المحقونة (Experience-Injected Criterion Synthesis)، الذي يصف مبادئ التحقق العامة إلى معايير معينة بالحالة، ورؤية توجيهية ذاتية التنبيه (Criterion-Guided Autoregressive Perception)، التي تستخدم هذه المعايير للتنقل خلال أدوات بصريّة متعددة الدقة وجمع أدلة أرضية.

في التجارب التي تمت على منصات AndroidWorld وMobile-MiniWoB++، أظهر نموذج GUI-PRA تحسنات بلغت 5.0% و6.5% على التوالي مقارنة بالنماذج القياسية لمكافآت العمليات، حيث حقق نموذج Qwen3-VL معدل نجاح بلغ 54.74% على AndroidWorld.

كما أثبت نموذج GUI-PRA تنافسية قوية في اختبار OS-Critic Bench عند مقارنته بالنماذج الناقدة المدربة بالكامل، مما يشير إلى إمكانيات واعدة لتعزيز فعالية الأتمتة.