في عالم الذكاء الاصطناعي المتطور، تبرز أهمية الوكلاء الاستباقيين (Proactive Agents) الذين يحولون موارد الحوسبة غير المستخدمة إلى دعم مفيد قبل أن يطلب المستخدمون ذلك. ولكن، على الرغم من أن العمل الذي تقوم به هذه الوكلاء قد يكون صحيحًا، إلا أنه يمكن أن يتسبب في سوء فهم سياق المستخدم، مما يؤدي إلى تكاليف مراجعة أو تقويض الثقة.

تتناول ورقة جديدة نُشرت على موقع arXiv الأسس اللازمة لتصميم وتنفيذ وتقييم الوكلاء الاستباقيين، من خلال ثلاثة مبادئ رئيسية تعرف بـ 3T:
1. **قدرة المهمة (Task Capability)**: تشمل توقع الاحتياجات ذات الصلة وأداء الأعمال المفيدة بشكل صحيح.
2. **تخصيص الوقت (Temporal Allocation)**: يتعلق بتوزيع الموارد حسب توافرها وعندما تكون النتائج مطلوبة.
3. **الثقة (Trust)**: تهدف إلى الحفاظ على ثقة المستخدمين واعتمادهم المناسب على الوكيل.

تربط الدراسة هذه الأهداف بمساحة التصميم الخاصة بها والمتكونة من خمسة أبعاد تشمل نطاق المهمة، أفق التوقع،Trigger الانطلاق، توقيت المعالجة، وعمق التدخل. كما تحدد الدراسة الحاجة إلى تمثيل دقيق للمستخدم والبيئة، ونماذج اللغات الأساسية (Backbone LLMs)، وتكوينات الوكلاء.

بالإضافة إلى ذلك، تم اقتراح تجربة جديدة تُعرف باسم **PROACTIVITY-GYM**، وهي منصة تقييم قائمة على المحاكاة تتضمن سيناريوهات متعددة الأيام وبيئات حالية، وتستخدم مستخدمين مهيئين بالسمات لتقييم عواقب المساعدة الاستباقية عبر التفاعلات.

تم تنفيذ تقييمات عبر 23 تكوينًا مختلفًا لوكلاء النماذج، مما كشف عن فجوات أداء ملحوظة في مختلف مجالات 3T، وأظهر أن القضاة من نماذج اللغات الكبيرة غالبًا ما يخلطون بين قدرة المهمة والثقة. أظهرت دراسة بشرية مع 30 مشاركًا أهمية تحسين كافة جوانب 3T: حيث أظهرت النتائج انخفاضًا حادًا في الثقة بعد عدم توافق التدخل على الرغم من النجاح الظاهر، وفضل المشاركون الحصول على المساعدة خلال وقت النوم، حتى لو كانت غير مكتملة، للمحافظة على التركيز المستمر.

تجمع هذه النتائج بين أهمية تصميم وتقييم الوكلاء الاستباقيين من خلال اعتبار العمل المفيد، تخصيص الموارد، وتطور ثقة المستخدم كمكونات أساسية.