في عالم الذكاء الاصطناعي، تُعتبر القدرة على إدارة الوقت عنصرًا أساسيًا لضمان أداء فعال. وقد تم الكشف مؤخرًا عن نظام جديد يُعرف باسم AgentTime، يهدف إلى تقييم قدرة الوكلاء الذكيين على تقدير والتحكم في فترات العمل الخاصة بهم. يتطلب هذا النظام وجود وعي زمني، مما يمكّن الوكلاء من التنبؤ بالوقت الفعلي المستغرق لأداء المهام.

حتى الآن، ركزت الأبحاث في هذا المجال على فهم الوعي الزمني، لكن القليل من الدراسات استكشفت كيفية متابعة المدة الزمنية والتحكم بها في بيئات العمل المتكاملة للوكلاء. يتضمن AgentTime 222 مهمة من 18 مصدرًا مختلفًا، تشمل البرمجة، واستخدام الحاسوب، وأفكار العمل الذكي.

تشير النتائج إلى تباين كبير في دقة الوكلاء في اتباع التعليمات المتعلقة بالمدة الزمنية للعمل. على سبيل المثال، كان أداء نموذج Claude Code بعيدًا عن دقة التوقيت المطلوبة بنسبة 2.9 مرة، بينما كان نموذج GPT-6 Astra أكثر دقة بنسبة 1.2 مرة فقط. لكن انتباهنا لا يجب أن يقتصر فقط على مدي قدرة الوكلاء على إنجاز المهام، بل أيضًا على كيفية إدارتهم للوقت خلالها.

تتضمن التجارب المطبقة توجيهات محددة بالمدة الزمنية المطلوبة، وتتراوح هذه المدة من دقيقة واحدة إلى عدة أيام. ومع ذلك، تظهر النتائج أن مجرد مطابقة الوكلاء للمشغل الزمني المطلوب لا يعني أنهم سيكونون قادرين على إتمام العمل بفعالية. فبعض الوكلاء أظهروا سلوكيات غير متوقعة، حيث عُثر على أن 14 من بين 158 تجربة أجراها Astra قد توقفت بعد إتمام ما يبدو أنه عمل مكتمل.

وبالإضافة إلى ذلك، تظهر التنبؤات عادةً زيادة في تقديرات أوقات العمل بعوامل تفوق التقديرات الطبيعية. هذه النتائج تشير بوضوح إلى أن النجاح في إكمال مهمة لا يعني بالضرورة قدرة العميل على التحكم في وقته أو ضمان العمل طوال المدة المطلوبة.

لطالما كانت الحاجة ملحة لتوفير تقييم شامل لقدرة الوكلاء على العمل بشكل موثوق وآمن ومستقل لفترات زمنية طويلة. لذا، فإن دراسة AgentTime تمثل خطوة مهمة نحو تحقيق تلك الأهداف.