في عالم الذكاء الاصطناعي المتسارع، يعد مساعدو البريد الإلكتروني إحدى الأدوات الأساسية التي يسعى المستخدمون للاستفادة منها. ولكن، ماذا يحدث عندما يختلف أسلوب التواصل بين المستخدمين؟ دراسة حديثة نُشرت على arXiv، تسلط الضوء على كيفية تأثير تنوع أساليب التعبير على فعالية هذه المساعدات.

تُظهر النتائج أن العديد من الاختبارات الحالية تنجح في قياس أداء المساعدين عندما يُستخدم نفس الطلب بعبارة واحدة فقط. ولكن، هل يمكن أن يؤثر أسلوب الكلام على كفاءة أداء هؤلاء المساعدين؟

لتقييم هذه المسألة، قام الباحثون ببناء نماذج بديلة تشمل خمسة محاور للتواصل وأربع لهجات، وتجريبها على ثلاثة معايير قياسية: خط أنابيب المعزّز لاسترجاع المعلومات (Retrieval-Augmented Generation) ووكيلين يستخدمان أدوات. كان الاختبار صادماً، حيث أظهرت النتائج أن الطلبات غير المباشرة تنخفض أداؤها عبر جميع المعايير، في حين أن الطلبات الرسمية تؤدي إلى انخفاض الأداء في معايير الوكالة.

أظهرت الفحوصات الدقيقة لأنظمة الذكاء الاصطناعي أن هذه الإخفاقات لها أسباب مختلفة. الطلبات المطولة تضعف أداء نظام استرجاع المعلومات، بينما تبقى الأشكال غير المباشرة واللهجات ضارة حتى عند استرجاع البريد الإلكتروني الصحيح. وفي السياق الوكالي، تسبب الطلبات غير المباشرة والرسمية في عدم اتخاذ الوكلاء للإجراءات الضرورية بدلاً من زيادة الإجراءات غير المدعومة.

توضح هذه النتائج أن الاستجابة الناجحة ليست كافية لإثبات موثوقية الأداء؛ لذا يجب أن تشمل التقييمات تنوع أساليب التعبير وقياس ما إذا كانت الوكلاء تكمل العمل المطلوب. لذا، يطرح السؤال: كيف يمكن لمطوري الذكاء الاصطناعي معالجة هذه التحديات لتحسين أداء المساعدين؟