في زمن تتزايد فيه الاعتماد على نماذج اللغات الضخمة (Large Language Models) لأغراض الإبداع، تبرز إشكالية التحصيل المنتظم لنتائج غنية ومتنوعة. إذ غالبًا ما تفتقر المخرجات إلى الأصالة، بينما يُعتبر تعدد الخيارات أحد العوامل الحاسمة في نجاح هذه النماذج.

تمثل الحلول التقليدية، مثل زيادة درجات السخونة عند أخذ العينات، عائقًا أمام الحفاظ على جودة النتائج. لذا، يعد التوصل إلى توازن بين الدقة والتنوع من التحديات المستمرة في تصميم أنظمة الذكاء الاصطناعي المبدعة.

استنادًا إلى نظرية المعلومات، يقدم الباحثون نظامًا لتقييم النصوص بناءً على سياقات معينة، والذي يسعى بشكل كمي لتقدير القيمة والأصالة. ويهدف هذا النظام إلى تحفيز الدقة والتوافق مع الطلبات، مع تشجيع الفروقات عن التوزيع المتعلم.

أظهر الباحثون أن هذا النظام يمكن أن يُستخدم كمكافأة في إطار تقنيات التعلم المعزز (Reinforcement Learning)، مما يسمح بتحسين تعيين نماذج اللغة الضخمة لتحقيق الأداء الأقصى.

من خلال تجارب شملت مجموعة متنوعة من المهام الإبداعية، مثل توليد الشعر وحل المسائل الرياضية، أوضحوا أن هذه الاستراتيجية تعزز من القيمة والأصالة للمخرجات المولدة، مما يضع معايير جديدة للإبداع في الذكاء الاصطناعي.