في عالم الأدب، تتداخل الأبعاد الثقافية والعاطفية والفلسفية بشكل معقد، مما يجعل تقييم جودة السرديات عملية تستدعي فهماً عميقاً. ومن هنا، يبرز إطار SAGE كأداة مبتكرة لتقييم هذه الجوانب بطريقة منهجية.

SAGE، الذي يعدّ اختصارًا لـ 'إطار تقييم جودة الأدب السردي'، يتألف من ستة طبقات تقييمية، حيث يقسم بين التقييم القائم على قواعد صارمة للأبعاد النصية القابلة للملاحظة والتقييم القائم على نماذج اللغات الضخمة (Large Language Models) للجوانب التفسيرية المستمدة من الثقافة والنظرية العاطفية والفلسفة الوجودية.

تحت كل طبقة تفسيرية، يتم تقييم المواد الاستبنائية عبر جولات متعددة من التقويم الذاتي باستخدام نماذج اللغات الضخمة. نتائج الدراسة تشير إلى درجة موثوقية تصل إلى 98.8%، وهنا تبرز أهمية الارتباط بين التقييمات المختلفة.

عند اختبار الإطار على 600 تقييم تشمل 100 قصة قصيرة، اكتشف الباحثون وجود حدود نظامية مثيرة للاهتمام: تمثل التقديرات العاطفية والنفسية مستويات قريبة من الأداء البشري، بينما ظهرت فجوات أكبر فيما يتعلق بالنقد الثقافي والعمق الفلسفي.

القصص المولدة بواسطة نماذج اللغات الضخمة جاءت دون مستوي الجودة المعروفة للأعمال الأدبية التجارية في جميع الطبقات الثلاث، مما يسلط الضوء على الفجوة بين القدرات الأدبية التقليدية والقدرات التي تتطلب مواقف ثقافية وتفاعل فلسفي. يعتبر هذا الاكتشاف نداءً لفهم عميق لكيفية تقييم وتوجيه الأعمال الأدبية في عصر الذكاء الاصطناعي.