في عالم البحث العلمي، تساهم نماذج اللغات الضخمة (Large Language Models) في إعادة تشكيل الطرق التي نتعامل بها مع البيانات والمعلومات. دراسة جديدة تناولت كيفية استخدام هذه النماذج لتسهيل عمليات مراجعة الأدبيات بطريقة منهجية، خصوصًا فيما يتعلق بنماذج انتشار الأمراض.

تشير النتائج إلى تطوير خط أنابيب جديد يستخدم نماذج لغوية ضخمة لاستخراج المعلومات النموذجية من 536 ورقة بحثية تمت مراجعتها من قبل الأقران، حيث تم مقارنة النتائج بنتائج تم الحصول عليها من مراجعة أدبية أُجريت بواسطة باحثين بشريين.

تظهر الدراسات أن دقة النتائج على مستوى الورقة كانت حوالي 77.95% لنموذج GPT-4.1 و81.67% لنموذج GPT-5.0. بينما تتراوح الدقة على مستوى الحقول بين 32.40% إلى 100.00%، مع وجود مجالات أكثر تعقيدًا أو ذات طابع ذاتي يظهر فيها أداء أقل موثوقية.

تعد قلة الاتفاق بين النماذج مؤشرًا محتملًا على جودة المخرجات، حيث قد تشير الاختلافات الكبيرة إلى وجود أخطاء. بينما يمكن أن تشير التوافقية العالية مع دقة قليلة إلى وجود ضوضاء أو أخطاء في البيانات البشرية.

بشكل عام، تقدم هذه الدراسة رؤى عملية في تطوير المحفزات وتسلط الضوء على إمكانية وقيود استخدام نماذج اللغات الضخمة لتقنية مراجعات الأدبيات الشاملة في مجال النمذجة والمحاكاة.