على مدار السنوات القليلة الماضية، شهدنا انتشاراً واسعاً لبرمجيات الدردشة والمعاونين المدعومين بنماذج اللغات الضخمة (LLM) كأدوات للكتابة الأكاديمية. وبينما قد توفر هذه الكتابة مزايا هائلة من حيث إزالة حواجز اللغة، إلا أنها تثير أيضاً مخاوف تتعلق بالمخالفات والغش الأكاديمي.

ولفهم مدى تأثير هذه النماذج على الأدبيات العلمية، أصبح من الضروري مراقبة استخدام النصوص المعدلة بواسطة LLMs في المنشورات الأكاديمية. ومع وجود بعض التقدم في هذا المجال، لا توجد حالياً طرق موثوقة لتقديم تقديرات دقيقة.

نقترح طريقة جديدة وغير متحيزة لتقدير استخدام LLM في مجموعة من النصوص، تعتمد على تغيير ترددات الكلمات. طبقنا طريقتنا على النصوص الكاملة للأبحاث الطبية المفتوحة الوصول من مكتبة (Pubmed Central)، ووجدنا أنه بحلول نهاية عام 2025، سيظهر 89% من الأوراق البحثية استخداماً ملحوظاً لمفردات مرتبطة بـ LLMs.

كما أظهرت البيانات أن LLMs مستخدمة بنسبة الضعف عند كتابة فقرة في قسم المناقشة (68%) مقارنةً بنسبة استخدامها في قسم الطرق (32%)، ورغم ذلك، فإن نسبة الاستخدام الكلي لـ LLM داخل قسم الطرق تتجاوز 50%.

يبدو أن هذه التقديرات ستكون حاسمة في تشكيل الإرشادات والسياسات المستقبلية المتعلقة بالكتابة الأكاديمية. لذا، من الضروري على الأكاديميين وصناع القرار أن يتعاملوا مع هذا الاتجاه في أقرب وقت ممكن.