في عالم النصوص العلمية، يلعب التعرف على الكيانات العلمية (SciNER) دوراً حيوياً في استخراج المعلومات واكتشاف المعرفة. لقد أظهر استخدام نماذج اللغات الكبيرة (Large Language Models) قدرة كبيرة على تحقيق أداء تنافسي في هذا المجال مع جهد بشري minimun. تشير الأبحاث الحالية إلى أهمية دمج معلومات نوع الكيان لتعزيز دقة التعرف على الكيانات وتصنيفها بواسطة نماذج اللغة.
ومع ذلك، عندما يتم تزويد النماذج بأعداد كبيرة من أنواع الكيانات، تواجه صعوبة في التعرف الدقيق على الكيانات في النصوص العلمية، حيث تكون أنواع الكيانات أكثر تعقيدًا مقارنةً بالمجالات العامة. لمواجهة هذا التحدي، تم اقتراح نهج يسمى TdSciNER والذي يعتمد على معلومات نوع الكيان لتحسين أداء SciNER.
يبدأ هذا النهج بتصميم نموذج فلتر نوع الكيان لتحديد الأنواع الأكثر احتمالاً للكيانات الموجودة في الجملة المدروسة. بعد ذلك، يتم إدخال مهمة تصنيف متعددة الكلاسات كجزء من إطار التعلم المتعدد المهام إلى جانب SciNER للحصول على تمثيلات سياقية أغنى. بالإضافة إلى ذلك، تم تطوير استراتيجية اختيار جديدة مستندة إلى تشابه الجمل وتنوع نوع الكيان لتفعيل قدرات التعلم في سياق نماذج اللغة، مما يعزز دقة التعرف على الكيانات عبر مجالات علمية متنوعة.
أظهرت التجارب على ثلاث مجموعات بيانات أن هذه الطريقة تحقق أداءً مماثلاً للنماذج التي تعتمد على الإشراف الكامل. علاوة على ذلك، تؤكد التحليلات أن كل مكون معتمد على نوع الكيان في TdSciNER يساهم في تحسين أداء SciNER. يوفر هذا العمل رؤى قيمة للتطورات المستقبلية في مجال SciNER ومهام استخراج المعلومات الأوسع في التنقيب عن النصوص العلمية.
اكتشاف الكيانات العلمية بذكاء اصطناعي: نهج مبتكر لتعزيز الدقة في التعرف على الأسماء
تقدم دراسة جديدة نهجاً مبتكراً لتعزيز التعرف على الكيانات العلمية باستخدام نماذج لغوية كبيرة. تهدف هذه الطريقة إلى تحقيق دقة أعلى في تصنيف الكيانات من خلال دمج معلومات نوع الكيان.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
