في عالم يتطور بسرعة نحو العولمة والتواصل متعدد اللغات، تأتي مجموعة بيانات جديدة تُعرف بـ AlphaMWE لتشكل انطلاقة مهمة في مجال الترجمة. تتكون AlphaMWE من منصة تعتمد على الترجمة الآلية (Machine Translation) وتكامل الجهود البشرية لتحسين دقة الترجمة. تشمل المجموعة تعبيرات متعددة الكلمات (Multi-Word Expressions) وتغطي عدة لغات منها العربية، الصينية، الإنجليزية، الألمانية، الإيطالية، والبولندية.
تتميز AlphaMWE بأنها تجمع بين التقنيات الحديثة والتحرير البشري، حيث تم استخراج البيانات من مجموعة PARSEME المشتركة لعام 2018. تم تطبيق نظام صارم لمراقبة الجودة، حيث خضعت جميع الترجمة الآلية للتحرير اليدوي والتفحص الثاني للتأكد من دقة البيانات وتصحيح الأخطاء. تشير النتائج إلى أن الترجمة الدقيقة للتعبيرات متعددة الكلمات تمثل تحدياً أمام أنظمة الترجمة الآلية، وهذا ما تم إثباته من خلال استخدام مقياس HOPE في عملية التدقيق.
تعزيزًا للأبحاث المستقبلية في مجال الترجمة، قدمت الدراسة تصنيفات واضحة لأنواع الأخطاء التي تواجه أنظمة الترجمة، مع مقارنة بين أربعة أنظمة رئيسية هي: Microsoft Bing Translator وGoogleMT وBaidu Fanyi وDeepL MT. بفضل تحرير البيانات وتنظيفها، بالإضافة إلى تعليقات من محترفين، نعتقد أن مجموعة بيانات AlphaMWE ستكون أداة هامة للأبحاث المستقبلية في مجال علم المصطلحات المتعددة والوظائف المعلوماتية.
إذا كنتم مهتمين بآخر التطورات في عالم الذكاء الاصطناعي والترجمة، فلا تفوتوا فرصة متابعة هذا التطور الثوري في معالجة الترجمة متعددة اللغات! ما رأيكم في هذا الابتكار الجديد؟ شاركونا في التعليقات.
إطلاق AlphaMWE: ثورة في معالجة الترجمة متعددة اللغات!
قامت دراسة جديدة بتقديم مجموعة بيانات ثورية تدعى AlphaMWE، والتي تجمع الترجمة الآلية بمشاركة البشر لتوفير تعريفات دقيقة للتعابير متعددة الكلمات. هذه المجموعة تغطي لغات عديدة، بما في ذلك العربية، الإنجليزية، والصينية، مما يمثل نقلة نوعية في أبحاث الذكاء الاصطناعي.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
