في عالم الذكاء الاصطناعي المستمر في التطور، يعد إدخال المعرفة المتخصصة في النماذج اللغوية الضخمة (Large Language Models) تحديًا كبيرًا. رغم أن هذه النماذج تكتسب كميات هائلة من المعرفة أثناء التدريب الأولي، إلا أنها تعاني من نقص في المعلومات الخاصة التي قد تكون ضرورية للإجابة على استفسارات دقيقة تتعلق بمصادر محددة مثل الأدلة أو الوثائق الفنية.
من هنا برزت تقنية KItCAT: تقنية إدخال المعرفة عبر تدريب تلقائي مفسد، التي تعكس تفكيراً جديداً في منهجية التدريب. تعتمد هذه التقنية على تعديل تسلسل المدخلات بشكل عشوائي لإنتاج مدخلات تدريب متنوعة، مما يسهل عملية تحسين الأداء للأنظمة في مجال المعرفة المتخصصة.
الكثير من الأبحاث السابقة عالجت ضرورة توليد شروح متعددة للمعرفة الجديدة، غير أن هذه العملية تتطلب طاقة حسابية كبيرة وقدرات نماذج لغوية متقدمة. ولكن KItCAT تأتي بتسهم بسيط يمكن نماذج اللغة من تقليل حاجة استخدام إعادة الصياغة المجهدة.
تُشمل مكونات KItCAT في تدريب أساسي على توقع العنصر التالي، حيث يتم استبدال جزء عشوائي من الرموز المدخلة برموز أخرى من المفردات، بينما تظل تسميات العنصر التالي الأصلية ثابتة. هذه التدخلات البسيطة تؤدي إلى تنويع مدخلات التدريب بكفاءة عالية وبأقل تكلفة. وقد أظهرت الدراسات أن KItCAT تتفوق بشكل متواصل على الطرق التقليدية المعروفة مثل التدريب المستمر (Continued Pre-training) عبر العديد من مجموعات البيانات وأنظمة النماذج.
تلك التقنية ليست فقط مثيرة للاهتمام ولكن أيضًا تمثل فكرة جديدة في عالم الذكاء الاصطناعي حيث يجري تبسيط التعليم وتخفيف الأعباء الحسابية. يمكنكم متابعة تفاصيل أكثر عن KItCAT واستخداماتها عبر زيارة Github.
فما هي توقعاتكم حول هذه الابتكارات الجديدة في الذكاء الاصطناعي؟ هل تعتقدون أن KItCAT ستحقق نتائج أفضل من الطرق التقليدية؟ شاركونا في التعليقات.
KItCAT: ثورة جديدة في إدخال المعرفة عبر تدريب تلقائي مفسد!
تقدم KItCAT استراتيجية مبتكرة وسهلة لتعزيز نماذج الذكاء الاصطناعي بحصولها على المعرفة المتخصصة من الوثائق النادرة. ستغير هذه التقنية طريقة تدريب النماذج اللغوية التقليدية وتوفر حلولاً أكثر كفاءة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
