في عالم الذكاء الاصطناعي، تُعتبر مشكلة 99 برولوج (P-99) واحدة من أشهر التحديات في البرمجة المنطقية. وقد قامت مجموعة من الباحثين مؤخرًا بخوض تجربة مثيرة في حل 33 من هذه المشاكل باستخدام نموذج لغة ضخم (LLM) هو "كلود" (Claude) من شركة أنثروبيك (Anthropic).
تبدأ التجربة بتحديد المجملات غير الرسمية للمسائل باللغة الإنجليزية، حيث تم الاعتماد على "كلود" لتوليد شيفرات برولوج بشكل آلي. هذه العملية لا تعني فقط كتابة الأكواد، بل تجاوزت ذلك لتشمل إنشاء ملفات اختبار (test files) وتشغيلها للتحقق من نجاحها.
كما استخدم الباحثون أداة LPTP (Logic Program Theorem Prover) لإثبات خصائص دقيقة للشيفرات المولدة مثل الصحة (groundness) والانتهاء (termination) والانفراد (uniqueness)، بالإضافة إلى التحقق الوظيفي (functional correctness). قدّم "كلود" خلال هذه التجربة 58 إجراءً منطقيًا، 508 اختبارات، و257 مبرهنة، بمجموع 11800 سطر إثبات.
كما أجرى الفريق مراجعة يدوية لكل ملف تم إنشاؤه، حيث تم التحقق من الكود البرولوجي، وتشغيل الاختبارات، وفحص البيانات المنطقية المولدة، بالإضافة إلى التحقق من الإثباتات المقدمة من قبل "كلود" باستخدام LPTP. توضح هذه الورقة التجريبية تفاصيل هذه العملية، مما يتيح للمهتمين إمكانية إعادة إنتاجها بسهولة.
ما رأيكم في هذا الاستخدام المبتكر لنماذج اللغة الضخمة؟ نسعد بتعليقاتكم وتفاعلاتكم!
تحول مذهل: كيف أنشأت نماذج اللغة الضخمة كود برولوج ل99 مشكلة!
تمكن الباحثون من حل 33 مسألة من مجموعة تحديات برولوج الشهيرة باستخدام نموذج لغة ضخم (LLM). التجربة أثبتت فعالية عالية في توليد الشيفرات والتحقق من صحتها.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
