يواجه الباحثون والمطورون في بيئات البرمجيات الكبيرة تحديات كبيرة بسبب الفجوة اللغوية بين استفسارات المستخدمين وتفاصيل التنفيذ الفعلية. ولتجاوز هذه العقبة، تم تقديم MediaWiki Code2Code Search، وهو نظام بحث عصبي مصمم لتعزيز اكتشاف الكود بطريقة دلالية.

يعمل النظام على فهرسة 1.29 مليون كيان هيكلي (مثل الدوال والأنواع والقوالب) عبر أكثر من 2500 مستودع من مستودعات MediaWiki، مما يمكن المستخدمين من استرجاع المعلومات بناءً على نيتهم الحسابية وليس الرموز السطحية فقط. يستخدم النظام بنية مقاومة للضغط مع فصل مستمر بين فهرسة نظام GPU المكثفة في وقت عدم التقديم وطبقة الخدمة المستندة إلى CPU فقط، مما يقلل من حجم المؤشر إلى 168.6 ميجابايت.

يتحقق هذا التحسين البارز في الأداء للمستخدمين، حيث يضمن النظام سرعة استجابة متوسطة قدرها 1.85 ثانية على الأجهزة العادية، مما يلبي القيود المفروضة على ذاكرة الوصول العشوائي.

تم اختبار النظام عبر معيار مكون من 27 استفسار، حيث أظهر أداءً متفوقًا مقارنةً بأساليب البحث التقليدية مثل BM25، مع تحقيق نتيجة P@10 تصل إلى 0.87 مقارنة بـ 0.64. كما أن الأداء كان طورًا ملحوظًا في المهام التي تخفق فيها الأساليب اللغوية التقليدية.

هذا الابتكار متاح للجميع عبر الرابط [https://code2codesearch.toolforge.org] بموجب ترخيص Apache 2.0، ويقدم واجهة برمجة تطبيقات RESTful مفتوحة تسهل الوصول إلى الوظائف المتنوعة للنظام.

إذا كنت مطورًا أو باحثًا في مجال البرمجة، فإن MediaWiki Code2Code Search يمثل أداة مثالية تفتح أمامك آفاقًا جديدة في البحث عن الكود البرمجي. ما رأيكم في هذا التطور؟ شاركونا في التعليقات.