في عالم الذكاء الاصطناعي، يُعتبر الاكتشاف جزءًا أساسيًا ومسارًا فريدًا لتحقيق المعرفة. ومع ذلك، كان هناك نقص ملحوظ في الأدوات التي تقيم قدرة الذكاء الاصطناعي على اكتشاف حقائق جديدة عبر التجارب في بيئات محكومة. لتغطية هذا الفجوة، تم إطلاق أداة جديدة تُعرف بـ "ديغ-بينش" (DiG-bench)، التي تعني "اكتشاف في الألعاب".

تتضمن أداة ديغ-بينش مجموعة من 70 لعبة مستقلة، حيث كل لعبة مُرمّزة كسلسلة نصية قصيرة ولها قواعد تحول خاصة يجب اكتشافها من خلال التفاعل والتجارب. تقدم مستويات الألعاب سلسلة من التحديات لاختبار ما إذا كانت القواعد قد تم اكتشافها، حيث أن شروط الفوز في كل مستوى غير معروفة أيضاً.

تم تصميم الألعاب لمجموعة متنوعة من مستويات الصعوبة، حيث يسهل المستوى الأدنى حله من قِبل عدة نماذج، بينما يتحدى المستوى الأعلى أفضل النماذج في استخداماتها المعقدة. الجدير بالذكر أن جميع الـ 70 لعبة قد تم حلها من قبل شخص واحد على الأقل في المحاولة الأولى. وتم إطلاق مجموعة مكونة من 21 لعبة للعامة، بينما تم الحفاظ على باقي الألعاب في خصوصية للتقييم الآمن.

تُعد هذه الأداة خطوة كبيرة في البحث عن كيفية تفاعل نماذج الذكاء الاصطناعي مع البيئات المعقدة، مما يفتح آفاقاً جديدة لفهم التطور الذكي. ما رأيكم في هذه التكنولوجيا الجديدة؟ هل تعتقدون أنها ستؤثر على مستقبل الذكاء الاصطناعي؟ شاركونا آراءكم في التعليقات.