في عالم يتطور بسرعة في مجال الذكاء الاصطناعي، تم إطلاق معيار ASI-Bench كخطوة ثورية تهدف إلى تقييم قدرة الأنظمة الذكية على الابتكار واستقلالية البحث العلمي. بينما تظل الأنظمة الحالية معتمدة على المعرفة البشرية، يسعى ASI-Bench لاختبار مدى قدرة هذه الأنظمة على تجاوز ذلك.
تأسس ASI-Bench بجهود أكثر من 40 خبيرًا وبإجمالي تكلفة 31,000 ساعة بشرية، ويحتوي على 60 مهمة بحثية موزعة عبر 11 مجالًا علميًا مختلفًا. يهدف هذا المعيار إلى تقييم الأداء في سياقات جديدة، حيث يتم تقليص الدعم الإرشادي البشري بشكل متتابع خلال نفس المشروع البحثي، مما يساعد في قياس قابلية الذكاء الاصطناعي على اتخاذ القرارات بشكل مستقل.
خلال التجارب، أظهرت النتائج أن الأنظمة آلتمتك والمتطورة تعاني من انخفاض كبير في الدرجات عندما نحتاج منها إلى الإنشاء الذاتي للطريقة البحثية. على سبيل المثال، مع تقديم توجيه كامل، كان المعدل 50.91، ولكن مع تقليص التوجيه انخفض المعدل إلى 29.10 وفي حال مطالبة الأنظمة بتحديد الطريقة بأنفسها انخفض لأقل من 27.
يوبّين هذا التراجع الواضح الاعتماد الكبير للأنظمة الحالية على دعم البشر، مما يعني أن الطريق ما زال طويلاً قبل أن تتمكن هذه الأنظمة من إجراء الأبحاث العلمية بشكل مستقل ومتكامل. ASI-Bench متاح للجميع، ويدعو الباحثين والمبتكرين إلى المساهمة في تطوير مهام جديدة وتحدي حدود الذكاء الاصطناعي الحالي من خلال زيارة https://asibench.apexin.ai/submit. انضموا إلى هذه الرحلة لمساعدة البشرية في تحقيق الذكاء الاصطناعي الفائق!
اكتشاف ذروة الذكاء الاصطناعي: ASI-Bench يفتح آفاق جديدة للعمق العلمي
تم إطلاق ASI-Bench، وهو معيار جديد يهدف لاختبار قدرة الأنظمة الذكية على الابتكار والتحقيق العلمي بشكل مستقل، مما يمهد الطريق نحو الذكاء الاصطناعي الفائق. هذا الابتكار يعد خطوة جريئة نحو تعزيز إمكانيات الذكاء الاصطناعي في مستقبل غير مسبوق.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
