🏷️ #Mixture of Experts
13 مقال
أبحاث
إطلاق تقنية MESH: تحسين ذاكرة فعال لتدريب نماذج Mixture-of-Experts!
أركايف للذكاءمنذ 28 يوم
👁 2أبحاث
LibMoE: المكتبة الثورية لتقييم نماذج خبراء الخليط في نماذج اللغة الكبيرة!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
رقم قياسي جديد في تدريب نماذج الذكاء الاصطناعي بفضل NVIDIA GB300 NVL72!
مدونة إنفيديا للذكاءمنذ 1 شهر
أبحاث
اكتشفوا ButterflyMoE: ثورة في تقنيات ضغط الذاكرة للذكاء الاصطناعي!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
ثورة جديدة في نمذجة الصور: تعرف على تقنية MEPA المتقدمة لنماذج التوليد الآلي!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
اكتشاف ثوري: OmniMoE يعيد تعريف الكفاءة في أنظمة Mixture-of-Experts!
أركايف للذكاءمنذ 2 شهر
أبحاث
ثورة جديدة في نماذج Mixture-of-Experts: إعادة تصميم مبتكرة باستخدام تقنية Manifold Power Iteration!
أركايف للذكاءمنذ 2 شهر
نماذج لغوية
ثورة تكنولوجيا الذكاء الاصطناعي: التعرف على MobileMoE واستخدامه الفعال في الهواتف الذكية
أركايف للذكاءمنذ 3 شهر
أبحاث
اكتشاف ثوري: LoRA-Mixer يجمع بين تفوق LoRA ونماذج الخبراء المتعددة!
أركايف للذكاءمنذ 3 شهر
أبحاث
إطلاق نموذج EMO: ثورة في التدريب المختلط للخبراء من أجل التحول المعياري!
هاجينج فيسمنذ 3 شهر
نماذج لغوية
ثورة الذكاء الاصطناعي: كيف تُعيد Mixture of Experts (MoEs) تشكيل نماذج التحويلات؟
هاجينج فيسمنذ 6 شهر
أبحاث
قفزات أداء مذهلة: كيف تعيد NVIDIA تشكيل مستقبل الذكاء الاصطناعي؟
مدونة إنفيديا للذكاءمنذ 7 شهر
👁 1أبحاث
مرحبًا بكم في Mixtral: أحدث تقنية Mixture of Experts للتعلّم العميق!
هاجينج فيسمنذ 33 شهر
👁 1