Ailoxa Logo

🏷️ #MoE

9 مقال

تعرّف على فري توكن: محرك الخدمة المتقدم القائم على الحافة الذي يدير 753 مليار نموذج GLM-5.2 على وحدة معالجة واحدة!
أدوات

تعرّف على فري توكن: محرك الخدمة المتقدم القائم على الحافة الذي يدير 753 مليار نموذج GLM-5.2 على وحدة معالجة واحدة!

مارك تيك بوستمنذ 1 شهر
👁 3
اكتشف نموذج Qwen3.8-2.4T-A95B من Alibaba: ثورة في الذكاء الاصطناعي!
نماذج لغوية

اكتشف نموذج Qwen3.8-2.4T-A95B من Alibaba: ثورة في الذكاء الاصطناعي!

مدونة إنفيديا للذكاءمنذ 1 شهر
تكنولوجيا TEXAS: إشراف ذكي متكيف لموديلات اللغة متعددة الخبراء
نماذج لغوية

تكنولوجيا TEXAS: إشراف ذكي متكيف لموديلات اللغة متعددة الخبراء

أركايف للذكاءمنذ 1 شهر
👁 3
ثورة جديدة في نماذج اللغة: LLaDA MoE v2 تصل إلى آفاق جديدة في الذكاء الاصطناعي!
أبحاث

ثورة جديدة في نماذج اللغة: LLaDA MoE v2 تصل إلى آفاق جديدة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
👁 2
افتتاح مصدر نموذج Mixture-of-Kittens: قفزة نوعية في تقنيات التدريب باستخدام MoE
أدوات

افتتاح مصدر نموذج Mixture-of-Kittens: قفزة نوعية في تقنيات التدريب باستخدام MoE

مارك تيك بوستمنذ 2 شهر
👁 7
VEN-VL: إطار عمل مبتكر لفهم متعدد الوسائط بشكل فعال وذكي!
أبحاث

VEN-VL: إطار عمل مبتكر لفهم متعدد الوسائط بشكل فعال وذكي!

أركايف للذكاءمنذ 4 شهر
👁 7
التحليل الأمني لتوجيه نماذج Mixtral MoE: هل تسهم الزناديات في سلامة الذكاء الاصطناعي؟
أبحاث

التحليل الأمني لتوجيه نماذج Mixtral MoE: هل تسهم الزناديات في سلامة الذكاء الاصطناعي؟

أركايف للذكاءمنذ 4 شهر
إطلاق نموذج Command A+ من Cohere: ثورة في الذكاء الاصطناعي باستخدام أقل من GPU واحد!

إطلاق نموذج Command A+ من Cohere: ثورة في الذكاء الاصطناعي باستخدام أقل من GPU واحد!

مارك تيك بوستمنذ 4 شهر
👁 2
تحويل نماذج الخبراء الثابتة إلى ديناميكية: كيف يمكن لتقنية ZEDA تسريع الأداء وتقليل التكاليف؟
أبحاث

تحويل نماذج الخبراء الثابتة إلى ديناميكية: كيف يمكن لتقنية ZEDA تسريع الأداء وتقليل التكاليف؟

أركايف للذكاءمنذ 4 شهر