في خطوة ثورية جديدة، أعلنت شركة OpenBMB عن إطلاق نموذجها المتقدم MiniCPM5-2B، الذي يتميز بكونه نموذجًا لغويًا كثيفًا يتكون من 2,516,756,480 خلية. هذا النموذج الذي يوفر سياقًا بحدود 131,072 توكن، يُظهر أداءً استثنائيًا، حيث يتمتع بمتوسط درجة 53.9 عبر 34 معيارًا مختلفًا، متفوقًا بذلك على النموذج المنافس Qwen3.5-4B الذي حقق 51.1.
يتميز نموذج MiniCPM5-2B بتفوقه في مجالات استخدام الأدوات، تطوير البرمجيات، واسترجاع المعلومات ذات السياق الطويل، مما يجعله خيارًا مثاليًا لتطبيقات الذكاء الاصطناعي التي تتطلب دقة وتنوعًا. تمت عملية تعديل النموذج بعد التدريب باستخدام 400 مليار توكن من بيانات التعلم العميق، مما يعكس التوجيه الفائق ودمج 16 نموذج خبير في نقطة تحقق واحدة.
تأتي الأوزان الخاصة بالنموذج تحت ترخيص Apache 2.0، مصحوبة ببيانات ما قبل التدريب، وبيانات SFT، ونماذج متوسطة لكل من Base وMidtrain وSFT فقط. يبدأ حجم البناء باستخدام GGUF من 1.56 جيجابايت، في حين أن بنية LlamaForCausalLM المعتادة تدعم التحميل عبر vLLM، وSGLang، وllama.cpp، وOllama، وMLX بدون الحاجة إلى تفرع شفرة النموذج.
إذا كنت من المهتمين بأحدث تقنيات الذكاء الاصطناعي، فإن MiniCPM5-2B سيكون محط اهتمامك، عبر ما يقدمه من فوائد وتطبيقات واسعة في العديد من المجالات.
إطلاق MiniCPM5-2B: نموذج ذكاء اصطناعي فائق الأداء يقدم تقنيات ثورية!
أطلقت OpenBMB نموذج MiniCPM5-2B، وهو نموذج لغوي كثيف يتكون من 2.5 مليار خلية ويفتخر بأداء رائع عبر 34 معيارًا. يأتي هذا الابتكار بتقنيات متطورة تعزز تجربة الذكاء الاصطناعي على الأجهزة.
المصدر الأصلي:مارك تيك بوست
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
