في خطوة رائدة نحو تحسين استخدام الأدوات في مؤسسات الأعمال، أعلنت شركة سالزفورس (Salesforce) عن تطوير نموذجها اللغوي الجديد "كوا" (Koa). يعتمد هذا النموذج على تقنية التعلم المعزز باستخدام أسلوب Group Relative Policy Optimization (GRPO) بعد تدريبه على نموذج الأساس الشهير "نيموترون-3-سوبر-120B" (Nemotron-3-Super-120B).
تجدر الإشارة إلى أن نموذج كوا تم تدريبه باستخدام بيانات عامة وبيانات مولدة بشكل اصطناعي، مع الحفاظ على سرية بيانات العملاء، مما يضمن تحسين قدراته في استخدام الأدوات وتعزيز إمكانات التعاملات الذكية بدون المساس بالأمان.
يتميز كوا بخوارزمية مبتكرة تعتمد على "خط أنابيب المحاكاة إلى المكافأة" (simulation-to-reward pipeline)، التي تسهم في توسيع المواصفات الخاصة بسير العمل إلى مهام متعددة الأدوار مع مكافآت قائمة على نجاح استخدام الأدوات في طلبات تعتمد على البيانات.
لخدمة المجالات المؤسسية، تتم كتابة هذه المواصفات بلغة "سيناريو الوكيل" (Agent Script)، وهي لغة مكتوبة من سالزفورس لتطوير وكلاء Agentforce. بينما في المجالات العامة لاستخدام الأدوات، يتم توليد هيكل سير العمل مباشرة.
وفقاً للنتائج التي تم الإعلان عنها، أظهر نموذج كوا تحسناً ملحوظاً مقارنةً بنموذجه الأساسي، حيث حقق مكاسب واضحة في استخدام الأدوات متعددة الأدوار، متجاوزًا معياراً قوياً خاصًا، مع كونه دون النماذج الرائدة الأكثر قوة.
تدل هذه النتائج على أن التعلم المعزز المدفوع بالمواصفات يمثل مسارًا عمليًا لتخصيص نماذج الأساس ذات الأوزان المفتوحة لمهام الأعمال الذكية. **فما رأيكم في هذا التطور الجديد؟ شاركونا آراءكم في التعليقات!**
سالزفورس كوا: نموذج لغوي مبتكر يعزز استخدام الأدوات في المؤسسات!
تكشف سالزفورس عن نموذجها اللغوي الجديد كوا، الذي يمثل طفرة في تطوير ذكاء اصطناعي موجه للمؤسسات، مما يساهم في تحسين استخدام الأدوات بكفاءة. انطلقوا معنا لاستكشاف خصائص هذا النموذج الثوري!
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
