في خطوة جديدة تُعرّف أدوات الذكاء الاصطناعي، أطلقت مايكروسوفت نموذج "MAI-Transcribe-2-Streaming"، الذي يُعتبر أول نموذج لتحويل الكلام إلى نص في الوقت الحقيقي. هذا الابتكار الرائد جاء بنتيجة مذهلة، حيث حصل على المركز الأول بين 38 نموذجًا على منصة التحليل الاصطناعي، "Artificial Analysis".
لقد سجل النموذج دقة مذهلة تصل إلى 2.5% في معدل الخطأ في النصوص النهائية (WER) في زمن قدره 0.13 ثانية، بالإضافة إلى دقة بلغت 2.5% في أول ترجمات جزئية بمعدل 0.12 ثانية.
يُعَدّ "MAI-Transcribe-2-Streaming" واسع النطاق، حيث يدعم أكثر من 60 لغة ويتضمن تقنية الكشف التلقائي عن اللغة. كما أنه يُقدّم بسعر جذاب يصل إلى 0.54 دولار للساعة خلال فترة التقديم الخاصة.
النموذج متاح الآن في العرض العام على منصة "Microsoft Foundry"، مما يسهل على المطورين والباستخداميين استخدام هذه التقنية المتقدمة.
تستمر مايكروسوفت في تحقيق الريادة في مجالات الذكاء الاصطناعي، مما يجعلنا نشعر بشغف لمعرفة كيف ستشكل هذه الابتكارات المستقبل. هل ترغب في تجربة هذا النموذج؟ شاركنا برأيك في التعليقات!
مايكروسوفت تطلق MAI-Transcribe-2-Streaming: النموذج الرائد لتحويل الكلام إلى نص في الوقت الحقيقي!
أصدرت مايكروسوفت نموذج MAI-Transcribe-2-Streaming لتحويل الكلام إلى نص في الوقت الحقيقي، محققاً المركز الأول في تصنيف النماذج. يتميز بدقة عالية وتغطية لأكثر من 60 لغة.
المصدر الأصلي:مارك تيك بوست
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
