في خطوة غير مسبوقة، أعلنت Google عن إطلاق نموذجها الأكثر تطوراً في مجال نماذج الحوار المباشر، وهو Gemini 3.8 Live، بالإضافة إلى النسخة المطورة منه Gemini 3.8 Live Extended Thinking. تتميز هذه النماذج بقدرتها الفائقة على تنفيذ أدوات واستدعاءات API في الخلفية أثناء سير المحادثة، مما يجعل التفاعل أكثر سلاسة وطبيعية.

تتمتع نماذج Gemini 3.8 بقدرة مذهلة على التعامل مع المدخلات المرئية، مما يعني أنها تستطيع تحليل المحتوى المرئي والتفاعل معه دون انقطاع. كما أنها تدعم التبديل السلس بين 97 لغة أثناء المحادثات، مما يجعلها أداة مثالية للتواصل الدولي.

حصل نموذج Extended Thinking على تقييم #1 في مؤشر جودة الحديث من Artificial Analysis، حيث حقق 82.6 نقطة. كما حصل على 97.7% في اختبار Big Bench Audio، مما يضمن جودة فريدة في التفاعل الصوتي.

تتوفر هذه النماذج الجديدة عبر Gemini API واستوديو Google AI بسعر 0.005 دولار لكل دقيقة من المدخلات الصوتية، مع توضيح أن جميع البيانات الصوتية التي تم إنشاؤها ستحتوي على علامة مائية من Google DeepMind. هذا الابتكار يمثل خطوة كبيرة نحو تطوير وكلاء صوتيين جاهزين للإنتاج، مما يفتح آفاق جديدة في عالم الذكاء الاصطناعي.

ما مدى أهمية هذه التطورات الجديدة بالنسبة لكم في مجالات الذكاء الاصطناعي وتكنولوجيا المحادثات؟ شاركونا آراءكم في التعليقات!