عالم الذكاء الاصطناعي يشهد تقدمًا ملحوظًا مع إطلاق معيار PetQA، الذي يعد الأول من نوعه في تقييم المعرفة البيطرية والتفكير الإكلينيكي. يتألف المعيار من 10,076 سؤالًا مجتمعيًا و8,751 سؤالًا متعدد الوسائط تم تجميعها من استفسارات حقيقية تتعلق بالكلاب والقطط، حيث تمّ صياغتها بجانب الإجابات المقدمة من خبراء بيطريين.

يتميز معيار PetQA، الذي تم تطويره في كوريا، بجزء اختباري خاص يُعرف بـ PetQA-Bench، يتضمن توضيحات لأنواع الأسئلة والحالات السريرية. إلى جانب ذلك، تم تقييم 18 نموذجًا باستخدام مقاييس ROUGE وBERTScore، بالإضافة إلى مقاييس LLM-as-a-judge المتعلقة بالموضوعات الدقيقة ومدى الفائدة تحت ثلاثة إعدادات مختلفة: الاستدلال بدون تدريب (zero-shot inference)، ونظام استرجاع مدعوم بالتوليد (retrieval-augmented generation)، والتدريب الخاضع للإشراف (supervised fine-tuning).

تظهر نتائج التقييم نقاط القوة والقيود في النماذج الحالية في التعامل مع الاستفسارات السريرية البيطرية، فضلاً عن الحاجة إلى طرق تكيف أكثر كفاءة لتطوير أنظمة ذكاء اصطناعي موثوقة في الرعاية البيطرية. لزيادة نطاق الاستخدام، تم توفير إصدارات مترجمة من معيار PetQA-Bench بعدة لغات، مما يفتح آفاقًا جديدة للممارسين البيطريين والباحثين.

فما رأيكم في هذا الابتكار؟ هل تتوقعون أن يؤثر على كيفية دعم الذكاء الاصطناعي للرعاية البيطرية؟ شاركونا آرائكم في التعليقات!