تواجه تقنية تصنيف الصور الطبية تحديات عديدة، إذ تُعتمد غالباً على الرؤية فقط، بينما يعتمد التحليل السريري على المعرفة النصية بتفاصيل مثل التشريح والموقع والمظهر والسياق المحيط. في هذا السياق، جاء نموذج MedPlex (Medical Plexus of Vision and Language) ليدشّن ثورة في هذا المجال.

تُعتبر MedPlex بنية متكاملة من نماذج الرؤية واللغة (Vision-Language Model - VLM)، تسمح بتوجيه النصوص كعنصر مستمر ومؤثر في تعلم تصنيف الصور الطبية. من خلال تقنية Bi-Fusion (الدمج الثنائي)، يعمل النموذج على تطوير التمثيلات البصرية والنصية بشكل مشترك عبر هرمية الترميز.

ما يميز MedPlex هو تقديم تتطابق المفاهيم على مستوى الفئات والأقاليم، حيث يربط كل هدف تشريحي بملف تعريف سريري مُجمع، بينما يحتفظ بتفاصيل المفاهيم الفردية مثل الشكل والموقع والمظهر والملمس. وهذا يعني أن اللغة تُقدم إشرافاً منظماً خلال عمليات الإدخال، بدلاً من كونها مجرد إشارة في مراحل متأخرة.

لقد حقق MedPlex أداءً رائداً في معايير التصوير بالأشعة المقطعية (CT) والرنين المغناطيسي (MR)، بما في ذلك تقييمات متعددة للأعضاء، وكذلك تقسيم الهياكل القلبية والأورام، حتى في الحالات التي تتطلب إشرافاً سريرياً نصياً حراً.

استعد لمشاهدة كيف يمكن لمثل هذه التقنيات المتطورة أن تُحدث فرقاً كبيراً في مجالات الطب والتصوير! هل أنت مستعد لاستكشاف المزيد حول هذه الابتكارات؟