في الآونة الأخيرة، شهدت مجالات الجراحة المعتمدة على الذكاء الاصطناعي (AI) تقدمًا ملحوظًا يدعو للتفاؤل. نُقدم لكم اليوم تقنية سيرجراو (SurgRAW)، التي تمثل قفزة نوعية في معالجة الفيديو الجراحي. وهذا يعد خصيصة أساسية لتعزيز دقة العمليات الجراحية ودعم العاملين في المجال.

تعتبر الجراحة المدعومة بالروبوت (Robotic-Assisted Surgery - RAS) من مفاتيح تطوير التقنيات الطبية الحديثة، إلا أن معظم الأنظمة الحالية تعتمد على نماذج معزولة ومتخصصة بمهام معينة، مما يؤدي إلى انقطاعات في سير العملية وتفسير محدود. بالرغم من أن نماذج الرؤية مع اللغة (Vision-Language Models - VLMs) تقدم قدرات قوية في التفكير العميق، إلا أنها غالبًا ما تواجه مشاكل تتعلق بالتخيل والاختلافات في نطاق البيانات.

لذا، تم تقديم سيرجكو تي بنش (SurgCoTBench)، وهو معيار جديد يركز على التفكير في الجراحة، ويشمل 14256 مجموعة QA مع ملاحظات على مستوى الإطار عبر خمس مهام جراحية رئيسية. بناءً على هذا الطرح، تم تطوير سيرجراو، وهو نظام يتبع نهجاً تفاعلياً يعتمد على سلسلة من الأفكار لتحقيق التفكير متعدد المهام في مجال الجراحة.

يستفيد نظام سيرجراو من تدفق عمل هرمي حيث يقسم فهم المشهد الجراحي إلى مسارين تفكير، مما يضمن تفاعل الوكلاء المتخصصين بشكل فعال. بالإضافة إلى ذلك، يتم تضمين آلية نقاش لتعزيز التعاون بين الوكلاء المتخصصين بدلاً من العمل بشكل فردي. وقد أثبتت التجارب أن سيرجراو يتفوق على الأنظمة المعتمدة على الرؤية مع اللغة وكذلك الأنظمة الوكيلة بمعدل دقة أعلى بنسبة 14.61%.

للاستزادة، يمكنكم الوصول إلى مجموعة البيانات والكود عبر هذا الرابط [https://github.com/jinlab-imvr/SurgRAW.git]. هل أنتم مستعدون للانطلاق في رحلة الابتكار في مجال الجراحة؟ شاركونا آرائكم في التعليقات!