أعلنت شركة جينا آي (Jina AI) بفخر عن إصدارها الجديد، وهو نموذج معالجة الوثائق jina-ocr-v1. هذا النموذج الابتكاري يمتلك 3.4 مليار معامل (parameters) ويهدف إلى تحويل مجموعة واسعة من المحتويات البصرية، بما في ذلك ملفات PDF، والرسوم البيانية، والفواتير، إلى نصوص واضحة ومنسقة بتنسيق Markdown. يعتمد النموذج على تطور تقنية DeepSeek-OCR، حيث يستخدم خوارزمية متعددة الامتيازات (MoE) لتعزيز كفاءته.

وما يميز jina-ocr-v1 هو رأس الترميز (decoding head) المدمج FastMTP، الذي يعمل على صياغة 3 رموز (tokens) في كل خطوة مع الحفاظ على خروج البيانات من دون فقدان أي معلومات. وعلى الرغم من التحديات، حقق النموذج أداءً مبهراً في اختبارات القياس، حيث سجل 91.14 على OmniDocBench v1.6 و83.4 على olmOCR-Bench.

الجدير بالذكر أن هذه التقنية قادرة على معالجة 2.57 صفحة في الثانية عند استخدام معالج A100، مما يجعلها اختيارًا مميزًا للمستخدمين الذين يسعون إلى الفعالية دون تجاوز ميزانياتهم.

يمكن للمستخدمين الوصول إلى الأوزان الخاصة بالنموذج عبر منصة Hugging Face بموجب رخصة CC BY-NC 4.0، كما يمكن الاستفادة من الوصول المستضاف من خلال خدمة Jina Reader.

إذا كنت تبحث عن حل مبتكر لتحويل الوثائق وتنظيم المعلومات بشكل أسرع وأكثر دقة، فلا تفوت فرصة تجربة jina-ocr-v1.