في خطوة مبتكرة نحو تعزيز القدرة على استعادة الوثائق التاريخية الصينية، تم الكشف عن إطار عمل تونغ غو سي سي آر (TongGuOCR) الذي يعد طفرة في تقنية التعرف على النصوص (OCR). تاريخيًا، كانت الوثائق الصينية تفتقر إلى إمكانية الوصول الكامل، حيث كانت معظمها متاحة فقط كصور ممسوحة، مما يعوق العملية البحثية والتحليلية.

يأتي تونغ غو سي سي آر ليعالج هذه المشاكل بفضل تقنياته المتقدمة التي تضم شقين رئيسيين. الأول هو وحدة معالجة مسبقة لتجنب ارتباك التخطيطات المعقدة، حيث تصف هذه الوحدة كتل التعرف بشكل محلي، ما يساعد على الحفاظ على السياق المحلي وتخفيف التداخل بين المناطق.

أما الثاني، فهو وحدة التعرف المعززة المرتبطة بالرموز والتي تتوسع في مدى المفردات على مستوى الرموز النادرة، مما يسمح لكل رمز نادر بتمثيل فوري، وبالتالي تسريع عملية فك التشفير. هذه الوحدة تهدف أيضًا إلى نمذجة الانتقالات بين السطور، مما يسهل التنقل بين النصوص ذات التخطيطات المعقدة.

النتائج كانت مثيرة للإعجاب، حيث أظهر إطار تونغ غو سي سي آر أدائه المتميز مقارنة بالنماذج التقليدية وأيضًا النماذج العامة متعددة الوسائط. في اختبار M5HisDoc، حقق تونغ غو 93.76% من معدل الدقة، مما يمثل خطوة نوعية في تسهيل الوصول إلى التراث الثقافي للأجيال القادمة.

لمزيد من التفاصيل والتجربة العملية، يمكنكم زيارة العرض التوضيحي عبر الإنترنت الموجود على الرابط: https://jzzh2004.github.io/TongGuOCR.