في عالم الذكاء الاصطناعي السريع التطور، تمثل LatentPress علامة بارزة في مجال ضغط السياقات التاريخية المحادثات والطويلة. بدلاً من استخدام النصوص القابلة للقراءة من قبل الإنسان أو الصور التي تحتاج إلى فك تشفير، تقدم LatentPress تمثيلاً ثالثاً مدهشاً: توكنات الذاكرة المستمرة (Continuous Memory Tokens) التي يمكن لنموذج لغة مجمد قراءتها مباشرة عبر واجهة إدخالها.
تتميز هذه التقنية بكفاءة مدهشة، حيث تستطيع ضغط المعلومات بنسبة تتراوح بين 4 إلى 16 ضعفاً، مع تدريب جزء صغير فقط يتضمن بين 4.2 و26.2 مليون معلمة، وهو ما يمثل حوالي 0.1% من معلمات جهاز فك التشفير.
وعلى منصة التقييم LongMemEval، حققت LatentPress دقة وصلت إلى 0.504 عند ضغط بنسبة 7.70 مرة، متفوقة على الأدلة غير المضغوطة (0.490) وملخصات النصوص (0.184) وضغط النصوص القائم على OCR (0.426 إلى 0.312).
وفي اختبارات LongBench-QA، طابق الكتاب ضمن المجال أو تجاوز القراءة من السياقات الخام عند ضغط يتراوح بين 4 إلى 8 مرات، بينما تخلف ضغط 16 مرة قارب الخام.
تسجل LatentPress أيضًا أوقات كتابة تبلغ 43 مللي ثانية لكل محادثة، مما يجعلها أسرع بكثير من ملخصات النصوص أو عمليات فك التشفير باستعمال OCR، وتكون القراءة أسرع بين 5 إلى 9 مرات من السياقات الخام أو OCR المخزن.
هذه الابتكارات تعزز إمكانية استخدام الرموز اللينة (Soft Tokens) كواجهة معالجة للبيانات تتجاوز النصوص والرؤى، مما يفتح آفاق جديدة أمام البحث والتطبيقات في عالم الذكاء الاصطناعي.
اكتشاف LatentPress: ثورة في ضغط السياق تفوق النصوص والرؤى!
تمثل LatentPress تقنية مبتكرة تضغط السياقات بطريقة جديدة تفوق الأساليب التقليدية. بفضل هذه التكنولوجيا، يمكن لنماذج اللغة أن تصل إلى سرعة ودقة غير مسبوقة في معالجة المعلومات.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
