في عالم تحليل البيانات وتجارب المستخدم، تعتبر عملية قياس انتشار المحتوى (prevalence measurement) من العناصر الجوهرية التي تحتاجها المنصات لضمان جودة المحتوى المقدم. هذا ما تقدمه منصة بينتريست (Pinterest) من خلال نظامها المبتكر الذي يعتمد على نماذج اللغات الضخمة (Large Language Models).

تتبع المنصات الإعلامية عبر الإنترنت النسبة المئوية للإعجابات (impressions) المرتبطة بسمات المحتوى، مما يساعد في تقييم التوازنات ووضع حدود لاختبار A/B (A/B testing). لكن المشكلة تكمن في أن توفير قياسات موثوقة يعتمد على نماذج اللغات الضخمة غالباً ما يكون مكلفاً ويتطلب موارد هائلة عند إجراء التجارب على نحو متكرر خلال اليوم.

لحل هذه المعضلة، قامت بينتريست بتطبيق نظام لقياس انتشار مركزي يعتمد على معايير وتقييمات مستمرة من نماذج اللغات الضخمة، مما يقلل التكاليف بصورة كبيرة ويسمح بالتوسع عبر العديد من التجارب في ذات الوقت. يتم تحديث المعايير بشكل مستمر من خلال تدفق بيانات مميزة، مما يضمن دقة القياس عبر كل تجربة تجرى على المنصة.

من خلال استخدام هذا النظام المتطور، تنجح بينتريست في تقديم قياسات موثوقة عبر أكثر من 100 تجربة في اليوم، مع خفض التكاليف المرتبطة بالقياسات الفردية. ويوفر هذا النظام، وفقًا للإحصائيات، تقديرات قريبة من النقاط المرجعية لنماذج اللغات الضخمة بنسبة تصل إلى 92% دورياً.

بفضل هذا الابتكار، يمكن للفرق العاملة دون بنية تحتية مماثلة تبني نفس النمط في عملها عن طريق إنشاء نظام تدريجي للقياس، مما يقلل التكاليف بشكل كبير. إن استخدام الذكاء الاصطناعي في قياسات الانتشار هو خطوة مهمة نحو مستقبل أكثر كفاءة وإنتاجية في عالم التحليل البيانات.