نصوص التعرف البصري القديمة تجعل نماذج اللغة تتعلم بكفاءة 30 بالمئة فقط – مشروع FineBooks يهدف إلى تغيير ذلك
اختبر مشروع FineBooks من Hugging Face وEleutherAI 14 نموذجًا مفتوحًا للتعرف البصري على أكثر من 2000 صفحة من الكتب التاريخية. وتُظهر النتائج أن النماذج الأصغر غالبًا ما تتفوق على المنافسين الأكبر، حيث حقق النموذج الأفضل دقة تزيد عن 97 بالمئة في الأحرف بتكلفة أقل من دولارين لكل ألف صفحة. ووفقًا للمؤلفين، فإن الجودة كافية لتدريب الذكاء الاصطناعي ولكنها ليست كافية بعد للأغراض الأكاديمية.
Hugging Face
EleutherAI
PaddleOCR (Baidu)
LightOn
DeepSeek
The Decoder (DE)10.08 · 21:02
