PP-OCRv6 op Hugging Face: tekstherkenning in 50 talen met modellen van 1,5M tot 34,5M parameters
PaddleOCR (Baidu)
PP-OCRv6, de nieuwste generatie van PaddleOCR's universele OCR-modelfamilie, is nu beschikbaar op Hugging Face. Het biedt drie modelniveaus (tiny, small, medium) variërend van 1,5M tot 34,5M parameters, waarbij de medium- en small-niveaus 50 talen ondersteunen. Het model introduceert verbeteringen in detectie en herkenning, met tot 86,2% detectie-Hmean en 83,2% herkenningsnauwkeurigheid.
PP-OCRv6 is de nieuwste generatie van PaddleOCR's universele OCR-modelfamilie, ontworpen voor tekstherkenning en -detectie in de echte wereld, van documenten, screenshots, meertalige afbeeldingen, digitale schermen, industriële labels tot scenetekst. Het schaalt van 1,5 miljoen tot 34,5 miljoen parameters met drie niveaus: tiny, small en medium. De medium- en small-niveaus ondersteunen 50 talen, waaronder vereenvoudigd Chinees, traditioneel Chinees, Engels, Japans en 46 talen met Latijns schrift. Op de officiële benchmarks van PaddleOCR behaalt PP-OCRv6 medium 86,2% detectie-Hmean en 83,2% herkenningsnauwkeurigheid, een verbetering ten opzichte van PP-OCRv5 server van respectievelijk +4,6 en +5,1 procentpunten. Het model gebruikt PPLCNetV4 als uniforme backbone, met RepLKFPN voor detectie en EncoderWithLightSVTR voor herkenning. Het kan worden geïmplementeerd met meerdere backends: Paddle Inference, Transformers en ONNX Runtime. Modellen zijn beschikbaar op Hugging Face Hub in de formaten safetensors, Paddle inference en ONNX.
Bron: Hugging Face blog —
origineel
