ModelleOpen Source 🇺🇸 27.07.2026 11:04

PP-OCRv6 auf Hugging Face: Texterkennung in 50 Sprachen mit Modellen von 1,5M bis 34,5M Parametern

PaddleOCR (Baidu)PaddleOCR (Baidu)
PP-OCRv6, die neueste Generation der universellen OCR-Modellfamilie von PaddleOCR, ist jetzt auf Hugging Face verfügbar. Es bietet drei Modellstufen (tiny, small, medium) von 1,5 Millionen bis 34,5 Millionen Parametern, wobei die Stufen medium und small 50 Sprachen unterstützen. Das Modell führt Verbesserungen bei der Erkennung und Detektion ein und erreicht eine Detektions-Hmean von bis zu 86,2 % und eine Erkennungsgenauigkeit von bis zu 83,2 %.
PP-OCRv6 ist die neueste Generation der universellen OCR-Modellfamilie von PaddleOCR und wurde für die Texterkennung und -extraktion in realen Szenarien entwickelt – darunter Dokumente, Screenshots, mehrsprachige Bilder, digitale Anzeigen, industrielle Etiketten und Text in natürlichen Umgebungen. Die Modellreihe umfasst drei Größen (Tiny, Small und Medium) mit Parameterzahlen von 1,5 Mio. bis 34,5 Mio. Die Varianten Medium und Small unterstützen 50 Sprachen, darunter vereinfachtes Chinesisch, traditionelles Chinesisch, Englisch, Japanisch sowie 46 Sprachen mit lateinischem Alphabet. In den offiziellen Benchmarks von PaddleOCR erreicht PP-OCRv6 Medium eine Erkennungs-gemittelte F1-Metrik (Hmean) von 86,2 % und eine Erkennungsgenauigkeit von 83,2 %. Dies entspricht einer Verbesserung um 4,6 beziehungsweise 5,1 Prozentpunkte gegenüber dem PP-OCRv5 Server. Als einheitliches Backbone dient PPLCNetV4, ergänzt durch RepLKFPN für die Detektion und EncoderWithLightSVTR für die Texterkennung. Die Bereitstellung erfolgt über mehrere Backends: Paddle Inference, Transformers und ONNX Runtime. Die Modelle sind auf dem Hugging Face Hub in den Formaten Safetensors, Paddle Inference und ONNX verfügbar.
Quelle: Hugging Face blog — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten