ModelosCódigo Aberto 🇺🇸 27.07.2026 11:04

PP-OCRv6 no Hugging Face: reconhecimento de texto em 50 idiomas com modelos de 1,5M a 34,5M de parâmetros

PaddleOCR (Baidu)PaddleOCR (Baidu)
O PP-OCRv6, a mais recente geração da família de modelos OCR universais do PaddleOCR, já está disponível no Hugging Face. Ele oferece três níveis de modelo (tiny, small, medium) variando de 1,5M a 34,5M de parâmetros, com os níveis médio e pequeno suportando 50 idiomas. O modelo introduz melhorias na detecção e reconhecimento, alcançando até 86,2% de Hmean de detecção e 83,2% de precisão de reconhecimento.
O PP-OCRv6 é a mais recente geração da família de modelos OCR universais do PaddleOCR, projetado para detecção e reconhecimento de texto em cenários reais, como documentos, capturas de tela, imagens multilíngues, displays digitais, etiquetas industriais e texto de cena. Ele varia de 1,5 milhão a 34,5 milhões de parâmetros com três níveis: tiny, small e medium. Os níveis medium e small suportam 50 idiomas, incluindo chinês simplificado, chinês tradicional, inglês, japonês e 46 idiomas de escrita latina. Nos benchmarks oficiais do PaddleOCR, o PP-OCRv6 medium alcança 86,2% de Hmean na detecção e 83,2% de precisão no reconhecimento, superando o PP-OCRv5 server em +4,6 e +5,1 pontos percentuais, respectivamente. O modelo usa o PPLCNetV4 como backbone unificado, com RepLKFPN para detecção e EncoderWithLightSVTR para reconhecimento. Pode ser implantado com múltiplos backends: Paddle Inference, Transformers e ONNX Runtime. Os modelos estão disponíveis no Hugging Face Hub nos formatos safetensors, Paddle inference e ONNX.
Fonte: Hugging Face blog — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas