模型开源 🇺🇸 27.07.2026 11:04

PP-OCRv6 登陆 Hugging Face:支持 50 种语言的文字识别,模型参数量从 150 万到 3450 万

PaddleOCR (Baidu)PaddleOCR (Baidu)
PP-OCRv6 是 PaddleOCR 通用 OCR 模型系列的最新版本,现已可在 Hugging Face 上使用。它提供三个模型档位(tiny、small、medium),参数量从 150 万到 3450 万不等,其中 medium 和 small 档位支持 50 种语言。该模型在检测和识别方面进行了改进,检测 Hmean 值最高可达 86.2%,识别准确率达 83.2%。
PP-OCRv6 是 PaddleOCR 通用 OCR 模型系列的最新一代,专为真实场景中的文本检测与识别而设计,涵盖文档、截图、多语种图像、数字显示、工业标签及场景文本。该系列模型参数量从 1.5M 到 34.5M 不等,分为 tiny、small 和 medium 三个规格。其中 medium 和 small 规格支持 50 种语言,包括简体中文、繁体中文、英语、日语及 46 种拉丁字母语言。在 PaddleOCR 官方基准测试中,PP-OCRv6 medium 模型的检测 Hmean 达到 86.2%,识别准确率为 83.2%,相比 PP-OCRv5 server 模型分别提升 4.6 和 5.1 个百分点。该模型采用 PPLCNetV4 作为统一骨干网络,检测部分使用 RepLKFPN,识别部分采用 EncoderWithLightSVTR。它可通过多种后端进行部署,包括 Paddle Inference、Transformers 和 ONNX Runtime。模型已以 safetensors、Paddle 推理格式和 ONNX 格式上架 Hugging Face Hub。
来源: Hugging Face blog — 原文
我们之前关于此话题的帖子 ↓
最新新闻