PaddleOCR VL

PaddleOCR VL

PaddleOCR-VL 1.5 面向真实场景文档解析的多任务 0.9B 视觉语言模型

78,625GitHub
❤️2
应用介绍

面向真实场景文档解析和文本定位识别任务的 SOTA 且资源高效的模型,在正常、扫描、倾斜、弯曲、屏摄与复杂光照六类场景文档解析任务上均取得全面的领先,新增支持文本检测识别任务能力,新增印章识别能力,强化复杂元素(如文本、表格、公式和图表)的识别能力,扩展支持至 111 种语言,同时资源消耗极低。

应用截图
Screenshot 1
Screenshot 2
Screenshot 3
移动端截图
Mobile Screenshot 1
Mobile Screenshot 2
Mobile Screenshot 3
应用信息
版本
1.5.0
安装包大小
770.75 KB
镜像大小
49.53 MB
更新时间
2026年3月4日
源代码
PaddlePaddle
平台支持
PC移动端
关键词
paddleocrmodelapppdfprompt