Dots OCR

Dots OCR

识别任意人类文字与符号

8,875GitHub
❤️1
应用介绍

这是一个拥有 30 亿参数的多模态模型,由一个 12 亿参数的视觉编码器和一个 17 亿参数的语言模型组成。该模型旨在实现通用可访问性,能够识别几乎所有人類书写系统。除了在同类规模模型中于标准多语言文档解析任务上达到当前最先进(SOTA)水平外,dots.ocr-1.5 还能将结构化图形(如图表和示意图)直接转换为 SVG 代码、解析网页界面并定位场景文本。此外,该模型在通用 OCR、目标定位与计数等任务中也展现出极具竞争力的性能。

应用截图
Screenshot 1
Screenshot 2
Screenshot 3
移动端截图
Mobile Screenshot 1
Mobile Screenshot 2
Mobile Screenshot 3
应用信息
版本
1.0.0
安装包大小
764.05 KB
镜像大小
49.53 MB
更新时间
2026年3月12日
源代码
rednote-hilab
平台支持
PC移动端
关键词
dotsocrmodelapppdfprompt