DeepSeek OCR 2
本地运行的 DeepSeek OCR(文字识别) 版本 2 模型
应用介绍
驱动 DeepSeek 识别各种文件和图像的大模型,由 DeepSeek 开源。 重要说明: 1. 本应用与 DeepSeek OCR 应用内的第 1 版模型的区别是:第 2 版模型使用了类似人类注意力的识别模式(由 CLIP 编码器转为使用 Qwen VL 编码器) - 优势:在识别杂乱图像会更像 "人类大脑" 自动聚焦处理重点部分的文字那样识别出文字,排版也类似于人类阅读顺序。 - 劣势:因此带来的副作用就是容易出现幻觉,输出也不如第 1 版模型稳定,因此作为独立应用发布。 2. 日常普通图片识别准确度:算力舱内置模型 ≈ DeepSeek OCR > DeepSeek OCR 2 3. 日常普通图片识别速度:算力舱内置模型 >> DeepSeek OCR ≈ DeepSeek OCR 2 4. 对排版要求较高的场景可以尝试使用 DeepSeek OCR 2 或 DeepSeek OCR,它们的排版功能较算力舱内置模型会更优秀
应用截图



移动端截图



应用信息