meiyouruguo 发表于 2026-7-29 15:28:50

OvisOCR2批量PDF、图片文档识别工具,本地离线

功能介绍
把成堆的扫描件、PDF、截图,一键变成可编辑的 Markdown 或 txt 文档
注意项
解压路径不要包含中文
电脑要求
    ·Windows 系统
    ·NVIDIA 显卡(显卡需要 12G), 显卡驱动更新到最新版本
    ·显存偏小的显卡,可在「参数设置」中下调并发页数、上下文长度、
参数设置
显存占用比/上下文长度/单页最大输出/最大尺度/并发页
8GB 低显存配置:0.75 / 24576 / 8192 / 2048px / 并发1
12GB 标准配置:0.70 / 32768 / 12288 / 2560px / 并发2
16GB 高速配置:0.65 / 32768 / 16384 / 2880px / 并发4



它替你解决什么
你手上有 200 页的 PDF 论文、几百张合同扫描件、一沓财报截图,需要把里面的文字、表格、公式全部提取出来,整理成能编辑的文档。
    手动敲字      —— 一整天没了,还容易出错
    找在线 OCR      —— 要上传文件,涉密资料不敢传,还按页收费
    用传统 OCR      —— 表格散架、公式变乱码、多栏排版读串行

识别效果有多好
底层是开源的 OvisOCR2 模型(仅 0.8B 参数,却相当能打):在权威文档解析榜单 OmniDocBench v1.6 上综合得分 96.58,是首个登顶该榜单的端到端模型 —— 此前榜首长期被结构复杂的多模块流水线方案占据。


    ·正 文    按人类阅读顺序还原,多栏排版不会读串行
    ·表 格    输出标准 HTML 表格,合并单元格也能正确还原
    ·公 式    输出 LaTeX,可直接粘进 Word / Typora / Obsidian
    ·插 图    自动定位图表区域,可裁剪成图片单独导出

为什么值得装
◆ 完 全 离 线
      模型跑在你自己的显卡上,文件一个字节都不会离开这台电脑。合同、病历、财报、内部资料,放心处理。不联网,不上传,不计费。
◆ 真 · 批 量
      支持整个文件夹递归扫描,几百个文件排队自动跑完。多个文件的页面会自动攒成一批送进显卡,吞吐远高于一个一个处理。
◆ 断 点 续 跑
      跑到一半断电了?勾上「跳过已存在的结果文件」再点开始,只补做没完成的部分,已经跑好的不会白费。
◆ 进 度 看 得 见
      左边队列实时显示每个文件的状态、页数、耗时;
      右边同步预览识别结果 —— Markdown 渲染效果、原始源码、原图,
      三个视图随时切换对照,识别得对不对一眼就知道。
◆ 输 出 即 用
      结果与源文件同名,可选保持原有目录层级;
      PDF 可整本合并成一个 .md,也可以每页单独成文件。
◆ 界 面 顺 手
      拖拽添加、深色 / 浅色主题一键切换、参数改完自动记住。
      所有识别参数都在「参数设置」页里,带说明,不用查文档。

适合谁用

    ·需要把纸质 / 扫描资料数字化归档的人
    ·整理论文、教材、技术手册的研究者与学生
    ·处理合同、发票、报表的财务与法务
    ·给知识库 / RAG 准备高质量 Markdown 语料的开发者
    ·任何受够了「复制 PDF 结果全是乱码」的人


OvisOCR2批量PDF、图片文档识别工具下载链接:

下载链接:https://pan.quark.cn/s/80cbf7006e9f
解压密码:aibbs.fun








特困生 发表于 2026-7-29 17:29:48

牛,很有用
页: [1]
查看完整版本: OvisOCR2批量PDF、图片文档识别工具,本地离线