Umi-OCR 快速上手:免费离线 OCR 文字识别,扫描 PDF 一次变可搜索文档
2026/9/20 14:01:24 网站建设 项目流程

Umi-OCR 快速上手:免费离线 OCR 文字识别,扫描 PDF 一次变可搜索文档

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

扫描件里的字看得见却选不中,一复制全是空行?几百页文献想找一句话,只能一页页翻?Umi-OCR 是一款免费、开源、离线运行的 OCR 文字识别工具:截图出字、批量提取图片文字,还能把扫描 PDF 识别成双层可搜索 PDF,识别过程不联网、不上传。处理合同、论文、发票这类敏感文档的学生、办公人员和开发者,可以把它当本地 OCR 的默认选项。

先跑起来:从下载到出结果 📥

  1. 获取软件:从项目发行版页面下载.7z压缩包,或执行git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR拉取源码
  2. 启动:解压后双击Umi-OCR.exe,Linux 用umi-ocr.sh,无需安装
  3. 选功能页:顶部标签页按需点开截图 OCR批量 OCR文档识别二维码
  4. 出结果:首次启动按系统语言自动切换界面;识别结果默认进剪贴板,批量任务可另存为文件

按任务来:功能页怎么选

截图 OCR:屏幕上复制不了的字,截下来就能取

网页、PPT 禁止复制,只能手敲?打开截图 OCR标签页,按快捷键截屏即可识别。左侧预览栏可直接划选原文,右侧识别记录支持编辑、多选复制;在别处复制了一张图片,也能直接粘贴过来识别。

实用技巧:

  • 多栏版面选文本后处理→ "多栏-按自然段换行",段落顺序自动理顺
  • 代码截图选 "单栏-保留缩进",行首空格和缩进得以保留
  • 识别记录支持多次截图累加,最后一次划选全部复制

批量 OCR:几百张图片一次跑完

几十张截图、扫描件要逐张识别,手点不现实?进入批量 OCR标签页,把图片一次拖进去(支持 jpg、png、webp、tif 等常见格式),自动排队识别,结果保存为txt、jsonl、md、csv(Excel)

实用技巧:

  • 图片带固定位置水印时,进右栏忽略区域编辑器,按住右键画矩形框,框内文字不再出现在结果里
  • 要进 Excel 汇总,直接保存为 csv 格式
  • 长任务可勾选任务完成后自动关机/待机,睡前挂着跑

文档识别:扫描 PDF 转双层可搜索 PDF

扫描版 PDF 搜不了、复制不了,重新录入要几小时。文档识别标签页导入 PDF(也支持 xps、epub、mobi、fb2、cbz)后开始识别,可输出双层可搜索 PDF:原扫描外观原样保留,上面叠一层透明文字,支持全文检索、Ctrl+F 定位和直接复制。

实用技巧:

  • 页眉页脚用忽略区域框掉,结果更干净
  • 识别整本书可开启任务完成后自动关机/待机
  • 输出文件就是普通 PDF,双击打开即可搜索

二维码:识别和生成就在这一个标签页

图片里的码扫不出来时,截图、粘贴或拖入图片即可读取,支持一图多码和 19 种协议;反过来输入文本也能生成二维码图片,可调纠错等级和图片尺寸。

实用技巧:

  • 一张图里多个码也能全部读出
  • 生成码时可指定纠错等级和图片宽高

需求对号入座

你的需求用哪个功能推荐设置 / 输出格式
屏幕上文字禁止复制截图 OCR文本后处理选"多栏-按自然段换行"
几百张图片提取文字批量 OCR输出 csv,直接导入 Excel
扫描 PDF 要能搜索复制文档识别输出双层可搜索 PDF
图片里的二维码读不出二维码一图多码识别
不想安装、要离线跑解压即用本地识别,无需联网

什么人用得起来

  • 研究生:把扫描版期刊论文导入文档识别,生成双层可搜索 PDF,几分钟内定位到引用和图表说明
  • 财务/行政:把一文件夹发票、单据截图拖入批量 OCR,保存 csv 后导入 Excel 汇总金额和日期
  • 开发者:通过 命令行手册 或 HTTP接口手册 把识别能力挂进自己的脚本和自动化流程

熟练后再动的旋钮 🎛

  • 引擎二选一:Rapid-OCR 兼容性好,Paddle-OCR 速度稍快,在全局设置切换
  • 识别语言:在文字识别设置里按资料主要语言切换,多语言文档效果更稳
  • 限制图像边长:识别超大长图前调高该数值,否则大图会被压缩
  • 界面和外观:语言、亮/暗主题、字体字号都在这调;截图闪烁或界面错位时,改一下渲染器或关闭硬件加速
  • 窗口置顶 + 锁定标签页:标签栏左上角置顶、右上角锁定,防止误关正在跑的页面

出错时先查这里 🩹

  • 多栏版面识别出来顺序混乱→ 文本后处理选"多栏"系列预设,竖排版面也能自动处理
  • 结果里总有水印文字→ 用忽略区域编辑器右键画框,框要包住水印可能出现的全部位置
  • 长图/大图识别不全→ 调高"限制图像边长",或先拆分成小图再批量导入
  • 截图闪烁、界面错位→ 全局设置里调整渲染器,或关闭硬件加速再试

Umi-OCR 是一款免费的离线 OCR 工具:截图取字、批量识别、扫描 PDF 转双层可搜索 PDF,解压就能跑。去发行版页面下载试用,把积压的扫描件一次处理完;用得不顺,直接去开源社区提 Issue。

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询