Umi-OCR 快速上手:免费离线 OCR 文字识别,扫描 PDF 一次变可搜索文档
【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR
扫描件里的字看得见却选不中,一复制全是空行?几百页文献想找一句话,只能一页页翻?Umi-OCR 是一款免费、开源、离线运行的 OCR 文字识别工具:截图出字、批量提取图片文字,还能把扫描 PDF 识别成双层可搜索 PDF,识别过程不联网、不上传。处理合同、论文、发票这类敏感文档的学生、办公人员和开发者,可以把它当本地 OCR 的默认选项。
先跑起来:从下载到出结果 📥
- 获取软件:从项目发行版页面下载
.7z压缩包,或执行git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR拉取源码 - 启动:解压后双击
Umi-OCR.exe,Linux 用umi-ocr.sh,无需安装 - 选功能页:顶部标签页按需点开截图 OCR、批量 OCR、文档识别、二维码
- 出结果:首次启动按系统语言自动切换界面;识别结果默认进剪贴板,批量任务可另存为文件
按任务来:功能页怎么选
截图 OCR:屏幕上复制不了的字,截下来就能取
网页、PPT 禁止复制,只能手敲?打开截图 OCR标签页,按快捷键截屏即可识别。左侧预览栏可直接划选原文,右侧识别记录支持编辑、多选复制;在别处复制了一张图片,也能直接粘贴过来识别。
实用技巧:
- 多栏版面选文本后处理→ "多栏-按自然段换行",段落顺序自动理顺
- 代码截图选 "单栏-保留缩进",行首空格和缩进得以保留
- 识别记录支持多次截图累加,最后一次划选全部复制
批量 OCR:几百张图片一次跑完
几十张截图、扫描件要逐张识别,手点不现实?进入批量 OCR标签页,把图片一次拖进去(支持 jpg、png、webp、tif 等常见格式),自动排队识别,结果保存为txt、jsonl、md、csv(Excel)。
实用技巧:
- 图片带固定位置水印时,进右栏忽略区域编辑器,按住右键画矩形框,框内文字不再出现在结果里
- 要进 Excel 汇总,直接保存为 csv 格式
- 长任务可勾选任务完成后自动关机/待机,睡前挂着跑
文档识别:扫描 PDF 转双层可搜索 PDF
扫描版 PDF 搜不了、复制不了,重新录入要几小时。文档识别标签页导入 PDF(也支持 xps、epub、mobi、fb2、cbz)后开始识别,可输出双层可搜索 PDF:原扫描外观原样保留,上面叠一层透明文字,支持全文检索、Ctrl+F 定位和直接复制。
实用技巧:
- 页眉页脚用忽略区域框掉,结果更干净
- 识别整本书可开启任务完成后自动关机/待机
- 输出文件就是普通 PDF,双击打开即可搜索
二维码:识别和生成就在这一个标签页
图片里的码扫不出来时,截图、粘贴或拖入图片即可读取,支持一图多码和 19 种协议;反过来输入文本也能生成二维码图片,可调纠错等级和图片尺寸。
实用技巧:
- 一张图里多个码也能全部读出
- 生成码时可指定纠错等级和图片宽高
需求对号入座
| 你的需求 | 用哪个功能 | 推荐设置 / 输出格式 |
|---|---|---|
| 屏幕上文字禁止复制 | 截图 OCR | 文本后处理选"多栏-按自然段换行" |
| 几百张图片提取文字 | 批量 OCR | 输出 csv,直接导入 Excel |
| 扫描 PDF 要能搜索复制 | 文档识别 | 输出双层可搜索 PDF |
| 图片里的二维码读不出 | 二维码 | 一图多码识别 |
| 不想安装、要离线跑 | 解压即用 | 本地识别,无需联网 |
什么人用得起来
- 研究生:把扫描版期刊论文导入文档识别,生成双层可搜索 PDF,几分钟内定位到引用和图表说明
- 财务/行政:把一文件夹发票、单据截图拖入批量 OCR,保存 csv 后导入 Excel 汇总金额和日期
- 开发者:通过 命令行手册 或 HTTP接口手册 把识别能力挂进自己的脚本和自动化流程
熟练后再动的旋钮 🎛
- 引擎二选一:Rapid-OCR 兼容性好,Paddle-OCR 速度稍快,在全局设置切换
- 识别语言:在文字识别设置里按资料主要语言切换,多语言文档效果更稳
- 限制图像边长:识别超大长图前调高该数值,否则大图会被压缩
- 界面和外观:语言、亮/暗主题、字体字号都在这调;截图闪烁或界面错位时,改一下渲染器或关闭硬件加速
- 窗口置顶 + 锁定标签页:标签栏左上角置顶、右上角锁定,防止误关正在跑的页面
出错时先查这里 🩹
- 多栏版面识别出来顺序混乱→ 文本后处理选"多栏"系列预设,竖排版面也能自动处理
- 结果里总有水印文字→ 用忽略区域编辑器右键画框,框要包住水印可能出现的全部位置
- 长图/大图识别不全→ 调高"限制图像边长",或先拆分成小图再批量导入
- 截图闪烁、界面错位→ 全局设置里调整渲染器,或关闭硬件加速再试
Umi-OCR 是一款免费的离线 OCR 工具:截图取字、批量识别、扫描 PDF 转双层可搜索 PDF,解压就能跑。去发行版页面下载试用,把积压的扫描件一次处理完;用得不顺,直接去开源社区提 Issue。
【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考