免费离线OCR软件指南:3步把扫描PDF变成可搜索文档
2026/9/20 15:41:07 网站建设 项目流程

免费离线OCR软件指南:3步把扫描PDF变成可搜索文档

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

扫描版 PDF 里的文字看得见、选不中,复制出来是一行空行;网页上的文字被锁住,连右键都没有。Umi-OCR是一款免费的离线 OCR软件:无需安装,解压后就能截图取字、批量识别图片,并把扫描 PDF 转成可搜索文档。识别全程在本地完成,文件不会离开你的电脑。

功能清单一览:一个标签页对应一类任务

功能页能做什么关键细节
截图OCR从屏幕直接取文字快捷键唤起截图,左侧预览可划选复制,右侧识别记录可编辑、累加后多选复制
批量OCR一次识别几百张图片支持 jpg、png、webp、bmp、tif 等格式,结果可存为 txt、jsonl、md、csv(Excel)
文档识别扫描 PDF 转成可搜索文档支持 pdf、xps、epub、mobi、fb2、cbz,可输出双层可搜索PDF
二维码读码与生成码一图多码,覆盖 QRCode、Code128 等 19 种协议;输入文本可生成码图片
全局设置管理整台软件的参数切换界面语言、主题、字体字号、OCR 引擎、渲染器

界面是标签页形式,按任务需要打开对应页面即可;标签栏左上角可切换窗口置顶,右上角能锁定标签页,防止误触关闭。

上手流程:从启动到拿到第一份结果

  1. 获取软件:从项目发行版页面下载 .7z 压缩包(或 .7z.exe 自解压包);开发者也可以git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR获取源码。验证:解压后能看到Umi-OCR.exeUmiOCR-data目录。
  2. 启动:Windows 双击Umi-OCR.exe,Linux 运行umi-ocr.sh。首次启动会按系统语言自动切换界面。验证:界面显示为对应语言,标签栏列出各功能页。
  3. 跑第一次识别:打开批量OCR页,拖入几张测试图片,点击开始。验证:识别文字自动进入剪贴板,同时可在页面里另存为 txt、jsonl、md、csv 文件。

任务列表没有数量上限,几百张图片可以一次排队识别;任务完成后还可以开启自动关机/待机,长任务挂到夜里跑。

🔍 高频问题逐个解决

网页、PPT 里的文字复制不了,怎么取出来?

打开截图OCR页,用快捷键唤起截图(按 Esc 可中断),软件识别框选区域内的文字。左侧预览栏可直接划选原文,右侧识别记录支持编辑;多次截图的结果会累加在记录里,最后一次性划选复制。在别处复制了一张图片?直接粘贴过来就能识别。

扫描 PDF 里的文字选不中,怎么让它可搜索?

打开文档识别页导入扫描版 PDF,选择输出为双层可搜索PDF后开始任务。输出文件保留原扫描外观,上面叠加一层透明文字:全文检索、Ctrl+F 定位、直接复制都可用。

图片上的水印、页眉总混进结果,怎么去掉?

进入批量识别页右栏设置的忽略区域编辑器,按住右键画若干矩形框。只有整个文本块都落在框内才会被忽略,所以框要尽量大,把水印可能出现的全部位置包进去;贴着框边沿的零散字符未必能被排除。

多栏排版顺序乱、代码缩进丢了,怎么调?

在页面设置里选文本后处理的排版解析方案:多栏资料选"多栏-按自然段换行",段落顺序会自动理顺;代码截图选"单栏-保留缩进",行首空格得以保留。所有预设方案都能自动处理横排和竖排版面。

超大长图识别不全、任务跑得慢?

页面设置 → 文字识别 →限制图像边长,把数值调高,大图就不会在识别前被压缩;或者先把长图拆成小图再批量导入。大批量任务记得开启任务完成后自动关机/待机。

一张图里贴了十几个二维码,怎么批量读?

打开二维码页,拖入一张或多张图片即可读取,支持一图多码,覆盖 QRCode、Code128、DataMatrix 等 19 种协议。反向也行:输入文本生成二维码图片,可调整纠错等级和图片宽高。

⚙️ 进阶选项:引擎、接口与界面

  • 引擎二选一:默认的 Rapid-OCR 兼容性好,Paddle-OCR 速度稍快,在全局设置里切换即可,两套引擎都内置在发行包里。
  • 界面定制:界面语言(繁中、英语、日语等)、亮/暗主题、字体字号都在全局设置中调整;界面翻译由 Weblate 平台协作完成。
  • 脚本调用:命令行和 HTTP 接口两种方式,都依赖本地 HTTP 服务(默认开启,主机保持"仅本地"即可)。例如批量识别一个文件夹里的图片:umi-ocr --path "D:/imgs" --output result.txt。完整参数见 命令行手册 和 HTTP接口手册。

排错对照表

现象处理方式
识别文字顺序混乱、多栏跳读文本后处理改选"多栏"系列预设,竖排版面同样适用
结果里总有水印文字忽略区域编辑器用右键画框,框住水印可能出现的全部位置
大图、长图识别不全调高"限制图像边长"数值,或先拆分成小图再批量导入
截图闪烁、界面错位全局设置 → 界面和外观里调整渲染器,或关闭硬件加速再试
只会复制到剪贴板,想存文件批量OCR 页另存为 txt、jsonl、md、csv;命令行可加--output参数

去发行版页面下载 .7z 包,解压后先把积压的扫描件处理掉;使用中遇到 Bug 就提 Issue,想帮忙翻译界面也可以加入项目。

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询