Umi-OCR 文字识别:3 张截图到手,拿到你的第一份识别结果
【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR
扫描版 PDF 里的字看得见、选不中,复制出来是一行空白;网页禁止复制,只能对着屏幕手敲。Umi-OCR是一款免费离线的 OCR 工具:解压即用、不装不联网,识别全程不离开你的电脑。它能从截图抓字、批量提取几百张图片的文字,还能把扫描 PDF 变成可搜索的文档,适合被扫描件、截图资料堆着的学生、办公人员和开发者。
快速上手:3 步拿到第一份识别结果
- 解压并启动:把 .7z 压缩包解压到任意文件夹,双击
Umi-OCR.exe(Linux 用户运行umi-ocr.sh)。首次启动界面语言会跟随系统自动切换,无需任何安装步骤。 - 选对标签页:界面顶部有"截图 OCR""批量 OCR""全局设置"等标签,点击批量 OCR。
- 丢几张图进去,点开始任务:选 3~5 张图片点"开始任务",左侧文件列表逐张标出耗时和置信度,右侧实时显示识别文字,划选复制,完成。
高频场景怎么用
从屏幕直接抠出文字
网页、PPT 里的字复制不了,只能手敲?打开截图 OCR标签页,按快捷键截屏,框里的文字自动识别;在别处复制的图片也能直接粘贴进来识别。右侧识别记录可编辑,还能勾选多条记录一次性复制。
实用技巧:
- 多栏版面选文本后处理里的"多栏-按自然段换行",段落顺序会自动理顺
- 代码截图选"单栏-保留缩进",行首空格和缩进得以保留
几百张截图和扫描件一次处理
几十张截图、扫描件要逐张点,手点不现实。打开批量 OCR,一次拖入几百张图片(jpg、png、webp、tif 等格式都支持),任务自动排队,结果保存为 txt、jsonl、md、csv(Excel)。
实用技巧:
- 图片带固定位置水印时,进忽略区域编辑器按住右键画矩形框,框内文字不再出现在结果里
- 长任务可勾选完成后自动关机/待机,睡前挂任务即可
扫描 PDF 转成可搜索 PDF
三百页扫描文献想找一句话,只能一页页翻。在文档识别标签页导入 PDF(xps、epub、mobi、fb2、cbz 也支持)开始识别,输出双层可搜索 PDF:原扫描外观原样保留,上面叠一层透明文字,全文检索、Ctrl+F 定位、直接复制都行,页眉页脚同样能用忽略区域排除。
识别二维码,或反向生成
图片里的码手机不方便扫时,在二维码标签页截图、粘贴或拖入图片即可读取内容,支持一图多码和 19 种协议;反过来输入文本也能生成二维码图片,纠错等级和图片尺寸都能调。
想把识别能力挂进自己的脚本和自动化流程,可以看命令行手册和HTTP接口手册,无需开界面直接调用。
初用常见问题
- 多栏版面识别顺序混乱→ 文本后处理选"多栏"系列预设,从右到左的竖排版面也能处理。
- 结果总有水印、页眉文字→ 忽略区域编辑器里按住右键画框,尽量包住水印可能出现的全部位置,只有框内完整文本块会被排除。
- 长图、大图识别不全→ 批量页"设置 → 文字识别 → 限制图像边长"调高数值,或先拆成小图再导入。
- 截图闪烁、界面错位→ 全局设置"界面和外观 → 渲染器"切换渲染方案,或关闭硬件加速。
Umi-OCR 完全免费、离线运行、解压即用,截图取字、批量提取、扫描 PDF 转可搜索文档都能干。现在就去发行版下载 .7z 压缩包,把攒着的扫描件一次处理完;遇到问题或建议,直接去项目开源社区提 Issue。
【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考