Umi-OCR 文字识别:3 张截图到手,拿到你的第一份识别结果
2026/9/20 14:42:33 网站建设 项目流程

Umi-OCR 文字识别:3 张截图到手,拿到你的第一份识别结果

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

扫描版 PDF 里的字看得见、选不中,复制出来是一行空白;网页禁止复制,只能对着屏幕手敲。Umi-OCR是一款免费离线的 OCR 工具:解压即用、不装不联网,识别全程不离开你的电脑。它能从截图抓字、批量提取几百张图片的文字,还能把扫描 PDF 变成可搜索的文档,适合被扫描件、截图资料堆着的学生、办公人员和开发者。

快速上手:3 步拿到第一份识别结果

  1. 解压并启动:把 .7z 压缩包解压到任意文件夹,双击Umi-OCR.exe(Linux 用户运行umi-ocr.sh)。首次启动界面语言会跟随系统自动切换,无需任何安装步骤。
  2. 选对标签页:界面顶部有"截图 OCR""批量 OCR""全局设置"等标签,点击批量 OCR
  3. 丢几张图进去,点开始任务:选 3~5 张图片点"开始任务",左侧文件列表逐张标出耗时和置信度,右侧实时显示识别文字,划选复制,完成。

高频场景怎么用

从屏幕直接抠出文字

网页、PPT 里的字复制不了,只能手敲?打开截图 OCR标签页,按快捷键截屏,框里的文字自动识别;在别处复制的图片也能直接粘贴进来识别。右侧识别记录可编辑,还能勾选多条记录一次性复制。

实用技巧:

  • 多栏版面选文本后处理里的"多栏-按自然段换行",段落顺序会自动理顺
  • 代码截图选"单栏-保留缩进",行首空格和缩进得以保留

几百张截图和扫描件一次处理

几十张截图、扫描件要逐张点,手点不现实。打开批量 OCR,一次拖入几百张图片(jpg、png、webp、tif 等格式都支持),任务自动排队,结果保存为 txt、jsonl、md、csv(Excel)。

实用技巧:

  • 图片带固定位置水印时,进忽略区域编辑器按住右键画矩形框,框内文字不再出现在结果里
  • 长任务可勾选完成后自动关机/待机,睡前挂任务即可

扫描 PDF 转成可搜索 PDF

三百页扫描文献想找一句话,只能一页页翻。在文档识别标签页导入 PDF(xps、epub、mobi、fb2、cbz 也支持)开始识别,输出双层可搜索 PDF:原扫描外观原样保留,上面叠一层透明文字,全文检索、Ctrl+F 定位、直接复制都行,页眉页脚同样能用忽略区域排除。

识别二维码,或反向生成

图片里的码手机不方便扫时,在二维码标签页截图、粘贴或拖入图片即可读取内容,支持一图多码和 19 种协议;反过来输入文本也能生成二维码图片,纠错等级和图片尺寸都能调。

想把识别能力挂进自己的脚本和自动化流程,可以看命令行手册和HTTP接口手册,无需开界面直接调用。

初用常见问题

  • 多栏版面识别顺序混乱→ 文本后处理选"多栏"系列预设,从右到左的竖排版面也能处理。
  • 结果总有水印、页眉文字→ 忽略区域编辑器里按住右键画框,尽量包住水印可能出现的全部位置,只有框内完整文本块会被排除。
  • 长图、大图识别不全→ 批量页"设置 → 文字识别 → 限制图像边长"调高数值,或先拆成小图再导入。
  • 截图闪烁、界面错位→ 全局设置"界面和外观 → 渲染器"切换渲染方案,或关闭硬件加速。

Umi-OCR 完全免费、离线运行、解压即用,截图取字、批量提取、扫描 PDF 转可搜索文档都能干。现在就去发行版下载 .7z 压缩包,把攒着的扫描件一次处理完;遇到问题或建议,直接去项目开源社区提 Issue。

【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片,PDF文档识别,排除水印/页眉页脚,扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询