
Umi-OCR免费开源的离线OCR软件截图、批量图片与PDF一键文字识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR处理扫描件、整理截图文字时把图片上传到在线识别服务总让人不放心。Umi-OCR 是一款开源、免费的离线OCR软件识别全部在本机完成断网也能用图片不用离开你的电脑。它同时覆盖截图识别、批量图片转文字、PDF文档识别三种最常见需求解压即用不用装任何东西。一分钟认识它Umi-OCR 是一款面向普通用户的桌面OCR工具界面用标签页组织首次启动会按系统语言自动切换界面。它内置 PaddleOCR 和 RapidOCR 两种离线引擎PaddleOCR 精度更高RapidOCR 速度更快可在全局设置中随时切换识别语言包也内置在软件里中文、英文、日文等开箱即用。项目说明开源协议MIT支持平台Windows 7 x64、Linux x64费用完全免费无会员、无次数限制网络依赖无需联网识别全程离线安装方式无需安装解压后直接运行主程序输出格式txt、jsonl、md、csvExcel 可打开一键截图提取文字操作路径打开截图OCR标签页按下快捷键唤起截图框选屏幕任意区域识别结果会立刻显示在右侧记录栏可以直接划选复制。除了快捷键也支持在别处复制图片后粘贴进来识别。实际效果识别出的文本不是散乱的字块页面内置了文本后处理的排版解析方案可以自动按自然段换行也能适配多栏排版识别代码截图时选择单栏-保留缩进方案行首缩进和空格都会保留下来。小提醒如果发现某些字没识别出来多半是图片被默认压缩过——页面设置里可以调高限制图像边长的数值用一点速度换精度。批量图片识别与转文字操作路径在批量OCR标签页导入一个文件夹或几十张图片支持 jpg、png、bmp、tif、webp 等常见格式没有数量上限。结果可保存为 txt、jsonl、md 或 csvcsv 用 Excel 打开即可。实际效果每张图片的识别结果独立保存任务完成后可以自动关机或待机适合夜间挂机跑完一批资料。页面右栏还有忽略区域编辑器按住右键在图上画矩形框内的文字会被跳过专门对付水印、LOGO 这类干扰。小提醒忽略区域按文本块生效——落在框内的整块文字才被忽略单字不会被单独抠掉所以框要画得稍微大一些把水印可能出现的整个区域包进去。PDF扫描件识别成可编辑文档操作路径在文档识别标签页导入文件支持 pdf、xps、epub、mobi 等格式。两种用途各取所需要纯文本就直接提取要归档就生成双层可搜索PDF——原来的扫描图像保留上面叠加一层识别出来的文字之后可以像普通 PDF 一样全文搜索、复制。实际效果同样支持忽略区域可以把每页固定出现的页眉页脚框掉避免它们混进正文。配合完成后自动休眠一个晚上处理完几大本扫描件不成问题。上手三步从项目仓库下载对应平台的发行包或直接git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR后按文档构建。把压缩包解压到任意目录双击Umi-OCR.exeLinux 下运行umi-ocr.sh启动无需安装。在截图OCR页按快捷键框选一块屏幕文字完成第一次识别。进阶用法命令行与HTTP接口想把 Umi-OCR 接进自动化流程主程序本身就是一条命令行入口。比如截图后直接把结果写进文件umi-ocr --screenshot --output result.txt也可以传文件夹路径批量识别其中的全部图片。所有指令都依赖本地 HTTP 服务默认开启命令行输入可用umi-ocr --help查看全部。程序集成方面Umi-OCR 默认在本地 1224 端口提供 HTTP 接口图片OCR、PDF识别、二维码识别/生成都有对应端点调用前可先访问参数查询接口拿到全部可调参数详见 HTTP接口手册。引擎本身走插件机制官方插件库还提供 PaddleOCR、RapidOCR 之外的备选引擎在全局设置中即可切换不用改代码。避坑与常见问题识别精度不如预期怎么办默认会把长边超过 960 像素的图片压缩再识别速度优先。精度不够时到页面设置的文字识别里调高限制图像边长或改用 PaddleOCR 引擎。命令行执行了没反应命令行靠本地 HTTP 服务转发指令先确认全局设置里 HTTP 服务已开启默认是开的且用的不是备用启动器。忽略区域为什么没把水印去掉它按整块文本生效不是逐字生效。框要完全包住水印可能出现的文字块画大一点比画小安全。能同时装两个引擎吗不要。两种引擎插件会互相覆盖快捷方式需要哪个装哪个切换用插件导入就行。另外 HTTP 接口并发能力有限批量脚本建议串行调用。写在最后Umi-OCR 把截图、批量图片、PDF 这三类最常见的文字识别需求做进了一个免安装的免费离线软件里个人使用或接入自动化脚本都够用。项目仓库https://gitcode.com/GitHub_Trending/um/Umi-OCR 遇到具体报错时建议先看 更新日志 或直接在仓库提 Issue。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考