ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Umi-OCR:免费离线 OCR,扫描件一键变可搜索文档

Umi-OCR:免费离线 OCR,扫描件一键变可搜索文档 Umi-OCR免费离线 OCR扫描件一键变可搜索文档【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线 OCR 工具截图取字、批量转文字、扫描 PDF 变可搜索文档都做在同一款软件里。识别全程在本机跑完文件不出机器断网照常用适合要频繁取字的办公、学习场景。截图框选屏幕文字直接拿走图片批量导入文字一次出齐扫描 PDF 转成可搜索文档跑起来3 步出第一个结果 下载发行包.7z或自解压.7z.exe解压到任意目录不用安装。双击Umi-OCR.exe启动Linux 跑umi-ocr.sh界面语言跟随系统自动切。打开「截图OCR」标签页按快捷键框选一块屏幕第一条识别结果就出来了。想从源码构建克隆仓库后按 README 的说明搭好对应平台环境即可git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR日常三个高频用法想抄走屏幕上一段话右键却点不中有些软件和论文阅读器把文字锁死了选不中、复制不了。打开「截图OCR」标签页。按页面里的快捷键在屏幕上框住那段文字。从右侧记录栏复制结果多栏排版可在设置里切「排版解析方案」整理顺序。如果结果总差几个字先调高图片对比度或转灰度图再核对识别语言中英混排就选混合语言包。一文件夹的发票图手打不现实几十张 jpg 发票扫描件要进表格或归档一张张敲不现实。打开「批量OCR」页把整个文件夹拖进去。等任务跑完左侧列表能看到每张图的耗时和状态。勾选保存格式txt、jsonl、md、csv可直接进 Excel四种里挑。如果每张图角落都盖着同一个水印 LOGO就在右栏设置里按住右键把水印区域框住框内文字整块跳过如果图片太多太大先调高「限制图像边长」的数值再拆成几批排队。几百页扫描教材CtrlF 搜不到扫描版 PDF 本质是一摞图片阅读器里怎么搜都没有。打开「文档识别」标签页把 PDF 拖进去。有固定页眉页脚的话用「忽略区域」把位置框掉。任务完成后导出拿到的是一份双层可搜索 PDFCtrlF 能定位页码文字能整段复制。PDF 之外XPS、EPUB、MOBI、FB2、CBZ 也支持。如果某个 PDF 报无法处理先把它逐页转成图片再走批量识别一般能绕过去实在不行升级软件版本。原理一句话双层 PDF 哪来的它不会重绘你的文档。原始扫描图完整保留版式、插图、字体原样不动OCR 只把每页文字转成一层透明文本叠在图片上面。你看到的还是那份扫描件但搜索索引和复制都指向那层透明文字所以能搜、能选。整套识别由内置离线模型在本机跑完RapidOCR、PaddleOCR 两套引擎可切换全程不用联网。不开界面CLI 与 HTTP 接口 ⚙️命令行入口就是主程序本身把整个文件夹识别到一个文件里只需一行umi-ocr --path D:/images --output D:/result.txt umi-ocr --screenshot --clip umi-ocr --qrcode_read D:/qr.png umi-ocr --help程序里要调用的话软件自带本地 HTTP 接口只走本机环回不出网卡。参数细节看 命令行手册 和 HTTP接口手册。先认清短板这些情况别硬试识别率跟输入质量强相关艺术字、潦草手写有上限先拍高清图关键内容人工过一遍。大文件、超长图吃内存4GB 以下内存的机器减少单批数量或调低「限制图像边长」。HTTP 接口对并发不友好脚本里串行调用等一条响应完再发下一条。语言包覆盖中、英、日、韩、法、德等常用语言小语种内容先选混合语言包再识别。四个高频取字场景都收进这个免费离线的小工具里。有问题去 Umi-OCR 仓库提 Issue 即可。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表