
Umi-OCR免费离线OCR截图识别到批量数字化【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR网页、PDF里的文字选不中截图再手敲进文档太费劲一整文件夹扫描件想变成能搜索的文本却嫌麻烦。Umi-OCR 是一款免费、开源的离线OCR软件截图、批量图片、PDF扫描件都在本地完成识别不传文件、不联网。办公文员、学生以及想把识别接进自己脚本的人都能直接用。先跑通从解压到认出第一行字解压.7z发行版到固定目录双击Umi-OCR.exe启动界面语言会按系统设置自动切换打开默认显示的「截图OCR」标签页按页面提示的快捷键唤起截图也可以直接把别处复制的图片粘贴进窗口在屏幕上框选一段文字右侧「记录」面板立刻出现识别结果在面板里划选文本复制粘进你的文档。标签栏左上角可以打开窗口置顶识别时窗口不会被挡右上角可锁定标签页防止误触关掉。功能地图四个标签页的入口与注意点功能入口位置适合什么时候用一个注意点截图OCR「截图OCR」标签页网页、PDF阅读器里复制不出来的文字结果可在右侧「记录」面板编辑后再复制支持粘贴图片识别批量OCR「批量OCR」标签页一次转几百张 jpg/png/webp/bmp/tif 图片输出支持 txt、jsonl、md、csv(Excel)可多选同存文档识别「文档识别」标签页pdf/xps/epub 等扫描件转成双层可搜索PDF带文本层的文档直接提取原文纯扫描件逐页识别二维码「二维码」标签页读图里的码或把文本生成二维码图片支持一图多码、19种协议生成时可定纠错等级和尺寸全局设置「全局设置」标签页切语言、主题、OCR引擎、渲染器「渲染器」是截图闪烁、界面错位的第一排查点脚本用户主程序Umi-OCR.exe本身就是命令行入口例如umi-ocr --screenshot --clip截图识别后写入剪贴板umi-ocr --path D:/img1.png D:/image/test识别单张图或整个文件夹。系统的和|重定向对它无效要用--output file.txt写文件。完整参数见 docs/README_CLI.mdHTTP接口见 docs/http/README.md。批量识别讲义照片任务开始前改的3个设置以「一学期手机拍的讲义照片变可编辑笔记」为例走一遍完整流程。输入打开「批量OCR」标签页把讲义照片文件夹整个拖进去点「选择图片」也能添加。图片没有数量上限几百张一次丢进去没问题。设置「页面设置 → 文字识别 →限制图像边长」调高。手机截图常超过2000像素高默认值偏小时大图会被压缩或截断这是结果缺角的头号原因排版解析方案选「多栏-按自然段换行」。它自动判断单双栏再按段落换行讲义这类普通文稿不会串行保存文件格式勾上 txt 和 md再指定一个输出目录方便直接用编辑器打开。如果照片角落带水印在右栏进入忽略区域编辑器按住右键把水印可能出现的位置框大一些。记住框内被忽略的是整个文本块而不是单个字框要完全包住水印。执行点「开始任务」左上角显示速度和百分比。长任务可以中途暂停电脑待机、休眠后回来接着跑也可以勾选任务完成后自动关机/待机。验收用编辑器打开生成的 md 文件翻几页核对分段和错字右侧「记录」面板按文件名回看单张图的识别结果发现异常单独重跑那几张。引擎、排版、输出格式怎么选如果你日常只识别简体中文就在OCR插件设置里只勾「简体中文」语言库否则每多勾一种语言内存占用都会升高如果文档是双栏、多栏报刊、双栏笔记就选「多栏-按自然段换行」否则代码截图请选「单栏-保留缩进」保留行首空格如果结果要进文档编辑就勾 txt 或 md 保存否则要喂给程序处理就勾 jsonl 或 csv(Excel)多种格式可以同时勾选如果要识别2000像素以上的大图长图就先把「页面设置 → 文字识别 →限制图像边长」调高否则超出部分会被压缩或截掉如果是老机器出现截图闪烁、UI错位就到「全局设置 → 界面和外观」切换渲染器或关闭硬件加速否则保持默认的显卡加速渲染即可。引擎方面软件内置 RapidOCR 和 PaddleOCR 两套离线插件在「全局设置」里切换。日常截图两者都够大批量处理时在「页面设置」里各跑一遍同一批图对比速度和准确率再定主力。常见问题一张表排查现象最常见原因一步解决批量识别大长图结果缺角、不完整图像边长限制没调够超出部分被压缩「页面设置 → 文字识别 → 限制图像边长」调高数值结果里混进水印、页眉页脚没画忽略区域或框没包住整个文本块忽略区域编辑器里右键画更大的矩形完全包住水印老显卡机器截图闪烁、界面错位显卡加速渲染与该机型不兼容全局设置「界面和外观」切换渲染器或关闭硬件加速双栏文档识别顺序乱、左右串栏用了不区分栏位的排版方案排版解析改「多栏-按自然段换行」脚本调命令行收不到识别结果系统的、|重定向对它无效改用--output file.txt写文件详见 docs/http/argv.md项目资料与下一步当前稳定版本 v2.1.52025.3.26新增日志机制和--reload配置重载沿革见 CHANGE_LOG.md功能细节以 README.md 为准。命令行与HTTP接口的完整手册在 docs/README_CLI.md 和 docs/http/README.md。遇到Bug直接到项目的 Issue 页面提交。先解压发行版框一次截图你就知道离线OCR能用到什么程度了。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考