
从单次截图到批量文档Umi-OCR 离线 OCR 的四个场景【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线文字识别软件截图 OCR、批量文档识别和二维码处理共用同一套界面。v2.1.5 版本在识别准确性和调用流程上做了不少更新。下面按四个使用场景展开从单次截图一路到批量、自动化和平台适配。框选截图得到一份可编辑的文本打开截图 OCR 标签页后用快捷键框选屏幕上的任意区域识别结果会同时出现在左侧图片预览和右侧记录栏。图片预览带文字叠加层在图上划选就能复制对应文字也能把原图复制进剪贴板。右侧记录栏支持逐条编辑还能跨多条记录一起划选复制。这一版给大部分标签页加上了左右或上下双栏的切换宽屏横排、窄屏竖摆都能适配 (#789)。截图前按 Esc 可以先把主窗口隐藏避免窗口本身挡住要识别的区域 (#652)。遇到带固定水印的图可以用忽略区域把那几个位置框住框内的整块文字会被整体跳过。把整个文件夹交给批量识别批量 OCR 标签页用来导入本地图片支持 jpg、png、webp、bmp、tif 等格式。识别结果能存成 txt、jsonl、md或 Excel 能直接打开的 csv。v2.1.5 优化了图片和文档的异步加载载入数万个子文件的文件夹也不会卡住加载过程还能看到进度 (#710)。文档识别是这一页的重点支持 pdf、epub、mobi 等格式。它既可以对扫描件做 OCR也能提取 PDF 里已有的文本再输出成双层可搜索的 PDF。这一版修了两处文本相关的问题提取 PDF 自带文本时会考虑页面旋转角度 (#785)生成单层 PDF 时也会把原文本内容写进去而不是只留一层图像。文档页同样有忽略区域用来去掉每页固定的页眉页脚文字。批量任务还能设成完成后自动关机或休眠适合把一整批文档留在后台处理。用命令行和接口接入流程熟悉截图和批量之后下一步常常是自动化。命令行入口就是主程序本身比如umi-ocr --path D:/img --output result.txt能把一个文件夹的识别结果写进单个文件。需要程序间调用时HTTP 接口走本机环回通信不经过外网参数细节见 HTTP 接口手册。识别代码或多栏版面时排版解析方案决定文字怎么排。选单栏-保留缩进可以保住行首空格选多栏-按自然段换行适合普通段落。v2.1.5 加了 --reload 指令改完配置文件不用重启就能刷新设置。从命令行启动还能看到实时日志默认 ERROR 级别以上会存进 UmiOCR-data/logs 目录排查问题方便不少。二维码这块识别一张图里多个码也能读支持 19 种协议。生成二维码时调整纠错等级或边距后图像会自动刷新不用再手动点一次生成 (#690)。修掉 Linux 的截图偏移补全界面语言Umi-OCR 主打 Windows也支持 Linux x64。v2.1.5 修了 Linux 截图时系统任务栏推移顶层窗口导致的位置偏移 (#778)。它还修了截图后主窗口位置和截图前对不上的问题桌面 Linux 用户用起来更稳定。界面语言靠社区翻译协作维护。v2.1.5 又加了俄语和泰米尔语加上之前的简繁中、英、日、葡语覆盖的地区更广。想参与翻译可以看仓库里的 i18n 工具链 和配套说明文档。软件是免安装的仓库里附了 v2.1.5 的 7z 便携包解压后双击主程序即可启动。命令行的完整参数见 命令行手册。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考