ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Umi-OCR 离线OCR:解压即用,3 步出文字的免费识别工具

Umi-OCR 离线OCR:解压即用,3 步出文字的免费识别工具 Umi-OCR 离线OCR解压即用3 步出文字的免费识别工具【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款开源免费的离线 OCR 软件图片、截图、PDF 里的文字它全都能抠出来。上传第三方识别网站的次数限制、图片外传的隐私顾虑、老机器跑不动的重客户端——这些麻烦它一次都不给你。内置 PaddleOCR 与 RapidOCR 两套识别引擎全程断网可用敏感资料也不用外传。3 步跑通首次识别从发布页下载.7z压缩包没有压缩软件就下自解压版解压到任意目录Windows 直接双击Umi-OCR.exeLinux 运行umi-ocr.sh首次启动会按系统语言自动切换界面进入截图OCR标签页默认快捷键是 CtrlShiftS。无需注册、无需配置软件打开的那一刻就已经可以用了。场景一随手截图转文字连粘贴都能识别动作链很短按下快捷键 → 框选屏幕上想转的区域 → 松手文字就出现在右侧记录栏。想复制哪句鼠标划选直接 CtrlC右键菜单里还有复制全部清空记录这类快捷操作。更顺手的是如果你在别处复制过一张图片不用截图直接粘贴进来就能识别。结果顺序乱七八糟时去设置里调排版解析选多栏-按自然段换行还原正常阅读顺序选单栏-保留缩进则专门对付代码截图缩进和空格原样保留。横排、竖排都能自动处理。场景二几百张图片一次性批量识别一个文件夹的扫描件要转文字就交给批量OCR标签页。拖入图片点开始任务左侧列表实时显示进度和每张的耗时、置信度。格式覆盖 jpg、png、webp、bmp、tif 等常见图片数量没有上限。带水印、页眉页脚的图用忽略区域解决在编辑器里按住右键框出水印位置识别时整个落在框内的文本块会被直接跳过不会混进结果。任务跑完的结果支持导出为 txt、jsonl、md、csvExcel四种格式方便后续加工。睡前挂个任务还能设置完成后自动关机或待机第二天直接收结果。场景三PDF 与电子书转成可搜索文档文档识别标签页接住整本书的需求支持 pdf、epub、mobi、fb2、cbz 等格式既能对扫描件做 OCR也能直接提取原有文本。输出是双层可搜索 PDF——在 PDF 里直接搜索、复制文字纸质资料瞬间变成电子档案。配合忽略区域每页的页眉页脚也能排除干净。进阶把识别能力装进自己的工作流界面之外还有两条自动化通道。命令行模式支持--path、--output等参数一行命令批量识别整个文件夹配上定时任务就能无人值守HTTP 接口则让其他程序远程调用图片识别、文档识别、二维码功能甚至可以部署到服务器上。详细参数都写在 docs/README_CLI.md 和 docs/http/README.md想深入折腾直接查这两份手册。界面细节也在全局设置里中、英、日、繁中等十几种语言一键切换多套亮色暗色主题字体和界面比例随意调。个别机器上截图闪烁或界面错位多半是渲染兼容问题换一种渲染方案通常就好。现在就装上它下载第一个发布包用 CtrlShiftS 跑通一次截图识别再找几张带水印的图试试批量任务的忽略区域这套离线识别的流程基本就摸熟了。遇到问题先看 CHANGE_LOG.md也欢迎去提 Issue 或参与界面翻译把它打磨得更顺手。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表