发布时间:2026/8/31 13:23:34
Umi-OCR 使用指南:免费离线 OCR 软件,截图、批量、PDF 识别一次讲清 Umi-OCR 使用指南免费离线 OCR 软件截图、批量、PDF 识别一次讲清【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR你拿到一份 PDF 合同打开后发现整份文件就是一张图片字选不中、条款搜不到把图片传到线上识别服务又担心隐私。Umi-OCR 是一款免费、开源、离线运行的 OCR 文字识别软件截图识别、批量图片导入、PDF 扫描件识别、二维码识别四件事都覆盖全程在你自己的电脑上完成不上传网络。下面按装好 → 日常使用 → 调优 → 接入工作流的顺序讲一遍。解压即用5 分钟装好跑通第一次识别下载安装一个压缩包解压就运行发行包是一个.7z压缩包另有.7z.exe自解压版本没有压缩软件的电脑也能解。解压后双击Umi-OCR.exe直接启动不安装、不写注册表整个文件夹可以随意挪到别的盘。系统要求不高Windows 7 x64 和 Linux x64 都能跑老机器也用得了。下载渠道和版本信息见官方文档README.md。首次配置语言、主题和开机自启首次启动时界面语言会按系统设置自动切换。想手动改去全局设置 → 语言简中、繁中、英文、日文都内置好了。同一个页面里还能一键创建桌面或开始菜单快捷方式开启开机自启切换亮/暗主题调整字体和界面大小切换 OCR 引擎、选择识别语言库配置完成后就能跑第一次识别打开截图OCR标签页按下快捷键开始。打开软件这几个标签页各管一件事 截图OCR快捷键一按文字直接可用最高频的场景屏幕上有一段你想要的文字不想再开别的软件。打开截图OCR标签页按快捷键框选区域文字就出现在右侧记录里。左侧图片预览可以直接用鼠标划选复制识别记录可以编辑也能划选多条记录一起复制。别处复制过图片的话直接粘贴进 Umi-OCR 同样能识别。 批量OCR几百张图一次跑完一整文件夹的扫描图一张张手动识别不现实。批量OCR标签页没有数量上限可以一次丢进去几百张。输入支持 jpg、png、webp、bmp、tiff 等格式结果可导出为 txt、jsonl、md、csvExcel 能直接打开多种格式可以同时输出。任务列表里能看到每张图的耗时和置信度哪张识别得不好一目了然。还有个实用选项任务完成后自动关机或待机。睡前把一天的图片排好队跑完就下班。 文档识别PDF 扫描件变可搜索文档回到开头那份合同在文档识别标签页把 PDF 丢进去两种情况都能处理带文本层的电子 PDF直接提取原有文字不用走识别纯图片的扫描 PDF逐页 OCR再输出为双层可搜索 PDF——外观保持扫描原样但文字可选可搜输入支持 pdf、xps、epub、mobi、fb2、cbz配合忽略区域排除页眉页脚的文字十几份扫描合同跑一遍等于把一堆图片变成能全文检索的档案库。容易忽略的三个功能结果干净不少 忽略区域把水印和页眉页脚框掉扫描文档每页都有水印或 LOGO 时识别结果里会混进这些字。批量OCR和文档识别都有忽略区域在设置里进入编辑器按住右键画多个矩形把水印可能出现的位置全部包住。任务运行时框内的文字会被跳过。注意它忽略的是整个文本块而不是单个字符框只盖住半个文本块时不会忽略所以矩形尽量画大一点。 排版解析多栏文档按自然段输出OCR 原始输出按引擎发现文字的顺序排列多栏版面读起来经常是乱的。排版解析会按版面重新组织顺序预设方案包括多栏-按自然段换行适合大部分情景自动识别多栏布局多栏/单栏-总是换行、无换行按换行习惯选单栏-保留缩进适合代码截图保留行首缩进和行中空格横排、竖排从右到左的排版都能处理 二维码识别和生成都能做二维码标签页有两个方向。识别截图、粘贴或拖入图片读取其中的二维码和条形码支持一图多码覆盖 QRCode、Code128、EAN13 等 19 种协议。生成输入文本生成二维码图片纠错等级等参数可调。处理文档时顺手把图里的码扫出来省得再开扫码软件。 识别不准或跑不动时先查这几处准确率问题先查图片、语言库、引擎三件事识别不准多数先出在图片上模糊、分辨率低、阴影重。先别怪软件把对比度调一调、裁掉无关区域再识别。其次看设置里选择的识别语言库要和文字对得上中文、英文还是中英混排。最后换引擎Umi-OCR 内置 RapidOCR兼容性好和 PaddleOCR速度稍快两个离线引擎在全局设置里可随时切换。软件层面的两个开关大图限制和渲染器超长、超大的图片识别时被截断去批量OCR → 页面的设置 → 文字识别 → 限制图像边长把数值调高即可。截图时界面闪烁、UI 错位去全局设置 → 界面和外观 → 渲染器切换渲染方案或关闭硬件加速。其他问题可以直接到项目提 Issue官方 README 里写明作者会尽量帮助排查。更进一步把识别能力接进自己的工作流命令行一条命令截图识别并写入文件主程序本身就是命令行入口不用打开界面umi-ocr --screenshot --clip—— 一行命令截图、识别结果直接进剪贴板粘到哪都行。也可以传图片或文件夹路径识别--path D:/xxx.png文件夹会递归搜索所有图片再加--output test.txt把结果写进文件。命令行依赖软件内的 HTTP 服务默认开启通信只在本地环回进行不经过网络。完整指令和参数见手册docs/README_CLI.md。HTTP 接口让其他程序调用本地 OCR做自动化的人可以把 Umi-OCR 当作本地 OCR 服务图片识别传 Base64 图片、PDF 文档识别、二维码识别与生成都提供了 HTTP 接口其他脚本或程序可以直接调用识别仍在本地完成。接口文档docs/http/README.md。下一步很具体到项目官方下载渠道拿最新发行包解压、双击启动先打开截图OCR绑一个快捷键这是你每天都会用到的功能手头有图片资料的话丢进批量OCR跑一轮完整流程双层可搜索 PDF 也值得试一次。免费开源、离线私密对普通用户来说这两点就够了。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/31 13:23:34

HyperMesh 2019视频教程:从几何清理到网格划分的完整前处理主线

很多人收藏了一堆 HyperMesh 2019 视频教程,真正打开软件面对一个实际问题时,却依然不知道第一步该做什么。这不是学习态度的问题,而是学习方式的问题。HyperMesh 这类前处理工具,操作面板非常多,按钮层级也深&#xf…

2026/8/31 13:18:34

CNN卷积神经网络零基础入门:PyTorch实现MNIST图像分类

CNN 卷积神经网络是深度学习入门绕不开的第一座山。很多零基础读者第一次接触 CNN 时,被卷积、池化、全连接、特征图、感受野这些名词劝退,但实际上它的设计逻辑非常朴素:让网络像人眼看图一样,先从局部细节开始识别,再…

2026/8/31 13:33:34

VMware Workstation虚拟机安装Windows 11完整教程

最近有不少朋友在评论区问我:能不能用一台电脑跑多个系统? Windows 11 能不能装在虚拟机里? 日常办公要用 Windows,学习 Linux 又不想重启切换,测试软件怕弄坏宿主机环境。答案其实很明确:用虚拟机。本文就…

2026/8/31 13:33:34

赫尔墨斯语音激活更新:智能交互体验再升级

无法根据这份材料生成技术博文。 原因有两点: 输入中只有标题“赫尔墨斯代理:新语音激活更新太强大了!”,没有项目正文、关键词、摘要描述等有效素材,缺少可讲解、可复现、可验证的技术内容,无法支撑一篇…

2026/8/31 13:33:34

恶意AI网络攻击与AI应用安全防御:从攻击面到落地实践

近两年,围绕 AI 系统的恶意攻击已经从概念推演变成了真实威胁。OpenAI、Anthropic、Google 等头部 AI 公司联合大量科技企业公开呼吁行业共同抵御恶意 AI 网络攻击,这场表态背后并不是单纯的公关动作,而是安全形势变化后的集体共识。过去我们…

2026/8/31 13:33:34

Spring AI 1.0+PGVector构建个人知识库AI问答系统实战

简介:本资源是一个基于Spring AI 1.0与PGVector向量数据库构建的个人知识库AI问答系统实战项目,面向Java后端开发者、AI工程实践者及深度学习初学者,解决私有知识高效检索与自然语言精准问答的技术落地问题。压缩包共214个文件,含…

2026/8/31 13:28:34

高精度太阳位置计算方法与MATLAB实现

简介:本资源是一套面向科研人员、能源工程师及天文爱好者设计的太阳高度角与方位角高精度MATLAB计算工具,解决太阳能系统设计、建筑日照分析、气象建模等场景中太阳位置实时精准计算的核心需求。压缩包共3个文件(1.26MB)&#xff…

2026/8/31 1:05:20

vSound小提琴数字处理器实操指南:从接线到演出的完整配置

电小提琴或者原声小提琴插电演出,第一个绕不开的坎就是声音难听。原声琴的共鸣和空气感一旦进了拾音器,出来的往往是一坨干瘪、发尖、带着奇怪塑料味的信号。我当初第一次把琴接上乐队调音台,直接被主唱吐槽"你这声音像在锯钢丝"。…

2026/8/31 2:14:20

传感器接口IC如何攻克生物化学传感的微弱信号难题?

1. 从电极到比特流:为什么生物化学传感必须依赖专用接口IC 做生物化学传感的人都有过类似的经历:明明传感器本身性能很好,信号输出却一塌糊涂——噪声大、漂移明显、重复性差,怎么调都达不到预期。很多时候问题并不在传感器&#…

2026/8/31 1:41:28

STM32F411CEU6多通道ADC采集:扫描模式+DMA实现详解

1. 多通道 ADC 的用武之地把“Multichannel ADC”和“STM32F411CEU6”这两个关键字放在一起,其实就是嵌入式开发里最常遇到的一类需求:用一块不算贵的 MCU,同时采集多路模拟信号。STM32F411CEU6 是 48 引脚的 Cortex-M4F 主控,主频…

2026/8/31 0:07:32

STM32C5设备支持包(IAR DFP)安装指南与常见坑

上一阵子在IAR里折腾一块基于STM32C5系列的新板子,工程从STM32CubeMX导出来之后怎么都编译不过。报错信息很干脆:找不到设备描述文件。跟着错误路径去查,发现指向的是一个让我愣了一下的名字:STMicroelectronics.stm32c5xx.2.1.0.…

2026/8/31 0:07:32

STM32N657 SWO引脚矛盾:CubeMX显示PB3,数据手册为PB5

拿到STM32N657这颗料的第一天,我就撞上了一个让人原地懵圈的引脚矛盾:CubeMX里清清楚楚显示SWO在PB3,翻开数据手册的引脚说明表,却赫然写着PB5。对于一个靠SWO输出调试日志吃饭的人而言,这种"工具和手册打架"…

2026/8/31 12:44:45

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/31 9:19:59

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/31 6:53:02

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…