Umi-OCR:离线 OCR 能做这 4 件事,免费批量文字识别 Umi-OCR离线 OCR 能做这 4 件事免费批量文字识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费开源的离线文字识别工具解压即可运行不依赖网络。你可以用它截图识字、批量导入图片识别文字也能识别 PDF 扫描件和二维码所有文件都只留在自己的电脑里。30 秒上手到项目发布页下载最新版本的压缩包.7z 格式解压到任意目录不需要安装步骤双击Umi-OCR.exe启动程序系统要求Windows 7 x64 及以上或 Linux x64。首次启动时界面语言跟随系统之后可以在全局设置里手动切换。主界面 - 截图、批量、二维码分标签页它能帮你做什么把 200 页合同扫描件变成可搜索文本把图片拖进「批量 OCR」页面就能开始任务没有数量上限。支持 jpg、png、bmp、tiff 等常见格式识别结果可存成 txt、md、jsonl 或 csv可直接导入 Excel。批量 OCR - 一次导入数百张图片截个图一秒钟把文字抠出来按截图快捷键默认 CtrlAltZ框选区域图中文字就会被识别并复制到剪贴板。左侧是图片预览右侧是识别记录可以直接划选复制也能编辑后再复制。截图 OCR - 框选即识别PDF 扫描件变成可搜索文档导入 pdf、xps、epub 等文档对扫描件做 OCR 并输出双层可搜索 PDF文字层可选中复制图像层保留原版式。还能设置忽略区域把页眉页脚从结果里排掉。二维码识别与生成一处搞定截图、粘贴或拖入带二维码的图片即可读取支持一图多码覆盖 QRCode、EAN13、PDF417 等 19 种协议。反过来输入一段文本也能生成二维码图片纠错等级等参数都可以调。和普通在线工具的区别维度Umi-OCR在线 OCR 服务文件去向全程离线图片不出本地需上传到第三方服务器网络依赖断网也能识别没网就用不了批量数量几百张一次导入不设限常受次数、文件大小限制费用免费开源无水印免费档多有额度限制进阶用法如果你需要整理识别结果的排版可以在「文本后处理」里选排版解析预设多栏文档比如论文用「多栏-按自然段换行」会按阅读顺序自动分段代码截图用「单栏-保留缩进」能保住缩进结构识别结果可以直接粘进编辑器。如果你想用命令行调用先确认全局设置里的 HTTP 服务已开启默认就是开的然后可以这样跑umi-ocr --path D:/scan # 识别文件夹内所有图片 umi-ocr --screenshot # 截图并识别 umi-ocr --qrcode_read D:/qr.png # 读取二维码更多参数见仓库中的 CLI 手册 和 HTTP 接口手册。适合谁用 怎么开始办公人员合同、发票扫描件数字化导出 txt 或 md 后接着编辑学生和研究者从 PDF 论文里提取正文多栏排版也能按段输出开发者用命令行和 HTTP 接口把 OCR 接进自动化流程隐私敏感用户身份证、账单这类材料本地识别不经过任何服务器多语言用户内置中、英、日、韩识别库不用另外下模型想开始的话到项目发布页下载版本包解压即可想看源码执行git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

最新新闻

Docker Compose编排物联网平台后端:Nginx+PHP-FPM+EMQX+InfluxDB一键部署实战

Docker Compose编排物联网平台后端:Nginx+PHP-FPM+EMQX+InfluxDB一键部署实战

Docker Compose编排物联网平台后端:NginxPHP-FPMEMQXInfluxDB一键部署实战 物联网平台后端涉及的服务组件多,手动部署一次就得折腾半天。Nginx做反向代理,PHP-FPM跑业务API,EMQX处理MQTT设备连接,InfluxDB存时序数据&a…

2026/8/24 20:08:28
网络小说改编短视频剧本:从文字到视觉的工程化转换指南

网络小说改编短视频剧本:从文字到视觉的工程化转换指南

在实际内容创作领域,尤其是短视频和短剧赛道,将网络小说改编为剧本是一个高频且极具挑战性的需求。很多创作者面临的困境是:直接照搬原著,导致剧情节奏拖沓、信息冗余、语言风格不符,最终视频完播率低下。这背后涉及的…

2026/8/24 20:08:28
从文本到可交互世界:Lyra 2.0架构解析与Unity实践指南

从文本到可交互世界:Lyra 2.0架构解析与Unity实践指南

在实际 3D 内容创作、游戏开发、虚拟现实和数字孪生等领域,构建一个高质量、可交互的 3D 世界通常需要耗费大量美术资源、编程工作和时间成本。传统的流程从建模、贴图、绑定到场景集成,每一步都依赖专业工具和人力投入,迭代和探索新想法的门…

2026/8/24 20:08:28
本地部署MiniMaxH3:基于ComfyUI的AI图生视频实战指南

本地部署MiniMaxH3:基于ComfyUI的AI图生视频实战指南

这次我们来看一个近期在AI视频生成领域备受关注的项目——MiniMaxH3。它不是一个独立的软件,而是一个基于ComfyUI工作流的AI视频生成解决方案,核心是利用MiniMax公司开源的H3模型来实现高质量的图生视频功能。简单来说,你可以给它一张图片和一…

2026/8/24 20:08:28
在.NET Framework WPF项目中利用Microsoft.Toolkit.Mvvm生成器提升MVVM开发效率

在.NET Framework WPF项目中利用Microsoft.Toolkit.Mvvm生成器提升MVVM开发效率

这次我们来看一个能显著提升 .NET 开发效率的工具:Microsoft.Toolkit.Mvvm中的生成器功能。对于使用 WPF、WinUI 3、UWP 等 XAML 框架的开发者来说,手动实现INotifyPropertyChanged接口、编写命令(ICommand)是重复且易错的体力活。…

2026/8/24 20:08:28
可扩展多智能体世界模型:从群体协同到一致性挑战

可扩展多智能体世界模型:从群体协同到一致性挑战

1. 从单体智能到群体涌现:为什么我们需要可扩展的多智能体世界模型? 最近在跟几个做自动驾驶和游戏AI的朋友聊天,大家不约而同地提到了一个共同的瓶颈:单个智能体(Agent)的能力似乎已经摸到了天花板。无论是…

2026/8/24 20:03:28