吾爱破解 - 52pojie.cn

 找回密码
 注册[Register]

QQ登录

只需一步,快速开始

查看: 44346|回复: 925
收起左侧

[原创工具] Umi-OCR 免费 · 离线 · 文字识别软件 [支持PDF识别!]

    [复制链接]
Nagisa1224 发表于 2023-11-21 09:55
本帖最后由 Nagisa1224 于 2024-4-1 12:59 编辑

Umi-OCR 文字识别工具

免费,开源,批量,无限次数的离线OCR软件。
适用于 Windows7 x64 及以上。
现已支持PDF识别,输出双层可搜索PDF!

https://github.com/hiroi-sora/Umi-OCR
  • 免费:本项目所有代码开源,完全免费。
  • 方便:解压即用,离线运行,无需网络。
  • 高效:自带高效率的离线OCR引擎,内置多种语言识别库。
  • 灵活:支持命令行、HTTP接口等外部调用方式。
  • 功能:截图OCR / 批量OCR / PDF识别 / 二维码 / 公式识别(测试中

1-标题-2.png

下载发行版

以下发布链接均长期维护,提供最新软件版本。

开始使用

软件发布包下载为 .7z.exe 自解压包,可在没有安装压缩软件的电脑上解压。解压后,点击 Umi-OCR.exe 即可启动程序。

遇到任何问题,或者希望请求新功能,请提在 Github 发个 Issue ,我会尽可能帮助你。(不经常上52,可能错过你的消息。)

另:兼容 Windows 7 是一项困难的工作,因为很多第三方库都不支持了。我只能尽量确保在靠后的Win7版本(如7601.24545)能完美使用所有功能。

Windows 7 用户遇到异常可参考: 常见问题及修复方法

标签页

Umi-OCR v2 由一系列灵活好用的标签页组成。您可按照自己的喜好,打开需要的标签页。

标签栏左上角可以切换窗口置顶。右上角能够锁定标签页,以防止日常使用中误触关闭标签页。

截图OCR

截图OCR:打开这一页后,就可以用快捷键唤起截图,识别图中的文字。

  • 左侧的图片预览栏,可直接用鼠标划选复制。
  • 右侧的识别记录栏,可以编辑文字,允许划选多个记录复制。
  • 也支持在别处复制图片,粘贴到Umi-OCR进行识别。
文本后处理

关于 OCR文本后处理 - 排版解析方案: 可以整理OCR结果的排版和顺序,使文本更适合阅读和使用。预设方案:

  • 多栏-按自然段换行:适合大部分情景,自动识别多栏布局,按自然段规则进行换行。
  • 多栏-总是换行:每段语句都进行换行。
  • 多栏-无换行:强制将所有语句合并到同一行。
  • 单栏-按自然段换行/总是换行/无换行:与上述类似,不过 不区分多栏布局。
  • 单栏-保留缩进:适用于解析代码截图,保留行首缩进和行中空格。
  • 不做处理:OCR引擎的原始输出,默认每段语句都进行换行。

上述方案,均能自动处理横排和竖排(从右到左)的排版。(竖排文字还需要OCR引擎本身支持)


批量OCR

批量OCR:这一页用于批量导入本地图片进行识别。

  • 支持格式:jpg, jpe, jpeg, jfif, png, webp, bmp, tif, tiff
  • 保存识别结果的支持格式:txt, jsonl, md, csv(Excel)
  • 与截图OCR一样,支持文本后处理功能,整理OCR文本的排版和顺序。
  • 没有数量上限,可一次性导入几百张图片进行任务。
  • 支持任务完成后自动关机/待机。
  • 如果要识别像素超大的长图或大图,请调整:页面的设置→文字识别→限制图像边长→【调高数值】
  • 拥有特殊功能 忽略区域
忽略区域

关于 OCR文本后处理 - 忽略区域: 批量OCR中的一种特殊功能,适用于排除图片中的不想要的文字。

  • 在批量识别页的右栏设置中可进入忽略区域编辑器。
  • 如上方样例,图片顶部和右下角存在多个水印 / LOGO。如果批量识别这类图片,水印会对识别结果造成干扰。
  • 按住右键,绘制多个矩形框。这些区域内的文字将在任务中被忽略。
  • 请尽量将矩形框画得大一些,完全包裹住水印所有可能出现的位置。

文档识别

文档识别

  • 支持格式:pdf, xps, epub, mobi, fb2, cbz
  • 对扫描件进行OCR,或提取原有文本。可输出为 双层可搜索PDF
  • 支持设定 忽略区域 ,可用于排除页眉页脚的文字。
  • 可设置任务完成后 自动关机/休眠

二维码

扫码

  • 截图/粘贴/拖入本地图片,读取其中的二维码、条形码。
  • 支持一图多码。
  • 支持19种协议,如下:

Aztec,Codabar,Code128,Code39,Code93,DataBar,DataBarExpanded,DataMatrix,EAN13,EAN8,ITF,LinearCodes,MatrixCodes,MaxiCode,MicroQRCode,PDF417,QRCode,UPCA,UPCE

生成码

  • 输入文本,生成二维码图片。
  • 支持19种协议和纠错等级等参数。

全局设置

全局设置:在这里可以调整软件的全局参数。常用功能如下:

  • 一键添加快捷方式或设置开机自启。
  • 更改界面语言。Umi支持繁中、英语、日语等语言。
  • 切换界面主题。Umi拥有多个亮/暗主题。
  • 调整界面文字的大小字体
  • 切换OCR插件。
  • 渲染器:软件界面默认支持显卡加速渲染。如果在你的机器上出现截屏闪烁、UI错位的情况,请调整界面和外观渲染器 ,尝试切换到不同渲染方案,或关闭硬件加速。

调用接口:


关于项目结构

各仓库:

支持的离线OCR引擎:

运行环境框架:

构建项目

请见 GitHub主页

支持

Umi-OCR 完全免费,且暂时不接受打赏。

喜欢本项目,请在GitHub主页给个⭐,谢谢支持!

更新日志

👆 点击查看

点评

大佬,我这电脑之前正常使用,但是突然双击无反应了,应急启动也是闪一下就退出了。也没有进程。咋解决啊  发表于 2024-5-24 17:20

免费评分

参与人数 355吾爱币 +363 热心值 +328 收起 理由
hdjfuen + 1 谢谢@Thanks!非常好用!
likai618 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
jgszy + 1 + 1 谢谢@Thanks!感谢大佬!
qiyi235 + 1 + 1 谢谢@Thanks!
北冥鱼 + 2 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
wang1anfu + 1 + 1 谢谢@Thanks!
hijk1 + 1 + 1 我很赞同!
aye177771666 + 1 + 1 谢谢@Thanks!
宇宙小菜鸟 + 3 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
下一个id见 + 1 + 1 谢谢@Thanks!
aobaoying + 1 + 1 谢谢@Thanks!
hdwlx + 1 + 1 谢谢@Thanks!
Tian555 + 1 + 1 用心讨论,共获提升!
smile1110 + 3 + 1 nbnbnb
gdf + 1 + 1 用心讨论,共获提升!
shelovesi + 1 + 1 超级好用!怒赞一个
aafusou + 1 + 1 谢谢@Thanks!
licy0208 + 1 + 1 我很赞同!
留点口德 + 1 + 1 谢谢@Thanks!
nide312 + 1 + 1 谢谢@Thanks!
Sugar0man + 1 + 1 谢谢@Thanks!
workzht + 1 + 1 谢谢@Thanks!
TIAOWUQINGYU + 2 + 1 感谢dalao无私分享
onlyclxy + 3 + 1 鼓励转贴优秀软件安全工具和文档!
陌路、天涯 + 1 + 1 谢谢@Thanks!
ahulym + 1 + 1 谢谢@Thanks!
唐三没藏 + 1 + 1 谢谢@Thanks!
Jerffery + 1 + 1 热心回复!
nani101 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
judgeyc + 1 + 1 谢谢@Thanks!
YZF945 + 1 + 1 用心讨论,共获提升!
小小刀55 + 1 + 1 谢谢@Thanks!
榻榻米 + 1 + 1 我很赞同!
bin33 + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
pointbraek + 1 + 1 谢谢@Thanks!
wzzhhoo + 1 + 1 我很赞同!
yudiqtfj + 1 谢谢@Thanks!
以水为茗 + 1 + 1 谢谢@Thanks!
damocles1985 + 1 + 1 谢谢@Thanks!
u2b + 1 + 1 谢谢@Thanks!
p009p + 1 + 1 谢谢@Thanks!
の煋宸徔膤ヴ + 1 谢谢@Thanks!
fancw17 + 1 + 1 我很赞同!
ldd1511828867 + 1 + 1 我很赞同!
heixinlian + 1 + 1 我很赞同!
caoyisheng + 2 + 1 用心讨论,共获提升!
douliuyin + 1 + 1 谢谢@Thanks!
cjw666 + 1 + 1 谢谢@Thanks!
GodJoey + 1 + 1 我很赞同!
ggh2 + 1 + 1 我很赞同!
xhg2992 + 1 + 1 谢谢@Thanks!
38342175 + 2 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
清水心跳 + 1 + 1 谢谢@Thanks!
sd001 + 1 + 1 我很赞同!
nicheng + 1 热心回复!
尤里zlj + 1 + 1 谢谢@Thanks!
restart19 + 1 + 1 谢谢@Thanks!
大K + 1 + 1 谢谢@Thanks!
fxw622812128 + 1 + 1 鼓励转贴优秀软件安全工具和文档!
www0313 + 1 + 1 非常优秀
aoali + 1 + 1 谢谢@Thanks!
小师叔 + 1 + 1 用心讨论,共获提升!
zzttzhang + 1 + 1 谢谢@Thanks!
shilichun1982 + 1 + 1 我很赞同!
hnabc2003 + 1 + 1 鼓励转贴优秀软件安全工具和文档!
Sankaku + 1 谢谢@Thanks!
binguyue + 1 + 1 谢谢@Thanks!
constraint + 1 + 1 还在下载,感觉好用,都给你
Excel52 + 1 + 1 谢谢@Thanks!
n53618861 + 1 欢迎分析讨论交流,吾爱破解论坛有你更精彩!
Wang0663 + 1 + 1 我很赞同!
windofsummer + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
2h000 + 1 + 1 谢谢@Thanks!
houkunlin + 1 用心讨论,共获提升!
路过一位靓仔 + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
xc120 + 1 + 1 谢谢@Thanks!
50466361 + 1 + 1 谢谢@Thanks!
阴凉 + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
niwang6 + 1 + 1 软件很好用,再接再励
aAChengYay + 1 + 1 用心讨论,共获提升!
yantian007 + 1 + 1 谢谢@Thanks!
2015abc + 1 + 1 我很赞同!
linangong0616 + 1 + 1 谢谢@Thanks!
Gilbert + 1 + 1 谢谢@Thanks!
caiduyi127 + 2 + 1 谢谢@Thanks!
catoo1 + 1 我很赞同!
newyun + 1 + 1 我很赞同!
以光之魂 + 1 + 1 用心讨论,共获提升!
Small-Bao + 1 + 1 谢谢@Thanks!
ABF7470 + 1 + 1 我很赞同!
yycda + 1 + 1 谢谢@Thanks!
Kexiaoluo123 + 1 + 1 我很赞同!
lustig + 1 + 1 感谢发布原创作品,吾爱破解论坛因你更精彩!
gloryer0714 + 1 鼓励转贴优秀软件安全工具和文档!
Quixote + 1 + 1 我很赞同!
搭闩必 + 1 + 1 谢谢@Thanks!
泪之火 + 1 + 1 谢谢@Thanks!
xuxiansen + 1 + 1 我很赞同!
蓝风 + 2 + 1 是真的好用,比天若强很多
gzdiky + 1 识别软件,我最爱的一款

查看全部评分

本帖被以下淘专辑推荐:

发帖前要善用论坛搜索功能,那里可能会有你要找的答案或者已经有人发布过相同内容了,请勿重复发帖。

secretji 发表于 2023-11-21 13:22
感谢分享,一直在用天若,回头试一下这个
 楼主| Nagisa1224 发表于 2023-12-2 20:40
l101 发表于 2023-12-2 17:37
我的电脑第三方程序调用运行结果
Umi-OCR_Paddle_v2.0.0
可以正常使用

Rapid与Paddle版,HTTP调用时填写的参数不同的哦,如果搞错了参数可能导致调用失败。

命令手册: https://github.com/hiroi-sora/Um ... 3%E7%A4%BA%E4%BE%8B

然后关于cmd无返回,这个可能是我这边的锅。由于运行环境的一些限制,会对管道输出流进行重定向,所以可能会影响调用方的获取。后续会改善这个问题。
 楼主| Nagisa1224 发表于 2023-11-22 11:47
BilboBaggins 发表于 2023-11-21 21:52
任务管理器里也没有,Paddle 和 Rapid 两个都试了,均无反应

试一下:打开文件夹 UmiOCR-data ,点击其中的 RUN_CLI.bat ,看看有无反应?如果有报错的话把报错贴上来。

如果没有报错并且能正确显示软件界面,那么可以用 RUN_GUI.bat 来启动软件。

RUN_.bat 是备用启动器,比主启动器 Umi-OCR.exe 的兼容性更好。

如果可以的话,后续结果到GitHub上发个Issue给我。52论坛这边我可能不会经常看。
 楼主| Nagisa1224 发表于 2023-11-23 10:27
snowyibb 发表于 2023-11-23 09:34
对了,我发现好像中英混排容易把那个空格自动删除,但是纯粹是英文的时候,通常都有空格。

请问大佬怎么 ...

这是PaddleOCR离线引擎的祖传问题了,暂时没有好的解决方法,如果要识别长篇英文段落那就切换到纯英文库吧。

以后会增加更多离线引擎,用户可自己选择更适合的。
 楼主| Nagisa1224 发表于 2023-11-23 16:32
最忆是江南 发表于 2023-11-23 11:50
添加 开机启动失败。 管理员允许也不行。

是否为win7?有没有啥报错?

你可以手动添加开机启动:
1. 添加一个桌面快捷方式
2. 将快捷方式扔到这个文件夹: C:\ProgramData\Microsoft\Windows\Start Menu\Programs\Startup
 楼主| Nagisa1224 发表于 2023-11-23 18:47
binbinjimg 发表于 2023-11-23 17:02
啥错也不报,也不显示界面,这是啥问题

UmiOCR-data文件夹,运行  RUN_CLI.bat ,看看有啥问题
头像被屏蔽
rogabet 发表于 2023-11-21 12:42
提示: 作者被禁止或删除 内容自动屏蔽
1045837055lucy 发表于 2023-11-21 15:06
感谢分享,办公利器,分流阿里,以防丢失。
Umi-OCR_Paddle_v2.0.0.7z.exe
https://www.alipan.com/s/kiKwzrsUHpM
点击链接保存,或者复制本段内容,打开「阿里云盘」APP ,无需下载极速在线查看,视频原画倍速播放。
lddhnly 发表于 2023-11-21 12:12
不错,感谢分享,收藏了。
诺十年以后 发表于 2023-11-21 12:18
感谢楼主分享收藏一波
bamao666 发表于 2023-11-21 12:39
感谢楼主分享
hxd97244 发表于 2023-11-21 12:47
收藏备用,感谢升级分享。
Leo361Leo 发表于 2023-11-21 12:55
谢谢楼主分享!!
jattcn 发表于 2023-11-21 13:02
收藏备用。谢谢楼主分享!!
aqtd2 发表于 2023-11-21 13:21
感谢分享,收藏备用
您需要登录后才可以回帖 登录 | 注册[Register]

本版积分规则

返回列表

RSS订阅|小黑屋|处罚记录|联系我们|吾爱破解 - LCG - LSG ( 京ICP备16042023号 | 京公网安备 11010502030087号 )

GMT+8, 2024-11-21 14:24

Powered by Discuz!

Copyright © 2001-2020, Tencent Cloud.

快速回复 返回顶部 返回列表