KingDownloads

Umi-OCR version history

10 releases tracked, newest first.

v2.1.5

Mar 25, 2025
- Added logging mechanism and dual-panel mode toggle for most tabs. - Fixed PDF text extraction issues and OCR result display bugs. - Improved asynchronous loading for images/documents with progress preview. - Added Russian and Tamil UI languages.

2 downloads

v2.1.4

Aug 31, 2024
[English](https://github-com.translate.goog/hiroi-sora/Umi-OCR/releases/tag/v2.1.4?_x_tr_sl=zh-CN&_x_tr_tl=en&_x_tr_hl=en&_x_tr_pto=wapp) ## v2.1.4 主要更新: - 修复:引擎原始输出项的"text"为空时,导致文本分析越界的错误。 (#625) - 新增UI语言:葡萄牙语 `Português` 。译者:[@杨鹏](https://hosted.weblate.org/user/ypf) - **PaddleOCR 插件相关**: - 修复:布尔类型选项不生效的问题。 - 修复: `繁体中文` 配置文件错误的问题。 - 优化:调整默认线程/内存限制,默认内存占用不超过系统总内存的一半。 - 优化:调整识别语言库结构,精简不必要的文件。 - **Linux 版本相关**: - 优化:`glibc` 依赖降级至 `2.31` ,兼容 `Debian-11` 等发行版。 - 修复:Docker 部署 在部分旧系统中报错 `'code': 803` 的问题。(#621) --- ## Windows 下载 不同版本仅OCR引擎插件不同,其它功能完全一致,附带多国语言识别库。`.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压。 ### Paddle 引擎插件版 (性能好,速度快,占用率高,适合高配机器。**不兼容奔腾、赛扬、凌动CPU**) **重要提示:如果执行OCR时报错 `0xc0000142`、`[Error] OCR init fail`,大概率是CPU不兼容Paddle,请换用Rapid版本。** **Umi-OCR_Paddle_v2.1.4.7z.exe** (126.5MB) SHA256: `319edf4d58803ed5482174dcaf8713248cc377a77d9164fcc28796ade591348b` ### Rapid 引擎插件版 (速度稍慢,内存占用低,适合低配机器,兼容性好) **Umi-OCR_Rapid_v2.1.4.7z.exe** (97MB) SHA256: `c1e851b172437f383ffb6ec1f3236e1beab23c0d7bfd6ba84ffea8f720126471` 更多下载途径: [蓝奏云](https://hiroi-sora.lanzoul.com/s/umi-ocr) | [SourceForge](https://sourceforge.net/projects/umi-o

2 downloads

v2.1.3

Jul 23, 2024
[English](https://github-com.translate.goog/hiroi-sora/Umi-OCR/releases/tag/v2.1.3?_x_tr_sl=zh-CN&_x_tr_tl=en&_x_tr_hl=en&_x_tr_pto=wapp) ## v2.1.3 主要更新: - 新推出 Linux (Debian) 平台版本。 - 支持:[Docker 部署](https://github.com/hiroi-sora/Umi-OCR_runtime_linux/blob/main/README-docker.md) 。 - 新增:HTTP 文档识别接口。👉 [文档](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/http/api_doc.md#/api/doc) - 修复:文档中宽高为0的异常图片会导致任务卡住。 bate.1 版本之后的更新: - 修复:HTTP文档识别接口上传的文件名含非ascii字符时,该字符可被保留。 - 优化:HTTP文档识别接口的 [Python示例](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/http/api_doc_demo.py) 和 [Html示例](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/http/api_doc_demo.html) 代码。 - 优化:排版解析的 **单栏-单行** 方案,对于间隔较大的两个相邻文本块,会添加空格作为间隔符。 #### Windows7 和 Linux 用户注意: [常见问题及修复方法](https://github.com/hiroi-sora/Umi-OCR/issues/447) --- ## Windows 下载 不同版本仅OCR引擎插件不同,其它功能完全一致,附带多国语言识别库。`.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压。 ### Paddle 引擎插件版 (性能好,速度快,占用率高,适合高配机器。**不兼容奔腾、赛扬、凌动CPU**) **重要提示:如果执行OCR时报错 `0xc0000142`、`[Error] OCR init fail`,大概率是CPU不兼容Paddle,请换用Rapid版本。** **Umi-OCR_Paddle_v2.1.3.7z.exe** (134MB) SHA256: `27f5eb5097ba8fe95bf8247cb186c9c8518f6c8268b4f5d828e2e80b9e40be

2 downloads

v2.1.3.beta.1

Pre-releaseJul 13, 2024
[English](https://github-com.translate.goog/hiroi-sora/Umi-OCR/releases/tag/v2.1.3.beta.1?_x_tr_sl=zh-CN&_x_tr_tl=en&_x_tr_hl=en&_x_tr_pto=wapp) ## v2.1.3 beta.1 测试版 主要更新: - 新推出 Linux 平台版本。 - 新增:HTTP 文档识别接口。👉 [文档](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/http/api_doc.md#/api/doc) - 修复:文档中宽高为0的异常图片会导致任务卡住。 (#562) #### Windows7 和 Linux 用户注意: [常见问题及修复方法](https://github.com/hiroi-sora/Umi-OCR/issues/447) - [Linux报错:Warning: Ignoring XDG_SESSION_TYPE……](https://github.com/hiroi-sora/Umi-OCR/issues/447#issuecomment-2226950867) - [Linux截图时黑屏](https://github.com/hiroi-sora/Umi-OCR/issues/447#issuecomment-2226951718) ## Windows 下载 不同版本仅OCR引擎插件不同,其它功能完全一致,附带多国语言识别库。`.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压。 ### Paddle 引擎插件版 (性能好,速度快,占用率高,适合高配机器。**不兼容奔腾、赛扬、凌动CPU**) **重要提示:如果执行OCR时报错 `0xc0000142`、`[Error] OCR init fail`,大概率是CPU不兼容Paddle,请换用Rapid版本。** **Umi-OCR_Paddle_v2.1.3.beta.1.7z.exe** (134.4MB) SHA256: `81e9b1af8c3d9f81050c13ab57fc26939ad1a77239336fbd78a0a4582d88a8b0` ### Rapid 引擎插件版 (速度稍慢,内存占用低,适合低配机器,兼容性好) **Umi-OCR_Rapid_v2.1.3.beta.1.7z.exe** (97.0MB) SHA256: `07bffac520eeee6442e2516db20c08a20b8a100a780fb718b9a3b15eae5bddfa`

2 downloads

v2.1.2

Jun 3, 2024
[English](https://github-com.translate.goog/hiroi-sora/Umi-OCR/releases/tag/v2.1.2?_x_tr_sl=zh-CN&_x_tr_tl=en&_x_tr_hl=en&_x_tr_pto=wapp) ## v2.1.2 主要更新 - 新增:批量任务(图片、文档)支持 **暂停任务** 。只要不退出软件,在待机/休眠后可以恢复任务。 - 新增:文档任务支持保存为 **单层纯文本PDF** 。 - 新增:HTTP OCR接口 允许设置 **忽略区域** 参数。👉 [文档](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_HTTP.md#1-%E5%9B%BE%E7%89%87ocrbase64-%E8%AF%86%E5%88%AB%E6%8E%A5%E5%8F%A3) - 新增:HTTP 二维码接口 允许设置 **图像预处理** 参数。👉 [文档](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_HTTP.md#/api/qrcode) - 新增:命令行`--screenshot`允许 **指定屏幕范围** ,自动进行截图。👉 [文档](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_CLI.md#ocr%E6%8C%87%E4%BB%A4) - 修复:文档内容提取和写入时的坐标旋转、比例适配问题。 - 修复:截图预览 & 记录面板中,跨区块复制文本时,尾块的复制字数不正确。 - 修复:文档识别 整页强制OCR 模式下,无法进行任务。(2024.6.5紧急修复) - 优化:批量文档标签页,拖入大量文件、提交大批任务时的性能和流畅度。 - 优化:文档任务保存的文件名规则。 - UI:优化一些布局,调整一些文本,美化一些视觉效果。 #### Windows7 用户注意: [常见问题及修复方法](https://github.com/hiroi-sora/Umi-OCR/issues/447) #### Linux 用户:可尝试使用 [最新测试版本](https://github.com/hiroi-sora/Umi-OCR/releases) --- 新开通了赞助方式 [爱发电](https://afdian.com/a/hiroi-sora) ,有意愿的用户可以支持一下~ Umi-OCR 保证始终 **开源** 和 **完全免费** 。所有需要付费/注册/关注才能下载的渠道均 **不是** 我们发布的渠道,请注意辨

2 downloads

v2.1.1

Mar 29, 2024
# 两周年 & 两万星星撒花! Celebrating the two-year anniversary of this project and reaching 20k stars! <details> <summary>作者的话</summary> 两年前,有个人试图寻找一个免费的、无需注册、开箱即用、支持批量处理且不限制数量的OCR软件。可惜,当时没有软件满足他的需求。于是,他一拍脑袋,花了几个日夜,自己写了个软件原型。那就是 Umi-OCR [v1.0](https://github.com/hiroi-sora/Umi-OCR/releases/tag/v1.0) 。 没想到这个项目还挺受大家欢迎,于是他就一直维护更新下去。在用户的建议下,Umi 的功能越来越丰富,有了截图,现代化UI,二维码,PDF识别,HTTP接口……从1k行代码的小demo,历经两年迭代,到如今20k+行;Umi 逐渐变成一个较为成熟完整的项目。 未来,Umi 会继续完善现有功能、开发新的功能。受限于作者的业余时间和精力,项目更新的速度可能不会很快,还请给予耐心。本项目始终在稳步前进,历史上大多数Issues反馈和请求,最终都落到了实处。 (下一步,我将对软件底层的插件机制做出较大的调整和重构,以便为表格识别、图片翻译、原生Linux支持 等大型功能铺平道路。) 感谢各位用户、开发者、翻译者的支持。感谢我自己的坚持。 —— by hiroi-sora --- </details> ## v2.1.1 主要更新 / Changelog - 修复:`Windows7` 及 `核心数<=2的CPU` 无法进行文档识别的Bug。 - 新增:批量文档识别允许指定忽略区域的页数范围。 - 新增:命令行`--path`允许传入多个图片或文件夹。👉[命令行手册](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_CLI.md) - 新增:新的命令行、HTTP接口:识别/生成二维码图像。👉[HTTP手册](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_HTTP.md) - 优化:双栏面板会记忆左右折叠状态。 - 完善 繁+英+日 界面本地化翻译。感谢 [翻译人员](https://github.com/hiroi-sora/Umi-OCR?tab=readme-ov-file#%E8%BD%AF%E4%BB%B6%E6%9C%AC%E5%9C%B0%E5%8C%96%E7%BF%BB%E8%AF%91) 。 <details> <summary>次要更新

2 downloads

v2.1.0

Feb 28, 2024
## 重大更新: - **批量文档识别**。支持 `pdf, epub, mobi` 等多种格式的文档,对扫描件进行OCR或提取原有文本。可输出为 **双层可搜索PDF** 。 - 更强大的 **排版解析** 功能,代替之前的**段落合并**。基于 [间隙树排序算法](https://github.com/hiroi-sora/GapTree_Sort_Algorithm) ,解析多栏布局图片与文档时有较好的精度。 - HTTP接口参数作出了部分改动,并提供了一些更方便的选项。有需要的用户请重新参考 [README_HTTP.md](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_HTTP.md) 。 ### ⚠ Windows 7 及低配电脑用户注意: > **文档识别**可能在Win7、或极低配电脑(如双核CPU)中出现**异常**,如无法识别PDF文件。已在 v2.1.1 版本中修复。 ### 其它更新内容: - 新增:允许隐藏托盘图标。 (#338) - 新增:重复上一次截图区域的快捷键。 (#357) - 新增:用本地图片浏览器打开图片的快捷按钮。 (#335) - 修复:避免系统环境变量`QMLSCENE_DEVICE`的影响。 (#270) - 修复一些小问题,优化一些UI表现与提示语。 <img src="https://github.com/hiroi-sora/Umi-OCR/assets/56373419/4726fb3e-9acf-42d9-847a-3006552929d1" width="750"> ### Help us translate / 帮助我们翻译! We warmly invite translators to join us in our project's localization efforts! You can review existing translations or contribute new ones. Please visit the online platform Weblate at: **https://hosted.weblate.org/engage/umi-ocr/** ### 配置文件迁移 Umi-OCR v2 用户升级时,将旧版软件的`UmiOCR-data/.settings`拷贝到新版相同位置即可。 ### 下载说明 不同版本仅OCR引擎插件不同,其它功能完全一致。 均支持 win7 x64 及以上的系统,附带多国语言识别库。 `.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上

2 downloads

v2.1.0-alpha

Pre-releaseJan 26, 2024
## `v2.1.0 alpha` 大版本前的测试版 经过一段时间的 ~~爆肝~~ 高强度开发,“**批量PDF文档识别**”功能已基本完成。不过,仍有一些繁琐的辅助功能没写完,仍有一些代码待优化。这些将在v2.1.0正式版中完善。 考虑到有不少用户急需批量文档识别,故提前发布测试版。大家可以用自己的文件来检测这个新功能的稳定性与兼容性。 我要摸鱼一段时间,休息一下。祝用户朋友们,新年快乐~🎉🎉🎉 ### 协助翻译! 如果您擅长`简体中文`和另外一门语言,可参与本项目翻译,或校对当前翻译! 在线翻译平台: https://hosted.weblate.org/engage/umi-ocr/ ## `v2.1.0` 主要更新 - 更新:**批量文档**标签页。支持导入`pdf, xps, epub, mobi, fb2, cbz`格式的文件,识别图片或提取原有文字。支持生成**可搜索双层PDF**。 - 更新:完全重写的**排版解析**功能(代替原来的**段落合并**)。基于自研的 [间隙树排序算法](https://github.com/hiroi-sora/GapTree_Sort_Algorithm) ,能有效解析多栏布局图片与文档。 - 更新一些辅助功能,修复一些Bug,优化一些UI表现。 <img src="https://github.com/hiroi-sora/Umi-OCR/assets/56373419/fc2266ee-b9b7-4079-8b10-6610e6da6cf5" width="750"> ### 注意 - 目前仅支持通过原PDF文档生成双层PDF。xps等格式不支持生成PDF,仅支持生成txt等文本文件。未来可能补全该功能。 - 为了适应排版解析等新功能,HTTP接口的参数作出了对应调整,但文档我还没写。HTTP接口用户请**暂时不要更新到测试版**。 与测试版PDF识别相关的问题,可以在 [Issue #333](https://github.com/hiroi-sora/Umi-OCR/issues/333) 中提出。 ### 配置文件迁移 v2.0.x 用户升级时,将旧版软件的`UmiOCR-data/.settings`拷贝到新版相同位置即可。 ### 下载说明 不同版本仅OCR引擎插件不同,其它功能完全一致。 均支持 win7 x64 及以上的系统,附带多国语言识别库。 `.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压。 ### Paddle 引擎插件版 (性能好,速度快,占用率高,适合高配机器。**不兼容奔腾、赛扬、凌动CPU**) *

2 downloads

v2.0.2

Jan 15, 2024
### `v2.0.2` 日常修Bug,小迭代版本。 - 更新:全局设置可调节 图片文字叠加层`开启/关闭`默认显示状态。 (#264) - 优化:输出为`txt 单独文件`时,将应用`指定路径`参数。 (#269) - 优化:`段落合并-多行-代码段` 去除结尾多余换行符。 (#292) - 优化:渲染器不兼容时,减少渲染层级错误的影响。 (#259) - 修复:清理图片缓存前进行检查,避免空图错误。 (#279) - 修复:记录面板中,光标无法移到第1个字符前面。 (#264) - 修复:系统语言非简体中文时,软件启动异常。 (#274) (#306) - 修复:csv输出的字符编码兼容性问题。 (#284) - 修复:`段落合并参数不存在` 的误报。 - 修复:组件`DefaultTips`不生效。 > 预告:批量文档识别功能(支持PDF、epub、mobi等文件)正在火热开发中,将于下个大版本 v2.1.0 中发布。预计一个月左右推出。 ### 配置文件迁移 v2.0.x 用户升级时,将旧版软件的`UmiOCR-data/.settings`拷贝到新版相同位置即可。 ### 下载说明 不同版本仅OCR引擎插件不同,其它功能完全一致。 均支持 win7 x64 及以上的系统,附带多国语言识别库。 `.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压。 ### Paddle 引擎插件版 (性能好,速度快,占用率高,适合高配机器。**不兼容奔腾、赛扬、凌动CPU**) **重要提示:如果执行OCR时报错`[Error] OCR init fail`,大概率是CPU不兼容Paddle,请换用Rapid版本。** **Umi-OCR_Paddle_v2.0.2.7z.exe** (118.5MB) SHA256: `28875194a3c78d2d88ad7f2cb44a4da4a1976e372b84e7dd5864dddf220eba63` ### Rapid 引擎插件版 (速度稍慢,内存占用低,适合低配机器,兼容性好) **Umi-OCR_Rapid_v2.0.2.7z.exe** (86.5MB) SHA256: `fbca7e0f6fa8b560a15548d5a6fe4549a13a428eeee3b2aa68b508a0094c9ea8`

2 downloads

v2.0.1

Dec 8, 2023
### `v2.0.1` 更新内容: - **【HTTP接口用户注意】** 重新设计了HTTP接口。允许省略参数,允许设定段落合并。见[HTTP使用手册](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_HTTP.md)。 - 命令行增加指令`-->`和`-->>`,将结果输出到文件。见[命令行使用手册](https://github.com/hiroi-sora/Umi-OCR/blob/main/docs/README_CLI.md#%E7%BB%93%E6%9E%9C%E8%BE%93%E5%87%BA)。 - 优化:调整图像数据的内部编码,减少英文空格丢失的几率。 - 优化:调整部分UI文本和布局。 - 优化:csv默认保存为ansi编码,以兼容Office Excel。 (#237) - 优化:Rapid插件移除了旧的简中-v3语言库,默认使用v4版。 - 修复:开启“禁用美化效果”后,外部通知弹窗无法关闭。 (#234) - 修复:别的程序通过命令行调用Umi-OCR时,无法获取stdout输出。 ### 配置文件迁移 v2.0.0 用户升级时,将旧版软件的`UmiOCR-data/.settings`拷贝到新版相同位置即可。 ### 下载说明 不同版本仅OCR引擎插件不同,其它功能完全一致。 均支持 win7 x64 及以上的系统,附带多国语言识别库。 `.7z.exe`为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压。 ### Paddle 引擎插件版 (性能好,速度快,占用率高,适合高配机器。**不兼容奔腾、赛扬、凌动CPU**) **重要提示:如果执行OCR时报错`[Error] OCR init fail`,大概率是CPU不兼容Paddle,请换用Rapid版本。** **Umi-OCR_Paddle_v2.0.1.7z.exe** (118MB) SHA256: `cb51be5c37f69ef6a4a5288c591051d240cf233929daff233a6e957c5eea600d` ### Rapid 引擎插件版 (速度稍慢,内存占用低,适合低配机器,兼容性好) **Umi-OCR_Rapid_v2.0.1.7z.exe** (86MB) SHA256: `b2e316ff3386ae9b62d45aefa5bc4a7e23319a61f64c4d3ccf37dee4d5af666f` ### 额外:数学公式识别插件 测试中,[详见这里](https://github.com/hiroi-sora/Umi-OCR

2 downloads