前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
圈层
工具
发布
首页
学习
活动
专区
圈层
工具
MCP广场
社区首页 >专栏 >超级好用的OCR工具,GitHub Star 7.2K,强烈推荐!

超级好用的OCR工具,GitHub Star 7.2K,强烈推荐!

作者头像
肉眼品世界
发布于 2021-01-08 02:54:35
发布于 2021-01-08 02:54:35
2K00
代码可运行
举报
文章被收录于专栏:肉眼品世界肉眼品世界
运行总次数:0
代码可运行

OCR 方向的工程师,一定需要知道这个 OCR 开源项目:PaddleOCR。短短几个月,累计 Star 数量已超过 7.2K,频频登上 Github Trending 日榜月榜,称它为 OCR 方向目前最火的 repo 绝对不为过。

12 月,它又带来四大新发布与升级,核心内容先睹为快:

  • 全新发布数据合成工具 Style-Text:可以批量合成大量与目标场景类似的图像,在多个场景验证,效果均提升 15% 以上。
  • 全新发布半自动数据标注工具 PPOCRLabel:有了它数据标注工作事半功倍,相比 labelimg 标注效率提升 60% 以上,社区小规模测试,好评如潮。
  • 多语言识别模型效果升级:中文、英文、韩语、法语、德语、日文识别效果均优于 EasyOCR。
  • PP-OCR 开发体验再升级:支持动态图开发(训练调试更方便),静态图部署(预测效率更高),鱼与熊掌可以兼得。

PaddleOCR 历史表现回顾

先看下 PaddleOCR 自今年开源以来,短短几个月在 GitHub 上的表现:

  • 6 月,8.6M 超轻量模型发布,GitHub Trending 全球趋势榜日榜第一。
  • 8 月,开源 CVPR2020 顶会 SOTA 算法,再上 GitHub 趋势榜单!
  • 10 月,发布 PP-OCR 算法,开源 3.5M 超超轻量模型,再下 Paperswithcode 趋势榜第一

这个含金量,广大的 GitHub 开发者们自然懂,3.5M 超超轻量模型的效果图大家直接看,绝对杠杠的。

火车票、表格、金属铭牌、翻转图片、外语都是妥妥的,3.5M 的模型能达到这个识别精度,绝对是良心之作了!

传送门:https://github.com/PaddlePaddle/PaddleOCR

那么最近的 12 月份更新,又给大家带来哪些惊喜呢?

全新发布 OCR 数据合成工具:Style-Text

相比于传统的数据合成算法,Style-Text 可以实现特殊背景下的图片风格迁移,只需要少许目标场景图像,就可以合成大量数据,效果展示如下:

1、相同背景批量数据合成

2、相同文字批量数据合成

3、图片分离前景背景

除了拉风的效果,采用这样的合成数据和真实数据一起训练,可以显著提升特殊场景的性能指标,分别以两个场景为例:

怎么样,绝对是黑科技了吧。这项能力核心算法是基于百度自研的文本编辑算法《Editing Text in the Wild》。

论文地址:https://arxiv.org/abs/1908.03047

不同于常用的基于 GAN 的数据合成工具,Style-Text 主要框架包括 ①文本前景风格迁移模块 ②背景抽取模块 ③融合模块。经过这样三步,就可以迅速实现图片文字风格迁移啦。

超强 OCR 数据标注工具:PPOCRLabel

除了数据合成,数据标注也一直是深度学习开发者关注的重点,无论是从成本还是时间上面,提高标注效率,降低标注成本太重要了。PPOCRLabel 通过内置高质量的 PPOCR 中英文超轻量预训练模型,可以实现 OCR 数据的高效标注。CPU 机器运行也是完全没问题的。话不多说,直接看 PPOCRLabel 效果演示:

用法也是非常的简单,标注效率提升 60%-80% 是妥妥的。只能说,真的太香了。

最好的多语言模型效果

简单对比一下目前主流 OCR 方向开源 repo 的核心能力:

中英文模型性能及功能对比

其中,多语言识别模型准确率对比(仅 EasyOCR 提供)

测试数据及环境说明:

  • 中英文场景:针对 OCR 实际应用场景,包括合同,车牌,铭牌,火车票,化验单,表格,证书,街景文字,名片,数码显示屏等,收集的 300 张图像,每张图平均有 17 个文本框,PaddleOCR 的 F1-Score 超过 0.5,这个性能已经很不错了。
  • 多语言场景:PaddleOCR 选择了开源数据 ICDAR2017 – MLT(多语言文本识别测试集),并抽取其中的法语、德语、日语、韩语数据作为评测集合。其中测试图片大多来自于自然场景,例如广告牌、路标、海报等。

PP-OCR 开发体验再升级

动态图和静态图是深度学习框架常用的两种模式。在动态图模式下,代码编写运行方式符合 Python 程序员的习惯,易于调试,但在性能方面, Python 执行开销较大,与 C++ 有一定差距。

相比动态图,静态图在部署方面更具有性能的优势。静态图程序在编译执行时,预先搭建好的神经网络可以脱离 Python 依赖,在 C++ 端被重新解析执行,而且拥有整体网络结构也能进行一些网络结构的优化。

飞桨动态图中新增了动态图转静态图的功能,支持用户使用动态图编写组网代码。预测部署时,飞桨会对用户代码进行分析,自动转换为静态图网络结构,兼顾了动态图易用性和静态图部署性能两方面优势。

良心出品的中英文文档教程

别的不需要多说了,大家访问 GitHub 点过 star 之后自己体验吧:

https://github.com/PaddlePaddle/PaddleOCR

代码语言:javascript
代码运行次数:0
运行
复制
本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2021-01-07,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 肉眼品世界 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
暂无评论
推荐阅读
编辑精选文章
换一批
有了它,公司的屎山代码就有救了!
前面几天已经介绍好几个 vue 的开发效率插件,今天我们介绍一个 react 相关的效率插件 react-dev-inspector
萌萌哒草头将军
2025/05/04
1000
有了它,公司的屎山代码就有救了!
尤雨溪宣布研发Vite Devtools,这两个很哇塞的 Vite 插件你一定要知道!
尤雨溪团队月初宣布, VoidZero 团队以及 NuxtLabs 合作开发全新的 Vite DevTools。
萌萌哒草头将军
2025/04/30
1810
尤雨溪宣布研发Vite Devtools,这两个很哇塞的 Vite 插件你一定要知道!
现代 Vue 和 Vite 开发:最佳实践和技巧
Vue.js 是用于构建用户界面的渐进式 JavaScript 框架,Vite 是下一代前端构建工具,可显著改善开发体验。
ssh_晨曦时梦见兮
2024/01/31
5470
现代 Vue 和 Vite 开发:最佳实践和技巧
前端食堂技术周刊第 59 期:GitHub Universe 2022、Rome v10、Parcel v2.8.0
周刊仓库 923 个 Star 了,有时间的兄弟们帮忙冲一波 1000 Star。
童欧巴
2023/01/08
5610
前端食堂技术周刊第 59 期:GitHub Universe  2022、Rome v10、Parcel v2.8.0
苦等三年,React Compiler 终于能用了。使用体验:很爽,但仍有瑕疵
自从从它第一次在 React Conf 2021 亮相。到现在 React Conf 2024 正式开源,我已经苦等了三年之久。盼星星盼月亮,终于把他给盼来了。
用户6901603
2024/05/17
1.7K1
苦等三年,React Compiler 终于能用了。使用体验:很爽,但仍有瑕疵
种子轮融资 700 w,Astro 的正式发布给前端界带来了什么?
从年初我就开始关注这个项目了,但当时只是学习了一下仓库的工程化搭建相关的东西 (changesets 自动发包之类),并没有深入了解它本身的功能。借着正式发版的机会,这几天熟悉了一下 Astro 1.0,发现了很多有意思的地方,下文会分别从团队背景、框架定位和核心优势几个维度给大家展开介绍,最后也会推荐一些学习资料。
用户3806669
2022/11/11
1.3K0
种子轮融资 700 w,Astro 的正式发布给前端界带来了什么?
Vite插件开发指南:轻松驾驭前端开发利器
Vite 插件扩展了设计出色的 Rollup 接口,带有一些 Vite 独有的配置项。因此,你只需要编写一个 Vite 插件,就可以同时为开发环境和生产环境工作。
微芒不朽
2024/07/20
2160
Vite插件开发指南:轻松驾驭前端开发利器
Vite:下一代前端构建工具的快速上手
Vite 是由 Vue.js 的作者尤雨溪开发的下一代前端构建工具,它以其快速的冷启动、按需编译和热更新能力而受到广泛关注。Vite 通过利用浏览器原生的 ES 模块导入功能,提供了几乎即时的开发环境启动速度和高度优化的开发体验。
天涯学馆
2024/05/18
2240
Vite3+Pinia2搭建
炑焽
2024/08/20
1120
一些开发者在Remix/React Router合并后转向TanStack
Meta-framework Remix 在 11 月合并了 React Router v7,这促使一些开发人员放弃该框架,转而使用 TanStack。
云云众生s
2025/02/15
1690
Vite2+Vue3+TypeScript:搭建企业级轻量框架实践
随着Vue3为广大开发者所接受和自身生态逐渐完善,更多同学往vue3的工程化方向完善,本文恰好给大家介绍下如何更好使用vue3及其周边插件,以及让他们组合到整个工程中去。
南山种子外卖跑手
2022/02/22
2.5K2
Vite2+Vue3+TypeScript:搭建企业级轻量框架实践
强烈推荐一款 Vue3 调试神器!
大家注意:因为微信最近又改了推送机制,经常有小伙伴说错过了之前被删的文章,或者一些限时福利,错过了就是错过了。所以建议大家加个星标,就能第一时间收到推送。
程序员老鱼
2023/08/10
1K0
强烈推荐一款 Vue3 调试神器!
JavaScript框架--迈向2023年
窥视未来的奇妙之处在于,道路永远不会完全清晰。我们可以看看趋势,看看创新,并尝试制定一个路线。更好的是,我们可以成为这些创新的一部分,引导方向。但没有什么是确定的。
前端小智@大迁世界
2023/03/11
1.4K0
JavaScript框架--迈向2023年
Vite:下一代前端构建工具的快速上手
Vite 是由 Vue.js 的作者尤雨溪开发的下一代前端构建工具,它以其快速的冷启动、按需编译和热更新能力而受到广泛关注。Vite 通过利用浏览器原生的 ES 模块导入功能,提供了几乎即时的开发环境启动速度和高度优化的开发体验。
天涯学馆
2024/07/26
1590
Vite:下一代前端构建工具的快速上手
从0到1使用vite搭建react项目保姆级教程
SWC是JavaScript编译工具比Babel要快,但是在功能和插件生态系统方面Babel更完善
言程序
2024/06/20
3.1K0
从0到1使用vite搭建react项目保姆级教程
如何在2023年开启React项目
在这里,我想给你一个新的React项目入门的简要概述。我想反思一下优点和缺点,反思一下作为一个开发者所需要的技术水平,反思一下作为一个React开发者,每个启动项目都能为你提供哪些功能。最后,你将了解到针对不同需求的3种解决方案。
chuckQu
2023/09/01
5200
如何在2023年开启React项目
如何使用Vite+React18创建Cesium项目?教你两种方式
VM19:1 Blocked script execution in 'about:blank' because the document's frame is sandboxed and the 'allow-scripts' permission is not set.
用户6297767
2023/11/21
5090
如何使用Vite+React18创建Cesium项目?教你两种方式
种草 Vue3 中几个好玩的插件和配置
松哥最近正在录制 TienChin 项目视频~采用 Spring Boot+Vue3 技术栈,里边会涉及到各种好玩的技术,小伙伴们来和松哥一起做一个完成率超 90% 的项目,戳戳戳这里-->TienChin 项目配套视频来啦。 ---- 小伙伴们知道 TienChin 项目前端用的是 Vue3,当我们把 Vue3 官网刷了一遍之后回来看 TienChin 项目的前端,发现还是有很多不太一样的地方,今天松哥就来和大家捋一捋 Vue3 中几个好玩的插件和配置,学完之后,相信大家对 TienChin 项目前端的很
江南一点雨
2022/08/25
1.2K0
种草 Vue3 中几个好玩的插件和配置
基于最新 Vite+Vue3+VantUI移动端应用项目搭建
这里记录下使用最新的Vite+vue3和有赞出品的Vant移动端UI库搭建移动端应用的过程。
杨永贞
2022/01/07
3.3K0
基于最新 Vite+Vue3+VantUI移动端应用项目搭建
Vite2+React+TypeScript:搭建企业级轻量框架实践
Hello大家好,前段时间写了个Vue3的工程项目用起来还不错,其实老早前就想把它移植过来React这边,奈何工作比较忙一直拖到现在,才陆陆续续把杂七杂八的模块补充好。
南山种子外卖跑手
2022/03/27
2.2K0
Vite2+React+TypeScript:搭建企业级轻量框架实践
推荐阅读
相关推荐
有了它,公司的屎山代码就有救了!
更多 >
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
本文部分代码块支持一键运行,欢迎体验
本文部分代码块支持一键运行,欢迎体验