TextDetection文本检测数据集汇总

字符识别和文本检测在实际生活中十分重要,从最简单的车牌检测到复杂的环境文本识别都需要这一技术的支持。目前这一领域最著名的会议是International Conference on Document Analysis and Recognition(ICDAR)

1.文字检测与识别主要数据集

在这里插入图片描述


Total-Text

paper


COCO-Text, COCO-Text V2

paper


MSRA-TD500
在这里插入图片描述
ref paper


ICDAR2017, 竞赛中包含了多个领域的数据集。

Category: Handwritten Historical Document Layout Recognition

cBAD: ICDAR2017 Competition on Baseline Detection ICDAR2017 Competition on Layout Analysis for Challenging Medieval Manuscripts ICDAR2017 Competition on Historical Book Analysis

Category: Historical Handwritten Script Analysis

ICDAR 2017 Competition on the Classification of Medieval Handwritings in Latin Script ICDAR2017 Competition on Historical Document Writer Identification (Historical-WI) Competition on Multi-script Writer Identification Using LAMIS-MSHD and CERUG Databases

Category: Character/Word Spotting

Competition on Query-by-Example Glyph Spotting of Southeast Asian Palm Leaf Manuscript Images Handwritten Keyword Spotting Competition

Category: Handwriting Recognition

ICDAR2017 Competition on Handwritten Text Recognition on the READ Dataset ICDAR2017 Competition on Information Extraction in Historical Handwritten Records

Category: Document Image Binarization

ICDAR2017 Competition on Document Image Binarization (DIBCO 2017)

Category: Document Recognition (Layout analysis & Text Recognition)

ICDAR2017 Competition on Recognition of Documents with Complex Layouts – RDCL2017 ICDAR2017 Competition on Recognition of Early Indian Printed Documents – REID2017 ICDAR2017 Competition on Page Object Detection

Category: Document Reconstruction

Smartphone-captured Document Image Reconstruction from Multiple Views

Category: Post OCR Correction

ICDAR2017 Competition on Post-OCR Text Correction

Category: Robust Reading Competitions

ICDAR2017 Competition on Reading Chinese Text in the Wild (RCTW-17) paper:https://arxiv.org/pdf/1708.09585.pdf ICDAR2017 Robust Reading Challenge on COCO-Text

Category: Text in Video

ICDAR2017 Competition on Arabic Text Detection and Recognition in Multi-resolution Video Frames Competition on Video Script Identification

Category: Forensics

Competition on File Type Identification

Category: Miscellaneous Competitions

ICDAR2017 Competition on Multi-font and Multi-Size Digitally Represented Arabic Text ref:http://mac.xmu.edu.cn/valse2017/ppt/Invited/VALSE2017\_bx.pdf


ICDAR2015
场景文字识别
生成数字图像文字识别
还包含了一个文本超分辨数据集
opencv中的一个接口


ICDAR2013
Robust Reading:http://refbase.cvc.uab.es/files/KSU2013.pdf
中文手写数据集, 下载
ref:https://www.computer.org/csdl/proceedings/icdar/2013/4999/00/06628568.pdf
数字文件researcher:https://roundtrippdf.com/en/

2.一些最近发表的工作(from total-text)

Detection

MSRFTSN, TextSnake, TextField , Mask TextSpotter , TextNet, Textboxes, EAST, Baseline, SegLink

End-to-end Recognition

TextNet, Mask TextSpotter, Textboxes


此外还有下面一些和数字字符识别相关的数据集:
手写字符识别:MNIST


街道门牌号数据集:SVHN
在这里插入图片描述


一些相关网站,可以找到更多数据集:
国际模式识别协会会第十一技术组(OCR):IAPR-TC11TC11 datasets
图像识别TC10工作组, TC10 datasets
ICDAR 2017汇总:https://github.com/cs-chan/Total-Text-Dataset
近年来Robust Reading竞赛汇总网站:http://rrc.cvc.uab.es/
研究导航:http://www.guide2research.com/conference/icdar-2019

在这里插入图片描述
pic from pexels.com

点赞
收藏

评论区

加载中...

相关推荐

MySQL:[Err] 1292 - Incorrect datetime value: ‘0000-00-00 00:00:00‘ for column ‘CREATE_TIME‘ at row 1

文章目录问题用navicat导入数据时,报错:原因这是因为当前的MySQL不支持datetime为0的情况。解决修改sql\mode:sql\mode:SQLMode定义了MySQL应支持的SQL语法、数据校验等,这样可以更容易地在不同的环境中使用MySQL。全局s

Oracle 分组与拼接字符串同时使用

SELECTT.,ROWNUMIDFROM(SELECTT.EMPLID,T.NAME,T.BU,T.REALDEPART,T.FORMATDATE,SUM(T.S0)S0,MAX(UPDATETIME)CREATETIME,LISTAGG(TOCHAR(

皕杰报表之UUID

​在我们用皕杰报表工具设计填报报表时,如何在新增行里自动增加id呢?能新增整数排序id吗?目前可以在新增行里自动增加id,但只能用uuid函数增加UUID编码,不能新增整数排序id。uuid函数说明:获取一个UUID,可以在填报表中用来创建数据ID语法:uuid()或uuid(sep)参数说明:sep布尔值,生成的uuid中是否包含分隔符'',缺省为

手写Java HashMap源码

HashMap的使用教程HashMap的使用教程HashMap的使用教程HashMap的使用教程HashMap的使用教程22

2020年前端实用代码段,为你的工作保驾护航

有空的时候,自己总结了几个代码段,在开发中也经常使用,谢谢。1、使用解构获取json数据let jsonData  id: 1,status: "OK",data: 'a', 'b';let  id, status, data: number   jsonData;console.log(id, status, number )

Android So动态加载 优雅实现与原理分析

背景:漫品Android客户端集成适配转换功能(基于目标识别(So库35M)和人脸识别库(5M)),导致apk体积50M左右,为优化客户端体验,决定实现So文件动态加载.!(https://oscimg.oschina.net/oscnet/00d1ff90e4b34869664fef59e3ec3fdd20b.png)点击上方“蓝字”关注我