登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Irregular scene text recognize performance over public.
Irregular scene text recognize performance over public.
收藏
Figshare
2022-08-29 更新
2026-04-28 收录
场景文本识别
不规则OCR评估
数据链接:
https://figshare.com/articles/dataset/Irregular_scene_text_recognize_performance_over_public_/20716837
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Irregular scene text recognize performance over public.
应用场景:
创建时间:
2022-08-29
相关数据集
Real-CE
场景文本识别
图像超分辨率
Real-CE数据集是由香港理工大学和OPPO研究院联合创建的,专注于中英文场景文本图像超分辨率的实际应用。该数据集包含1,935对训练图像和783对测试图像,总计33,789条文本行,其中24,666条为中文,9,123条为英文。数据集通过多种场景和资源收集,确保了文本内容、呈现和光照条件的多样性。创建过程中,使用了不同焦距的相机模块来捕捉图像,并通过图像注册方法进行对齐。Real-CE数据集旨
arXiv
2023-08-07 更新
249
0
Bharat Scene Text Dataset
场景文本识别
多语言数据
Bharat场景文本数据集包含13种语言的图像和文本标注,用于场景文本识别和检测。数据集详细记录了每种语言的图像数量、总词数及带有识别标注的词数,并通过JSON文件格式提供文本的标注信息。
github
2024-05-03 更新
49
0
Awesome Indic Scene Text Dataset
场景文本识别
多语言数据
该项目旨在收集印度语言的场景文本图像,目前专注于收集以下语言的图像:孟加拉语、古吉拉特语、印地语、卡纳达语、马拉雅拉姆语、奥里亚语、旁遮普语、泰米尔语、泰卢固语和乌尔都语。未来可能添加更多印度语言。
github
2022-04-20 更新
13
0
KhmerST
场景文本识别
高棉语
KhmerST数据集是由拉罗谢尔大学的信息图像交互实验室创建的,专门用于低资源高棉语场景文本检测和识别任务。该数据集包含1,544张专家标注的图像,涵盖室内和室外场景,具有多样化的文本类型和光照条件。数据集的创建过程包括在柬埔寨各地采集图像,并使用VGG图像标注器进行标注,提供多边形边界框坐标和行级文本信息。KhmerST数据集旨在解决高棉语在自然场景中的文本检测和识别问题,适用于数字文档存档、自
arXiv
2024-10-24 更新
106
0
STR-Fewer-Labels
场景文本识别
数据集
STR-Fewer-Labels数据集是由东京大学创建的,用于场景文本识别(STR)任务的数据集。该数据集包含276,000条真实标记的数据,旨在解决在无法使用合成数据的情况下训练STR模型的问题,特别是在处理手写或艺术文本以及非英语语言时。数据集通过GitHub公开,地址为https://github.com/ku21fan/STR-Fewer-Labels。创建过程涉及整合多个公开的真实数据源
arXiv
2021-06-05 更新
37
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广