相关数据集
Total-Text
Total-Text数据集由马来亚大学图像与信号处理中心创建,专注于场景文本检测与识别,特别是曲线路径文本。该数据集包含1555张图像,共9330个标注文本实例,涵盖水平、多向和曲线文本三种方向。创建过程中,数据集考虑了文本方向的多样性,超过半数图像包含两种以上文本方向。Total-Text旨在解决现有数据集中曲线文本缺失的问题,推动场景文本检测技术的发展,特别是在处理复杂场景中的曲线文本识别方面
arXiv2017-10-28 更新2150
Masad55/test
该数据集包含图像和坐标信息。图像以图像格式存储,坐标信息包括中心点的x和y坐标、文本和标签,均为字符串格式。数据集分为训练集、验证集和测试集,分别包含2263、282和284个样本。数据集的总下载大小为349508243字节,总大小为352658069.227字节。
Hugging Face2024-06-26 更新160
ViTextVQA
ViTextVQA is the first high-quality large-scale dataset in Vietnamese specializing in understanding text appearing in images
github2024-04-15 更新360
dimun/dates
--- license: apache-2.0 --- # Annotation The provided format is a generalized representation of metadata associated with image files. Each image entry includes details such as its height and width. A
Hugging Face2024-03-03 更新160



