相关数据集
CTW1500
CTW1500数据集是由华南理工大学电子信息工程学院创建的一个新型曲线文本数据集,专注于提升自然场景中曲线文本的检测能力。该数据集包含1500张图像,总计超过10000个文本标注,每张图像至少包含一个曲线文本。数据来源多样,包括互联网、图像库及手机拍摄等,涵盖多种语言和文本方向。创建过程中,研究团队采用了14点多边形标注方法,有效减少了人工标注的工作量。CTW1500数据集的应用领域主要集中在曲线
arXiv2017-12-06 更新5600
English OCR Data in Natural Scenes
71,535 Images English OCR Data in Natural Scenes
kaggle2023-10-13 更新210
Ashu44268/ICDAR2013_OCR
ICDAR 2013数据集是一个用于光学字符识别(OCR)的数据集,包含自然场景中的英文文本图像及其对应的文本标签。数据集分为训练集和测试集,每部分又包含普通文本和数字文本。该数据集支持文本检测、文本识别和文本定位任务,适用于图像到文本的研究和应用。
Hugging Face2025-12-16 更新140
222,289张中文自然场景OCR数据【数据堂】
222,289张中文自然场景OCR数据采集场景涵盖室内和室外场景。数据多样性包括多种场景和多种拍摄角度。在标注方面,对图像中文字进行行级标注、单词级标注、字符级标注和内容转写。本套中文自然场景OCR数据可用于自然场景OCR任务
OpenDataLab2024-05-22 更新510
Handwriting OCR Data of Japanese and Korean
71,535 Images English OCR Data in Natural Scenes
kaggle2023-10-13 更新190



