登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Character Dataset
Character Dataset
收藏
kaggle
2024-09-04 更新
2024-10-26 收录
手写字符识别
光学字符识别
数据链接:
https://www.kaggle.com/datasets/sathishgsmss/character-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
handwritten images characters
手写图像字符数据集
应用场景:
创建时间:
2024-09-04
相关数据集
OCR纸笔手写文字数据集1
光学字符识别
手写识别
手写文字数据集为图像类数据集,目标为手写汉字。通过移动设备,完成汉字的手写拍摄。为模型训练提供底层数据支撑。
山西数据交易平台
2021-05-12 更新
37
0
zirak-ai/PashtoOCR
光学字符识别
低资源自然语言处理
PsOCR是一个面向低资源普什图语的大型合成光学字符识别(OCR)数据集,包含100万张合成图像,具有单词、行和文档级别的注释,覆盖了包括1000种独特字体家族、多种颜色、图像大小和文本布局的广泛变化。该数据集还包括了用于低资源普什图语OCR系统评估和比较的10000张图像组成的基准。
Hugging Face
2025-09-11 更新
15
0
davanstrien/falcon-ocr-v2-test-l40s
光学字符识别
文档数字化
--- tags: - ocr - document-processing - falcon-ocr - plain - uv-script - generated --- # Document Processing using Falcon OCR (plain mode) This dataset contains OCR results from images in [davanstri
Hugging Face
2026-04-07 更新
7
0
Tamil synthetic OCR benchmarking dataset
光学字符识别
低资源自然语言处理
本研究介绍了一个新型的合成泰米尔OCR基准数据集,该数据集由2437959条记录组成,通过将泰米尔文本从OPUS数据库中的OpenSubtitles v2024版本中提取,并使用六种不同的字体将文本转换为图像。数据集旨在为低资源语言的OCR提供评估和比较的基础,以解决泰米尔等低资源语言在OCR中的挑战。
arXiv
2025-07-24 更新
17
0
szili2011/captcha-ocr-dataset
CAPTCHA识别
光学字符识别
这是一个包含约180万张合成字母数字验证码图像的数据集。每张图像都包含一个随机的、大小写敏感的字母和数字序列。该数据集专门用于训练和测试光学字符识别(OCR)模型,特别是具有CTC损失函数的CRNN模型。数据集包含两个主要文件:一个包含所有图像的zip文件和一个CSV文件,该文件将每个图像文件与其正确的文本标签链接。
Hugging Face
2025-06-26 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广