遇见数据集

mashey/dhivehi-vrd-batch-1-img-questions

收藏
Hugging Face2026-05-21 更新2026-05-31 收录
官方服务:

资源简介:

Dhivehi单行文本图像数据集是一个合成Dhivehi文本图像集合,用于训练和评估文本-图像或视觉模型等。每个图像包含单行Dhivehi文本,具有多种视觉风格和增强效果(详细信息可查看配置字段中的行)。注意:该数据集是alakxender/dhivehi-vrd-images的一个子集。

数据集信息: 特征: - 字段名: image,数据类型: 图像(image) - 字段名: question,数据类型: 字符串(string) - 字段名: answer,数据类型: 字符串(string) 划分集: - 名称: train,数据量: 6316914907.079533 字节,样本数: 379335 - 名称: validation,数据量: 1579232889.9204671 字节,样本数: 94834 下载大小: 7851017555 字节 数据集总大小: 7896147797 字节 配置项: - 配置名称: default 数据文件: - 划分集: train,文件路径: data/train-* - 划分集: validation,文件路径: data/validation-* 许可证: Apache-2.0 任务类别: - 图像到文本(image-to-text) - 视觉问答(visual-question-answering) 语言: - dv(迪维希语,Dhivehi) 标签: - Thaana(塔姆蒂文,迪维希语专用书写体系) - 迪维希语(Dhivehi) - 光学字符识别(Optical Character Recognition, OCR) 展示名称: ocr_thaa 样本规模区间: 100K < n < 1M # 迪维希语单行文本图像数据集 本数据集为合成生成的迪维希语单行文本图像集合,用于训练与评估文本-图像/视觉模型等相关任务。 每张图像均包含一行迪维希语文本,并应用了多样化的视觉风格与数据增强手段(可查阅配置字段以获取每条样本的详细信息)。 ***注意:本数据集为alakxender/dhivehi-vrd-images数据集的子集。***

提供机构:
mashey
二维码
社区交流群
二维码
科研交流群
商业服务