登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
lionking1988/docvqa_special_equip
lionking1988/docvqa_special_equip
收藏
Hugging Face
2023-05-26 更新
2024-03-04 收录
视觉问答
特殊设备
数据链接:
https://hf-mirror.com/datasets/lionking1988/docvqa_special_equip
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
一个用于特殊设备的docvqa格式数据集。
应用场景:
提供机构:
lionking1988
原始信息汇总
数据集概述
该数据集为特殊设备领域的文档视觉问答(DocVQA)格式数据集。
相关数据集
kaist-ai/volcano-train
文本到图像
视觉问答
--- task_categories: - image-to-text language: - en tags: - image-to-text - image-captioning - visual-question-answering size_categories: - 1M<n<10M --- # Data details - **274K multimodal feedback and
Hugging Face
2023-11-13 更新
17
0
ChuGyouk/PubMedVision-EnKo
医学影像
视觉问答
PubMedVision是一个大规模的医学视觉问答数据集。该数据集从PubMed中提取高质量的图像-文本对,并使用GPT-4V进行格式化以提升其质量。PubMedVision显著提高了多模态语言模型在医学领域的多模态能力。数据集包含1,294,062个医学视觉问答实例,分为对齐视觉问答和指令微调视觉问答两部分,每部分各含647,031个数据。
Hugging Face
2025-01-20 更新
14
0
abhishekvidhate/DocQVA_small
视觉问答
机器学习
该数据集包含以英语为主的问答数据,每个数据项包括一个问题、一张图像和一个答案列表。数据集的一个分割名为train_small,包含99个示例,数据大小约为57.5MB。
Hugging Face
2024-07-12 更新
10
0
sub_spatial
视觉问答
图像处理
这是一个从EmbSpatial-Bench、BLINK、CV-Bench和VSI-Bench-tiny等开源数据集中收集和提取的问答数据集。数据集包含问题ID、问题文本、正确答案、关联图像、视频路径、图像路径、可选答案列表、子任务类型、问题类别和来源等信息。测试集共有690个示例,数据集总大小为136,301,763字节。
Hugging Face
2025-04-21 更新
14
0
salma-remyx/vqasynth_sample_spatial_new
视觉问答
图像理解
该数据集包含图像和消息两个主要特征。图像特征的数据类型为图像,消息特征是一个列表,包含内容和角色两个子特征。内容子特征进一步包含索引、文本和类型三个子特征,数据类型分别为整数、字符串和字符串。角色子特征的数据类型为字符串。数据集包含一个名为训练的分割,包含10个示例,总大小为1566310字节。数据集的总下载大小为1391554字节。数据集标签包括vqasynth和remyx。
Hugging Face
2024-12-04 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广