相关数据集
antoineedy/vidore_v3_test_hr_mteb_format
Vidore3HrRetrieval是一个多语言文档检索数据集,属于MTEB(大规模文本嵌入基准)的一部分。该数据集包含欧盟发布的高分辨率报告,专门设计用于复杂文档理解任务。原始查询为英文,后被翻译成法语、德语、意大利语、葡萄牙语和西班牙语。数据集支持视觉文档检索、图像到文本和文本到图像等多种任务类型,包含语料库(corpus)、查询相关文档(qrels)和查询(queries)三个主要部分,每种
Hugging Face2025-12-19 更新270
DCQA
该数据集名为DCQA,包含了50,010份合成文档,这些文档融合了多种风格的图表。同时,该数据集还包含了699,051个问题,这些问题需要复杂的推理能力和常识性理解。数据集涵盖了六种不同的图表风格,并采用问答生成引擎来产生多样化的推理型问答对。规模上,该数据集包含了50,010份文档和699,051个问题,其任务涵盖了文档级问答和图表问答。
arXiv170
vidore/syntheticDocQA_healthcare_industry_test_ocr_chunk
--- dataset_info: features: - name: query dtype: string - name: image dtype: image - name: image_filename dtype: string - name: answer dtype: string - name: page dtype:
Hugging Face2024-06-13 更新150
coldoc/syntheticDocQA_energy_test
--- dataset_info: features: - name: query dtype: string - name: image dtype: image - name: image_filename dtype: string - name: answer dtype: string - name: page dtype:
Hugging Face2024-06-03 更新250
Nabin1995/invoice-dataset-layoutlmv3
该数据集包含图像和注释两个主要特征。注释部分包括边界框(bboxes)、命名实体识别标签(ner_tags)、路径(path)和单词(words)。数据集分为训练集、验证集和测试集三个部分,分别包含7000、1000和2000个样本。数据集的下载大小为477046778字节,总大小为591985783字节。
Hugging Face2024-07-20 更新160



