遇见数据集

mixedbread-ai/vidore-syntheticDocQA_healthcare_industry_test

收藏
Hugging Face2024-09-21 更新2025-04-08 收录
官方服务:

资源简介:

该数据集包含三种配置:语料库配置(corpus)、默认配置(default)和查询配置(queries)。语料库配置包含图片和唯一标识符(corpus-id),默认配置包含查询唯一标识符(query-id)、语料唯一标识符(corpus-id)和分数(score),查询配置包含查询唯一标识符和查询文本。数据集的训练集大小、下载大小和总数据大小在README中有详细描述。

The dataset consists of three configurations: corpus, default, and queries. The corpus configuration includes images and unique identifiers (corpus-id), the default configuration includes query unique identifiers (query-id), corpus unique identifiers (corpus-id), and scores (score), and the queries configuration includes query unique identifiers and query text. The training set size, download size, and total dataset size are detailed in the README.

提供机构:
mixedbread-ai
二维码
社区交流群
二维码
科研交流群
商业服务