mteb/llm-eval-public-health-qa
收藏资源简介:
该数据集是一个用于信息检索或文本匹配任务的数据集,包含三个主要配置:1) corpus配置:包含172个文档,每个文档有_id、title和text字段,用于构建文档库;2) queries配置:包含100个查询,每个查询有_id和text字段;3) default配置:包含100个测试样本,每个样本有query-id、corpus-id和score字段,用于评估查询与文档之间的相关性得分。数据集总大小约150KB,适用于自然语言处理中的检索和排序实验。
This dataset is designed for information retrieval or text matching tasks, consisting of three main configurations: 1) corpus configuration: includes 172 documents, each with _id, title, and text fields, used to build a document repository; 2) queries configuration: includes 100 queries, each with _id and text fields; 3) default configuration: includes 100 test samples, each with query-id, corpus-id, and score fields, used to evaluate relevance scores between queries and documents. The total dataset size is approximately 150KB, suitable for retrieval and ranking experiments in natural language processing.




