遇见数据集

trumancai/msmarco-w-instruction

收藏
Hugging Face2024-10-31 更新2024-12-14 收录
官方服务:

资源简介:

该数据集是一个用于文本检索任务的单语(英语)数据集。数据集包含三个配置:default、corpus和queries。default配置包含查询ID、语料库ID和分数,主要用于测试集;corpus配置包含语料库的ID、标题和文本内容;queries配置包含查询的ID和文本内容。数据集的主要任务是文档检索,数据来源于msmarco-w-instruction。

This dataset is a monolingual (English) dataset for text retrieval tasks. The dataset contains three configurations: default, corpus, and queries. The default configuration includes query ID, corpus ID, and score, primarily used for the test set; the corpus configuration includes corpus ID, title, and text content; the queries configuration includes query ID and text content. The main task of the dataset is document retrieval, and the data is sourced from msmarco-w-instruction.

提供机构:
trumancai
二维码
社区交流群
二维码
科研交流群
商业服务