遇见数据集

irds/neumarco_fa_dev

收藏
Hugging Face2023-01-05 更新2024-03-04 收录
官方服务:

资源简介:

`neumarco/fa/dev`数据集由ir-datasets包提供,包含查询(queries)和相关性评估(qrels)两部分。查询部分包含101,093条记录,相关性评估部分包含59,273条记录。文档部分需要使用`irds/neumarco_fa`数据集。该数据集主要用于文本检索任务,并且可以通过Hugging Face的datasets库进行加载和使用。

The `neumarco/fa/dev` dataset is provided by the ir-datasets package, and it consists of two components: queries and relevance judgments (qrels). The queries component contains 101,093 records, while the relevance judgments component has 59,273 records. The document part of this dataset requires the use of the `irds/neumarco_fa` dataset. This dataset is primarily designed for text retrieval tasks, and can be loaded and utilized via the Hugging Face datasets library.

提供机构:
irds
原始信息汇总

数据集卡片 neumarco/fa/dev

数据集概述

neumarco/fa/dev 数据集由 ir-datasets 包提供。

数据内容

该数据集包含以下内容:

  • queries(即主题):数量为 101,093
  • qrels(相关性评估):数量为 59,273

对于 docs,请使用 irds/neumarco_fa

使用方法

以下是加载和使用该数据集的示例代码:

python from datasets import load_dataset

queries = load_dataset(irds/neumarco_fa_dev, queries) for record in queries: record # {query_id: ..., text: ...}

qrels = load_dataset(irds/neumarco_fa_dev, qrels) for record in qrels: record # {query_id: ..., doc_id: ..., relevance: ..., iteration: ...}

注意:调用 load_dataset 将下载数据集(或提供非公开数据集的访问指令),并在 🤗 Dataset 格式中创建数据的副本。

二维码
社区交流群
二维码
科研交流群
商业服务