AIhnIndicRag/Hindi_Scidocs
收藏资源简介:
--- language: - hin multilinguality: - monolingual task_categories: - text-retrieval source_datasets: - arguana task_ids: - document-retrieval config_names: - corpus tags: - text-retrieval dataset_info: - config_name: default features: - name: query-id dtype: string - name: corpus-id dtype: string - name: score dtype: float64 - config_name: corpus features: - name: _id dtype: string - name: title dtype: string - name: text dtype: string - config_name: queries features: - name: _id dtype: string - name: text dtype: string configs: - config_name: default data_files: - split: test path: qrels/test.tsv - config_name: corpus data_files: - split: corpus path: corpus.jsonl - config_name: queries data_files: - split: queries path: queries.jsonl license: cc ---
语言: - 印地语(Hindi) 多语言特性: - 单语(monolingual) 任务类别: - 文本检索(text-retrieval) 源数据集: - Arguana 任务子类别: - 文档检索(document-retrieval) 配置名称列表: - 语料库(corpus) 标签: - 文本检索 数据集信息: - 配置名称:默认(default) 特征: - 名称:查询ID(query-id),数据类型:字符串 - 名称:语料库ID(corpus-id),数据类型:字符串 - 名称:得分(score),数据类型:64位浮点型 - 配置名称:语料库(corpus) 特征: - 名称:标识符(_id),数据类型:字符串 - 名称:标题(title),数据类型:字符串 - 名称:文本(text),数据类型:字符串 - 配置名称:查询集(queries) 特征: - 名称:标识符(_id),数据类型:字符串 - 名称:文本(text),数据类型:字符串 配置项: - 配置名称:默认(default) 数据文件: - 拆分方式:测试集(test),路径:qrels/test.tsv - 配置名称:语料库(corpus) 数据文件: - 拆分方式:语料库拆分(corpus),路径:corpus.jsonl - 配置名称:查询集(queries) 数据文件: - 拆分方式:查询集拆分(queries),路径:queries.jsonl 许可证:知识共享(CC)



