tyzhu/lmind_hotpot_train1000_eval500_v1_qa
收藏资源简介:
--- configs: - config_name: default data_files: - split: train_qa path: data/train_qa-* - split: train_recite_qa path: data/train_recite_qa-* - split: eval_qa path: data/eval_qa-* - split: eval_recite_qa path: data/eval_recite_qa-* - split: all_docs path: data/all_docs-* - split: all_docs_eval path: data/all_docs_eval-* - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: inputs dtype: string - name: targets dtype: string - name: answers struct: - name: answer_start sequence: 'null' - name: text sequence: string splits: - name: train_qa num_bytes: 173266 num_examples: 1000 - name: train_recite_qa num_bytes: 1052784 num_examples: 1000 - name: eval_qa num_bytes: 81677 num_examples: 500 - name: eval_recite_qa num_bytes: 542914 num_examples: 500 - name: all_docs num_bytes: 1370698 num_examples: 2959 - name: all_docs_eval num_bytes: 1370509 num_examples: 2959 - name: train num_bytes: 173266 num_examples: 1000 - name: validation num_bytes: 81677 num_examples: 500 download_size: 2985172 dataset_size: 4846791 --- # Dataset Card for "lmind_hotpot_train1000_eval500_v1_qa" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 默认配置:
- 数据文件路径:
train_qa:data/train_qa-*train_recite_qa:data/train_recite_qa-*eval_qa:data/eval_qa-*eval_recite_qa:data/eval_recite_qa-*all_docs:data/all_docs-*all_docs_eval:data/all_docs_eval-*train:data/train-*validation:data/validation-*
- 数据文件路径:
数据集信息
-
特征:
inputs: 数据类型为stringtargets: 数据类型为stringanswers: 结构化数据,包含:answer_start: 序列类型为nulltext: 序列类型为string
-
数据分割:
train_qa:- 字节数: 173266
- 样本数: 1000
train_recite_qa:- 字节数: 1052784
- 样本数: 1000
eval_qa:- 字节数: 81677
- 样本数: 500
eval_recite_qa:- 字节数: 542914
- 样本数: 500
all_docs:- 字节数: 1370698
- 样本数: 2959
all_docs_eval:- 字节数: 1370509
- 样本数: 2959
train:- 字节数: 173266
- 样本数: 1000
validation:- 字节数: 81677
- 样本数: 500
-
数据集大小:
- 下载大小: 2985172 字节
- 数据集大小: 4846791 字节



