tyzhu/lmind_hotpot_train1000_eval200_v1_doc_qa
收藏资源简介:
--- configs: - config_name: default data_files: - split: train_qa path: data/train_qa-* - split: train_recite_qa path: data/train_recite_qa-* - split: eval_qa path: data/eval_qa-* - split: eval_recite_qa path: data/eval_recite_qa-* - split: all_docs path: data/all_docs-* - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: inputs dtype: string - name: targets dtype: string - name: answers struct: - name: answer_start sequence: 'null' - name: text sequence: string splits: - name: train_qa num_bytes: 173266 num_examples: 1000 - name: train_recite_qa num_bytes: 1024784 num_examples: 1000 - name: eval_qa num_bytes: 33160 num_examples: 200 - name: eval_recite_qa num_bytes: 208740 num_examples: 200 - name: all_docs num_bytes: 1054269 num_examples: 2373 - name: train num_bytes: 1227535 num_examples: 3373 - name: validation num_bytes: 33160 num_examples: 200 download_size: 2356905 dataset_size: 3754914 --- # Dataset Card for "lmind_hotpot_train1000_eval200_v1_doc_qa" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:default 数据文件: - 拆分:train_qa,路径:data/train_qa-* - 拆分:train_recite_qa,路径:data/train_recite_qa-* - 拆分:eval_qa,路径:data/eval_qa-* - 拆分:eval_recite_qa,路径:data/eval_recite_qa-* - 拆分:all_docs,路径:data/all_docs-* - 拆分:train,路径:data/train-* - 拆分:validation,路径:data/validation-* 数据集信息: 数据集特征: - 名称:inputs,数据类型:字符串 - 名称:targets,数据类型:字符串 - 名称:answers,结构体: - 名称:answer_start,序列:空值 - 名称:text,序列:字符串 数据集拆分详情: - 拆分名称:train_qa,字节数:173266,样本数:1000 - 拆分名称:train_recite_qa,字节数:1024784,样本数:1000 - 拆分名称:eval_qa,字节数:33160,样本数:200 - 拆分名称:eval_recite_qa,字节数:208740,样本数:200 - 拆分名称:all_docs,字节数:1054269,样本数:2373 - 拆分名称:train,字节数:1227535,样本数:3373 - 拆分名称:validation,字节数:33160,样本数:200 下载总大小:2356905 数据集总存储大小:3754914 --- # "lmind_hotpot_train1000_eval200_v1_doc_qa" 数据集卡片 [更多信息请参阅](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
- 名称: lmind_hotpot_train1000_eval200_v1_doc_qa
数据集配置
- 默认配置: default
数据文件路径
- 训练问答: data/train_qa-*
- 训练背诵问答: data/train_recite_qa-*
- 评估问答: data/eval_qa-*
- 评估背诵问答: data/eval_recite_qa-*
- 所有文档: data/all_docs-*
- 训练数据: data/train-*
- 验证数据: data/validation-*
数据集特征
- 输入: string
- 目标: string
- 答案:
- 答案开始位置: null
- 文本: string
数据集分割
- 训练问答:
- 字节数: 173266
- 样本数: 1000
- 训练背诵问答:
- 字节数: 1024784
- 样本数: 1000
- 评估问答:
- 字节数: 33160
- 样本数: 200
- 评估背诵问答:
- 字节数: 208740
- 样本数: 200
- 所有文档:
- 字节数: 1054269
- 样本数: 2373
- 训练数据:
- 字节数: 1227535
- 样本数: 3373
- 验证数据:
- 字节数: 33160
- 样本数: 200
数据集大小
- 下载大小: 2356905
- 数据集大小: 3754914



