Seongill/NQ_5_missing_adv_top7
收藏官方服务:
资源简介:
--- dataset_info: features: - name: question dtype: string - name: answers sequence: string - name: has_answer dtype: bool - name: similar_sub dtype: string - name: ctxs list: - name: answer_sent sequence: string - name: hasanswer dtype: bool - name: id dtype: string - name: is_adv dtype: bool - name: new_answer_sent dtype: string - name: original_text dtype: string - name: score dtype: float64 - name: text dtype: string - name: title dtype: string - name: status dtype: string splits: - name: train num_bytes: 14540839 num_examples: 3610 download_size: 8130563 dataset_size: 14540839 configs: - config_name: default data_files: - split: train path: data/train-* ---
提供机构:
Seongill原始信息汇总
数据集概述
数据集信息
特征
- question: 类型为字符串。
- answers: 类型为字符串序列。
- has_answer: 类型为布尔值。
- similar_sub: 类型为字符串。
- ctxs: 类型为列表,包含以下子特征:
- answer_sent: 类型为字符串序列。
- hasanswer: 类型为布尔值。
- id: 类型为字符串。
- is_adv: 类型为布尔值。
- new_answer_sent: 类型为字符串。
- original_text: 类型为字符串。
- score: 类型为浮点数(float64)。
- text: 类型为字符串。
- title: 类型为字符串。
- status: 类型为字符串。
数据分割
- train: 包含3610个样本,占用14540839字节。
数据集大小
- 下载大小: 8130563字节。
- 数据集大小: 14540839字节。
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*
- split: train
- data_files:



