sam2ai/hindi_story_cloze_mini
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: eval path: data/eval-* dataset_info: features: - name: story_id dtype: string - name: input_sentence_1 dtype: string - name: input_sentence_2 dtype: string - name: input_sentence_3 dtype: string - name: input_sentence_4 dtype: string - name: sentence_quiz1 dtype: string - name: sentence_quiz2 dtype: string - name: answer_right_ending dtype: int32 splits: - name: train num_bytes: 39375 num_examples: 50 - name: eval num_bytes: 39375 num_examples: 50 download_size: 55954 dataset_size: 78750 --- # Dataset Card for "hindi_story_cloze" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
hindi_story_cloze
数据集配置
- 默认配置:default
数据文件
- 训练集(train):路径为
data/train-* - 评估集(eval):路径为
data/eval-*
数据特征
story_id:故事ID,数据类型为字符串input_sentence_1:输入句子1,数据类型为字符串input_sentence_2:输入句子2,数据类型为字符串input_sentence_3:输入句子3,数据类型为字符串input_sentence_4:输入句子4,数据类型为字符串sentence_quiz1:句子测验1,数据类型为字符串sentence_quiz2:句子测验2,数据类型为字符串answer_right_ending:正确答案结尾,数据类型为整数(int32)
数据集分割
- 训练集(train):字节数为39375,样本数为50
- 评估集(eval):字节数为39375,样本数为50
数据集大小
- 下载大小:55954字节
- 数据集大小:78750字节



