ludus800/stack_reddit_subset_completion
收藏资源简介:
--- dataset_info: features: - name: prompt dtype: string - name: completion dtype: string - name: text dtype: string splits: - name: train num_bytes: 1272978 num_examples: 1623 - name: valid num_bytes: 154452 num_examples: 203 - name: test num_bytes: 156110 num_examples: 203 download_size: 594481 dataset_size: 1583540 configs: - config_name: default data_files: - split: train path: data/train-* - split: valid path: data/valid-* - split: test path: data/test-* ---
数据集信息: 特征项: - 名称:提示词(prompt),数据类型:字符串 - 名称:补全结果(completion),数据类型:字符串 - 名称:文本(text),数据类型:字符串 数据集拆分: - 拆分名称:训练集(train),字节大小:1272978,样本数量:1623 - 拆分名称:验证集(valid),字节大小:154452,样本数量:203 - 拆分名称:测试集(test),字节大小:156110,样本数量:203 下载大小:594481 数据集总大小:1583540 配置项: - 配置名称:默认配置(default),数据文件对应如下: - 拆分:训练集(train),路径:data/train-* - 拆分:验证集(valid),路径:data/valid-* - 拆分:测试集(test),路径:data/test-*




