ai2-adapt-dev/UltraInteract_pair_randomlen_Coding
收藏资源简介:
--- dataset_info: features: - name: task dtype: string - name: dataset dtype: string - name: chosen list: - name: content dtype: string - name: role dtype: string - name: rejected list: - name: content dtype: string - name: role dtype: string - name: id dtype: string - name: parent_id dtype: string - name: length dtype: int64 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 101638655 num_examples: 13642 download_size: 45516651 dataset_size: 101638655 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 名称:任务(task),数据类型:字符串 - 名称:数据集(dataset),数据类型:字符串 - 名称:首选对话序列(chosen),数据类型:列表,其列表项包含: - 名称:对话内容(content),数据类型:字符串 - 名称:发言角色(role),数据类型:字符串 - 名称:落选对话序列(rejected),数据类型:列表,其列表项包含: - 名称:对话内容(content),数据类型:字符串 - 名称:发言角色(role),数据类型:字符串 - 名称:标识符(id),数据类型:字符串 - 名称:父标识符(parent_id),数据类型:字符串 - 名称:序列长度(length),数据类型:64位整型(int64) - 名称:内置索引层级0(__index_level_0__),数据类型:64位整型(int64) 数据划分: - 划分名称:训练集(train),字节占用量:101638655,示例总数:13642 下载总大小:45516651 字节 数据集总大小:101638655 字节 配置项: - 配置名称:默认配置(default),数据文件: - 对应划分:训练集(train),存储路径:data/train-*



