hyue0768/assignment4-qwen25-pairrm-dpo-dataset-20260423-093702
收藏资源简介:
--- dataset_info: features: - name: id dtype: int64 - name: prompt list: - name: role dtype: string - name: content dtype: string - name: chosen list: - name: role dtype: string - name: content dtype: string - name: rejected list: - name: role dtype: string - name: content dtype: string - name: instruction dtype: string - name: chosen_text dtype: string - name: rejected_text dtype: string - name: all_candidates list: string - name: pairrm_ranks list: int64 splits: - name: train num_bytes: 543289 num_examples: 50 download_size: 520005 dataset_size: 543289 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息(dataset_info)如下: 一、特征字段(features): 1. id:整数64位(int64)类型,作为样本唯一标识符; 2. prompt:列表结构,包含两个子字段: - role:字符串类型,用于标识对话角色; - content:字符串类型,对应对话上下文内容; 3. chosen:列表结构,包含两个子字段: - role:字符串类型,用于标识对话角色; - content:字符串类型,对应被选中的优质对话回复; 4. rejected:列表结构,包含两个子字段: - role:字符串类型,用于标识对话角色; - content:字符串类型,对应被拒绝的低质对话回复; 5. instruction:字符串类型,为任务指令文本; 6. chosen_text:字符串类型,为选中回复的纯文本形式; 7. rejected_text:字符串类型,为被拒回复的纯文本形式; 8. all_candidates:字符串列表,包含当前样本的所有候选回复; 9. pairrm_ranks:整数64位(int64)列表,对应各候选回复的排序评分或排名; 二、数据划分(splits): 仅包含训练集(train),其数据占用字节数为543289,样本总数为50; 三、整体规模:下载大小为520005字节,数据集解压后总大小为543289字节; 四、数据集配置(configs): 默认配置(default)下的数据文件包含训练集拆分,对应存储路径为data/train-*。



