orpo-explorers/OpenHermesPreferences-100k
收藏资源简介:
--- dataset_info: features: - name: source dtype: string - name: category dtype: string - name: prompt dtype: string - name: candidates_completions sequence: string - name: candidate_policies sequence: string - name: ranks sequence: int64 - name: rank_str dtype: string - name: chosen_policy dtype: string - name: chosen list: - name: content dtype: string - name: role dtype: string - name: rejected_policy dtype: string - name: rejected list: - name: content dtype: string - name: role dtype: string splits: - name: train num_bytes: 734023523.6333869 num_examples: 100000 download_size: 365550094 dataset_size: 734023523.6333869 configs: - config_name: default data_files: - split: train path: data/train-* ---
该数据集包含多个字段,如source、category、prompt等,每个字段都有其特定的数据类型。数据集被划分为一个训练集,包含100,000个样本,总大小为734,023,523.6333869字节,下载大小为365,550,094字节。
数据集概述
数据集特征
- source: 数据类型为字符串。
- category: 数据类型为字符串。
- prompt: 数据类型为字符串。
- candidates_completions: 数据类型为字符串序列。
- candidate_policies: 数据类型为字符串序列。
- ranks: 数据类型为整数序列。
- rank_str: 数据类型为字符串。
- chosen_policy: 数据类型为字符串。
- chosen: 包含两个子特征:
- content: 数据类型为字符串。
- role: 数据类型为字符串。
- rejected_policy: 数据类型为字符串。
- rejected: 包含两个子特征:
- content: 数据类型为字符串。
- role: 数据类型为字符串。
数据集分割
- train:
- 数据量: 734023523.6333869 字节。
- 示例数量: 100000。
数据集大小
- 下载大小: 365550094 字节。
- 数据集大小: 734023523.6333869 字节。
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*
- split: train
- data_files:



