weqweasdas/preference_dataset_mixture2_and_safe_pku150k
收藏资源简介:
--- dataset_info: features: - name: chosen_score dtype: float64 - name: rejected list: - name: content dtype: string - name: role dtype: string - name: rejected_score dtype: float64 - name: chosen list: - name: content dtype: string - name: role dtype: string splits: - name: train num_bytes: 1935063763 num_examples: 678029 download_size: 1101844862 dataset_size: 1935063763 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "preference_dataset_mixture2_and_safe_pku150k" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 特征: - 名称: chosen_score(优选得分) 数据类型: float64 - 名称: rejected(拒选回复组) 列表: - 名称: content(回复内容) 数据类型: string - 名称: role(角色) 数据类型: string - 名称: rejected_score(拒选得分) 数据类型: float64 - 名称: chosen(优选回复组) 列表: - 名称: content(回复内容) 数据类型: string - 名称: role(角色) 数据类型: string 数据集划分: - 名称: train(训练集) 字节大小: 1935063763 样本数量: 678029 下载大小: 1101844862 数据集大小: 1935063763 配置项: - 配置名称: default(默认配置) 数据文件: - 划分集: train(训练集) 路径: data/train-* --- # 「preference_dataset_mixture2_and_safe_pku150k(偏好混合数据集2与安全PKU150K)」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
preference_dataset_mixture2_and_safe_pku150k
数据集特征
- chosen_score: 数据类型为 float64。
- rejected: 包含两个子特征:
- content: 数据类型为 string。
- role: 数据类型为 string。
- rejected_score: 数据类型为 float64。
- chosen: 包含两个子特征:
- content: 数据类型为 string。
- role: 数据类型为 string。
数据集分割
- train: 包含 678029 个示例,数据大小为 1935063763 字节。
数据集大小
- 下载大小: 1101844862 字节。
- 数据集大小: 1935063763 字节。
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*




