andrewsiah/personalization_prompt_response_oasst_pythia_7b
收藏资源简介:
--- dataset_info: features: - name: reward_1 dtype: float64 - name: reward_2 dtype: float64 - name: reward_3 dtype: float64 - name: reward_4 dtype: float64 - name: reward_5 dtype: float64 - name: reward_6 dtype: float64 - name: reward_7 dtype: float64 - name: reward_8 dtype: float64 - name: prompt dtype: string - name: subset dtype: string - name: id dtype: int64 - name: response_1 dtype: string - name: response_1_model dtype: string - name: response_2 dtype: string - name: response_2_model dtype: string - name: response_3 dtype: string - name: response_3_model dtype: string - name: response_4 dtype: string - name: response_4_model dtype: string - name: response_5 dtype: string - name: response_5_model dtype: string - name: response_6 dtype: string - name: response_6_model dtype: string - name: response_7 dtype: string - name: response_7_model dtype: string - name: response_8 dtype: string - name: response_8_model dtype: string - name: rformatted_promptresponse_1 dtype: string - name: rformatted_promptresponse_2 dtype: string - name: rformatted_promptresponse_3 dtype: string - name: rformatted_promptresponse_4 dtype: string - name: rformatted_promptresponse_5 dtype: string - name: rformatted_promptresponse_6 dtype: string - name: rformatted_promptresponse_7 dtype: string - name: rformatted_promptresponse_8 dtype: string splits: - name: train num_bytes: 313975092 num_examples: 10431 download_size: 185968772 dataset_size: 313975092 configs: - config_name: default data_files: - split: train path: data/train-* ---
The dataset includes multiple reward features (reward_1 to reward_8), all of which are float64 type; a prompt feature (prompt), string type; a subset feature (subset), string type; an identifier (id), integer type; and multiple responses with corresponding model information. The dataset is divided into a training set (train), containing 10431 samples, with a total size of 313975092 bytes. The download size of the dataset is 185968772 bytes.
数据集概述
数据集特征
- reward_1 至 reward_8: 数据类型为
float64。 - prompt: 数据类型为
string。 - subset: 数据类型为
string。 - id: 数据类型为
int64。 - response_1 至 response_8: 数据类型为
string。 - response_1_model 至 response_8_model: 数据类型为
string。 - rformatted_promptresponse_1 至 rformatted_promptresponse_8: 数据类型为
string。
数据集分割
- train: 包含 10431 个示例,数据大小为 313975092 字节。
数据集大小
- 下载大小: 185968772 字节。
- 数据集大小: 313975092 字节。



