vwxyzjn/openhermes-dev__kaist-ai_prometheus-13b-v1.0__1707406141
收藏资源简介:
--- dataset_info: features: - name: model dtype: 'null' - name: category dtype: string - name: language dtype: string - name: custom_instruction dtype: bool - name: id dtype: string - name: topic dtype: string - name: avatarUrl dtype: 'null' - name: idx dtype: 'null' - name: conversations list: - name: from dtype: string - name: value dtype: string - name: weight dtype: 'null' - name: system_prompt dtype: string - name: source dtype: string - name: model_name dtype: string - name: skip_prompt_formatting dtype: bool - name: title dtype: string - name: hash dtype: 'null' - name: views dtype: 'null' - name: prompt dtype: string - name: token_length dtype: int64 - name: candidate0 list: - name: content dtype: string - name: role dtype: string - name: candidate1 list: - name: content dtype: string - name: role dtype: string - name: candidate0_policy dtype: string - name: candidate1_policy dtype: string - name: llm_as_a_judge_prompt dtype: string - name: completion0 dtype: string - name: candidate0_score dtype: float64 - name: completion1 dtype: string - name: candidate1_score dtype: float64 - name: chosen list: - name: content dtype: string - name: role dtype: string - name: chosen_policy dtype: string - name: rejected list: - name: content dtype: string - name: role dtype: string - name: rejected_policy dtype: string splits: - name: train_prefs num_bytes: 3180262 num_examples: 167 download_size: 1738919 dataset_size: 3180262 configs: - config_name: default data_files: - split: train_prefs path: data/train_prefs-* ---
数据集概述
数据集信息
特征
- model: 数据类型为
null - category: 数据类型为
string - language: 数据类型为
string - custom_instruction: 数据类型为
bool - id: 数据类型为
string - topic: 数据类型为
string - avatarUrl: 数据类型为
null - idx: 数据类型为
null - conversations: 列表类型,包含以下子特征:
- from: 数据类型为
string - value: 数据类型为
string - weight: 数据类型为
null
- from: 数据类型为
- system_prompt: 数据类型为
string - source: 数据类型为
string - model_name: 数据类型为
string - skip_prompt_formatting: 数据类型为
bool - title: 数据类型为
string - hash: 数据类型为
null - views: 数据类型为
null - prompt: 数据类型为
string - token_length: 数据类型为
int64 - candidate0: 列表类型,包含以下子特征:
- content: 数据类型为
string - role: 数据类型为
string
- content: 数据类型为
- candidate1: 列表类型,包含以下子特征:
- content: 数据类型为
string - role: 数据类型为
string
- content: 数据类型为
- candidate0_policy: 数据类型为
string - candidate1_policy: 数据类型为
string - llm_as_a_judge_prompt: 数据类型为
string - completion0: 数据类型为
string - candidate0_score: 数据类型为
float64 - completion1: 数据类型为
string - candidate1_score: 数据类型为
float64 - chosen: 列表类型,包含以下子特征:
- content: 数据类型为
string - role: 数据类型为
string
- content: 数据类型为
- chosen_policy: 数据类型为
string - rejected: 列表类型,包含以下子特征:
- content: 数据类型为
string - role: 数据类型为
string
- content: 数据类型为
- rejected_policy: 数据类型为
string
数据分割
- train_prefs: 包含 3180262 字节的数据,共有 167 个样本
数据集大小
- 下载大小: 1738919 字节
- 数据集大小: 3180262 字节
配置
- default:
- 数据文件:
- train_prefs: 路径为
data/train_prefs-*
- train_prefs: 路径为
- 数据文件:



