davanstrien/davanstriendataset-preferences-llm-course-model-selection
收藏资源简介:
--- dataset_info: features: - name: datasetId dtype: string - name: card dtype: string - name: instruction dtype: string - name: system_prompt dtype: string - name: generation_models sequence: string - name: generations sequence: string - name: model_name dtype: string - name: ratings sequence: int64 - name: rationales sequence: string splits: - name: train num_bytes: 167878 num_examples: 13 download_size: 79738 dataset_size: 167878 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征列表: - 字段名:数据集ID(datasetId),数据类型:字符串 - 字段名:数据集卡片(card),数据类型:字符串 - 字段名:指令(instruction),数据类型:字符串 - 字段名:系统提示词(system_prompt),数据类型:字符串 - 字段名:生成模型(generation_models),数据类型:字符串序列 - 字段名:生成结果(generations),数据类型:字符串序列 - 字段名:模型名称(model_name),数据类型:字符串 - 字段名:评分(ratings),数据类型:64位整数序列 - 字段名:评分理由(rationales),数据类型:字符串序列 数据集划分: - 划分名称:训练集(train),占用字节数:167878,样本数量:13 下载大小:79738 数据集总大小:167878 配置项: - 配置名称:默认(default),数据文件: - 对应划分:训练集(train),文件路径:data/train-*
数据集概述
数据集特征
- datasetId: 字符串类型
- card: 字符串类型
- instruction: 字符串类型
- system_prompt: 字符串类型
- generation_models: 字符串序列类型
- generations: 字符串序列类型
- model_name: 字符串类型
- ratings: 整数序列类型
- rationales: 字符串序列类型
数据集分割
- train:
- 数据大小: 167878 字节
- 示例数量: 13
数据集大小
- 下载大小: 79738 字节
- 数据集总大小: 167878 字节
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*



