debug-gen_critic
收藏资源简介:
该数据集包含文本对话数据及其相关评分信息,主要用于对话生成和评分预测任务。数据集包含五个结构化字段:prompt(字符串类型,表示对话提示)、response(字符串类型,表示对话回复)、pred(浮点数类型,表示预测值)、target(浮点数类型,表示目标值)和score(浮点数类型,表示评分)。数据集分为五个训练子集(train_89、train_90、train_91、train_2和train_1),总数据量为185,858,485字节,包含42,947个样本。各子集规模分别为:train_89(12,651个样本)、train_90(14,214个样本)、train_91(13,782个样本)、train_2(1,422个样本)和train_1(1,278个样本)。数据文件按分割存储在指定路径下。
This dataset comprises text dialogue data and its associated scoring information, primarily used for dialogue generation and scoring prediction tasks. It includes five structured fields: prompt (string type, representing dialogue prompt), response (string type, representing dialogue response), pred (float type, representing predicted value), target (float type, representing target value), and score (float type, representing the evaluation score). The dataset is split into five training subsets: train_89, train_90, train_91, train_2, and train_1. The total data size is 185,858,485 bytes, with a total of 42,947 samples. The sizes of each subset are as follows: train_89 contains 12,651 samples, train_90 contains 14,214 samples, train_91 contains 13,782 samples, train_2 contains 1,422 samples, and train_1 contains 1,278 samples. All data files are stored in designated paths based on their data splits.




