LangAGI-Lab/code-dpo-classification
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: eval path: data/eval-* dataset_info: features: - name: description dtype: string - name: index dtype: int64 - name: invaluabe_feedback dtype: string - name: wrong_code dtype: string - name: valuabe_feedback dtype: string splits: - name: train num_bytes: 27040658 num_examples: 17140 - name: eval num_bytes: 2998200 num_examples: 1904 download_size: 9705149 dataset_size: 30038858 --- # Dataset Card for "code-dpo-classification" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称:default 关联数据文件: - 划分集:训练集(train),文件路径:data/train-* - 划分集:验证集(eval),文件路径:data/eval-* 数据集信息: 特征字段如下: - 字段名:description,数据类型:字符串 - 字段名:index,数据类型:64位整数(int64) - 字段名:invaluable_feedback(原文存在拼写笔误,应为invaluable_feedback),数据类型:字符串 - 字段名:wrong_code,数据类型:字符串 - 字段名:valuable_feedback,数据类型:字符串 数据集划分详情: - 划分集:train(训练集),总字节数:27040658,样本数:17140 - 划分集:eval(验证集),总字节数:2998200,样本数:1904 下载总大小:9705149,数据集总存储大小:30038858 --- # 「code-dpo-classification」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)



