遇见数据集

ai2-adapt-dev/UltraInteract_pair_maxlen_Coding

收藏
Hugging Face2024-08-29 更新2025-04-12 收录
官方服务:

资源简介:

--- dataset_info: features: - name: task dtype: string - name: dataset dtype: string - name: chosen list: - name: content dtype: string - name: role dtype: string - name: rejected list: - name: content dtype: string - name: role dtype: string - name: id dtype: string - name: parent_id dtype: string - name: length dtype: int64 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 139942526 num_examples: 13642 download_size: 55196534 dataset_size: 139942526 configs: - config_name: default data_files: - split: train path: data/train-* ---

dataset_info: 特征字段: - 字段名: task 数据类型: 字符串 - 字段名: dataset 数据类型: 字符串 - 字段名: chosen(优选对话序列) 数据类型: 列表 子字段: - 字段名: content 数据类型: 字符串 - 字段名: role 数据类型: 字符串 - 字段名: rejected(拒选对话序列) 数据类型: 列表 子字段: - 字段名: content 数据类型: 字符串 - 字段名: role 数据类型: 字符串 - 字段名: id 数据类型: 字符串 - 字段名: parent_id 数据类型: 字符串 - 字段名: length 数据类型: 整型 - 字段名: __index_level_0__ 数据类型: 整型 数据划分: - 划分名称: train(训练集) 字节占用量: 139942526 样本数量: 13642 下载文件大小: 55196534 数据集存储大小: 139942526 配置项: - 配置名称: default(默认配置) 数据文件: - 对应数据拆分: train 文件路径: data/train-*

提供机构:
ai2-adapt-dev
二维码
社区交流群
二维码
科研交流群
商业服务