Weni/test-benchmark
收藏资源简介:
--- dataset_info: features: - name: '' dtype: string - name: content dtype: string - name: context_metadata dtype: string - name: question dtype: string - name: type_question dtype: string - name: type_feature dtype: string - name: name dtype: string - name: occupation dtype: string - name: instructions sequence: string - name: chatbot_goal dtype: string - name: adjective dtype: string - name: data_category dtype: string - name: id dtype: string - name: chunks_big list: - name: content dtype: string - name: score dtype: int64 - name: classes list: - name: ' context' dtype: string - name: ' id' dtype: string - name: class dtype: string - name: context dtype: string - name: id dtype: string - name: chosen_class_id dtype: string - name: language dtype: string - name: data_category_QA dtype: string splits: - name: train num_bytes: 60210444 num_examples: 3890 download_size: 16465838 dataset_size: 60210444 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 字段名:空,数据类型:字符串 - 字段名:content(内容),数据类型:字符串 - 字段名:context_metadata(上下文元数据),数据类型:字符串 - 字段名:question(问题),数据类型:字符串 - 字段名:type_question(问题类型),数据类型:字符串 - 字段名:type_feature(特征类型),数据类型:字符串 - 字段名:name(名称),数据类型:字符串 - 字段名:occupation(职业),数据类型:字符串 - 字段名:instructions(指令集),数据类型:字符串序列 - 字段名:chatbot_goal(聊天机器人目标),数据类型:字符串 - 字段名:adjective(描述性形容词),数据类型:字符串 - 字段名:data_category(数据类别),数据类型:字符串 - 字段名:id(标识符),数据类型:字符串 - 字段名:chunks_big(大分块单元),数据类型:列表,列表项包含: - 字段名:content(内容),数据类型:字符串 - 字段名:score(分值),数据类型:int64 - 字段名:classes(类别集合),数据类型:列表,列表项包含: - 字段名:context(上下文),数据类型:字符串 - 字段名:id(标识符),数据类型:字符串 - 字段名:class(类别),数据类型:字符串 - 字段名:context(上下文),数据类型:字符串 - 字段名:id(标识符),数据类型:字符串 - 字段名:chosen_class_id(选中类别标识符),数据类型:字符串 - 字段名:language(语言),数据类型:字符串 - 字段名:data_category_QA(问答任务数据类别),数据类型:字符串 数据集划分: - 划分名称:训练集(train),占用字节数:60210444,样本总数:3890 下载总大小:16465838,数据集存储总大小:60210444 配置项: - 配置名称:默认(default),数据文件: - 划分:训练集(train),文件路径:data/train-*



