arjun3103/haystack_similarity_eval
收藏官方服务:
资源简介:
--- dataset_info: features: - name: questions dtype: string - name: ground_truth_answers sequence: string - name: response_answers dtype: string - name: ans_type dtype: string - name: similarity dtype: float64 splits: - name: train num_bytes: 45329 num_examples: 58 download_size: 19161 dataset_size: 45329 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 字段名:问题(questions),数据类型:字符串 - 字段名:标准答案集合(ground_truth_answers),数据类型:字符串序列 - 字段名:模型回复答案(response_answers),数据类型:字符串 - 字段名:答案类型(ans_type),数据类型:字符串 - 字段名:相似度(similarity),数据类型:64位浮点数(float64) 数据集划分: - 划分名称:训练集(train),占用字节数:45329,样本数量:58 下载总大小:19161 数据集总占用大小:45329 配置项: - 配置名称:默认配置(default),数据文件: - 对应划分:训练集(train),文件路径:data/train-*
提供机构:
arjun3103原始信息汇总
数据集概述
数据集特征
- questions:问题,数据类型为字符串。
- ground_truth_answers:标准答案,数据类型为字符串序列。
- response_answers:回答,数据类型为字符串。
- ans_type:答案类型,数据类型为字符串。
- similarity:相似度,数据类型为浮点数(float64)。
数据集分割
- train:训练集,包含58个样本,总大小为45329字节。
数据集大小
- 下载大小:19161字节。
- 数据集总大小:45329字节。
配置
- config_name:默认配置。
- data_files:
- split:train
- path:data/train-*



