sepz/triviaqa_ft
收藏官方服务:
资源简介:
该数据集包含从KILT项目的triviaqa数据集中随机划分的训练集、开发集和测试集,比例为0.7/0.1/0.2,用于基准测试嵌入模型的微调。
The dataset contains a random 0.7/0.1/0.2 train/dev/test splits of triviaqa dataset from KILT for benchmarking embedding model fine-tuning.
提供机构:
sepz搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集是基于TriviaQA的微调版本,用于嵌入模型基准测试,包含约2300万行文本数据,涵盖事实性问答内容。数据集采用Parquet格式,分为训练、开发和测试集,适用于自然语言处理任务中的模型训练和评估。
以上内容由遇见数据集搜集并总结生成



