遇见数据集

sepz/triviaqa_ft

收藏
Hugging Face2024-08-29 更新2024-12-14 收录
官方服务:

资源简介:

该数据集包含从KILT项目的triviaqa数据集中随机划分的训练集、开发集和测试集,比例为0.7/0.1/0.2,用于基准测试嵌入模型的微调。

The dataset contains a random 0.7/0.1/0.2 train/dev/test splits of triviaqa dataset from KILT for benchmarking embedding model fine-tuning.

提供机构:
sepz
搜集汇总
数据集介绍
sepz/triviaqa_ft 数据集图片
背景与挑战
背景概述
该数据集是基于TriviaQA的微调版本,用于嵌入模型基准测试,包含约2300万行文本数据,涵盖事实性问答内容。数据集采用Parquet格式,分为训练、开发和测试集,适用于自然语言处理任务中的模型训练和评估。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务