相关数据集
MicPie/unpredictable_cluster15
UnpredicTable数据集由从互联网表格中提取的少样本任务组成,旨在通过微调语言模型来提高其在少样本学习中的表现。数据集包含多个版本和子集,涵盖了广泛的任务类型,如多项选择、问答、文本分类等。数据集的创建基于WDC Web Table Corpus,并通过自动化的方式将表格转换为少样本学习任务。
Hugging Face2022-08-04 更新190
rookshanks/toy_dataset_correcting
--- dataset_info: features: - name: question sequence: int64 - name: answer_prefix sequence: int64 - name: answer_continuation sequence: int64 splits: - name: train num_byt
Hugging Face2023-08-16 更新70
logits-dataset-mock
该数据集主要用于训练三个不同的模型,包含输入ID、注意力掩码和标签等特征。每个模型还有对应的top-k预测结果的logits和indices。数据集仅包含训练集,共有100个样本,总大小为511186800字节,下载大小为78724280字节。
Hugging Face2024-08-23 更新60
charan101/input_target_pairs_50_final
该数据集包含两个主要特征:input和target,均为字符串类型。数据集包含一个训练分割,大小为134742字节,包含353个示例。数据集的下载大小为73111字节,总大小为134742字节。默认配置文件指定了数据文件的路径为data/train-*。
Hugging Face2024-06-20 更新90
srbdtwentyfour/three_parts_cleaned
--- dataset_info: features: - name: id dtype: int64 - name: prompt dtype: string - name: response dtype: string - name: model dtype: string splits: - name: train num_
Hugging Face2024-06-09 更新60



