相关数据集
oda-99/wiki_tail_5_vowel_hira
该数据集包含多个特征字段,包括section(部分)、rhyme(韵律)和new_text(新文本),其中rhyme和new_text是字符串序列。数据集分为训练集和测试集,训练集包含1,853,385个样本,测试集包含205,932个样本。数据集的下载大小为218,102,166字节,总大小为389,239,324字节。数据文件的默认配置路径分别为训练集的data/train-*和测试集的dat
Hugging Face2024-11-17 更新180
rookshanks/toy_dataset_correcting
--- dataset_info: features: - name: question sequence: int64 - name: answer_prefix sequence: int64 - name: answer_continuation sequence: int64 splits: - name: train num_byt
Hugging Face2023-08-16 更新70
logits-dataset-mock
该数据集主要用于训练三个不同的模型,包含输入ID、注意力掩码和标签等特征。每个模型还有对应的top-k预测结果的logits和indices。数据集仅包含训练集,共有100个样本,总大小为511186800字节,下载大小为78724280字节。
Hugging Face2024-08-23 更新60
preference-agents-working/enron-top-senders
--- dataset_info: features: - name: message_id dtype: string - name: from dtype: string - name: to dtype: string - name: date dtype: string - name: subject dtype: strin
Hugging Face2024-04-26 更新170
srbdtwentyfour/three_parts_cleaned
--- dataset_info: features: - name: id dtype: int64 - name: prompt dtype: string - name: response dtype: string - name: model dtype: string splits: - name: train num_
Hugging Face2024-06-09 更新60



