相关数据集
oda-99/wiki_tail_5_vowel_hira
该数据集包含多个特征字段,包括section(部分)、rhyme(韵律)和new_text(新文本),其中rhyme和new_text是字符串序列。数据集分为训练集和测试集,训练集包含1,853,385个样本,测试集包含205,932个样本。数据集的下载大小为218,102,166字节,总大小为389,239,324字节。数据文件的默认配置路径分别为训练集的data/train-*和测试集的dat
Hugging Face2024-11-17 更新180
shossain/merged-no-pad-16384
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 12260640
Hugging Face2023-11-06 更新70
srbdtwentyfour/three_parts_cleaned
--- dataset_info: features: - name: id dtype: int64 - name: prompt dtype: string - name: response dtype: string - name: model dtype: string splits: - name: train num_
Hugging Face2024-06-09 更新60
preference-agents-working/enron-top-senders
--- dataset_info: features: - name: message_id dtype: string - name: from dtype: string - name: to dtype: string - name: date dtype: string - name: subject dtype: strin
Hugging Face2024-04-26 更新170
rookshanks/toy_dataset_correcting
--- dataset_info: features: - name: question sequence: int64 - name: answer_prefix sequence: int64 - name: answer_continuation sequence: int64 splits: - name: train num_byt
Hugging Face2023-08-16 更新70



