相关数据集
oda-99/wiki_tail_5_vowel_hira
该数据集包含多个特征字段,包括section(部分)、rhyme(韵律)和new_text(新文本),其中rhyme和new_text是字符串序列。数据集分为训练集和测试集,训练集包含1,853,385个样本,测试集包含205,932个样本。数据集的下载大小为218,102,166字节,总大小为389,239,324字节。数据文件的默认配置路径分别为训练集的data/train-*和测试集的dat
Hugging Face2024-11-17 更新180
marcelomoreno26/leniachat-qwen2-1.5B-v0-AQuAS
该数据集包含三个字段:参考回复(reference)、实际回复(answer)和上下文(context),均为文本格式。数据集目前只有训练集部分,包含107个示例,文件大小为537370字节。数据集的下载大小为149134字节。未提供详细的数据集用途或背景信息。
Hugging Face2025-02-10 更新120
rookshanks/toy_dataset_correcting
--- dataset_info: features: - name: question sequence: int64 - name: answer_prefix sequence: int64 - name: answer_continuation sequence: int64 splits: - name: train num_byt
Hugging Face2023-08-16 更新70
preference-agents-working/enron-top-senders
--- dataset_info: features: - name: message_id dtype: string - name: from dtype: string - name: to dtype: string - name: date dtype: string - name: subject dtype: strin
Hugging Face2024-04-26 更新170
shossain/merged-no-pad-16384
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 12260640
Hugging Face2023-11-06 更新70



