smita1988/english-hindi-translation-dataset1
收藏官方服务:
资源简介:
该数据集包含三个特征字段:input_ids,attention_mask和labels。数据集分为训练集、验证集和测试集,其中训练集包含1659083个示例,验证集包含520个示例,测试集包含2507个示例。整个数据集大小为1.4GB。
The dataset includes three feature fields: input_ids, attention_mask, and labels. It is split into a training set with 1,659,083 examples, a validation set with 520 examples, and a test set with 2,507 examples. The entire dataset is 1.4GB in size.
提供机构:
smita1988


