llama-lang-adapt/Translated-MNLI-1
收藏资源简介:
--- dataset_info: features: - name: label_text dtype: string - name: src_text1 dtype: string - name: src_text2 dtype: string - name: tgt_text1 dtype: string - name: tgt_text2 dtype: string - name: lang dtype: string splits: - name: train num_bytes: 13018660.0 num_examples: 32000 - name: validation num_bytes: 1627332.5 num_examples: 4000 - name: test num_bytes: 1627332.5 num_examples: 4000 download_size: 10059033 dataset_size: 16273325.0 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* ---
数据集信息: 特征字段: - 名称:标签文本(label_text),数据类型:字符串 - 名称:源文本1(src_text1),数据类型:字符串 - 名称:源文本2(src_text2),数据类型:字符串 - 名称:目标文本1(tgt_text1),数据类型:字符串 - 名称:目标文本2(tgt_text2),数据类型:字符串 - 名称:语言(lang),数据类型:字符串 数据集划分: - 划分名称:训练集(train),字节数:13018660.0,样本数量:32000 - 划分名称:验证集(validation),字节数:1627332.5,样本数量:4000 - 划分名称:测试集(test),字节数:1627332.5,样本数量:4000 下载大小:10059033 数据集总大小:16273325.0 配置项: - 配置名称:默认配置(default),数据文件: - 训练集划分:路径为 data/train-* - 验证集划分:路径为 data/validation-* - 测试集划分:路径为 data/test-*



