buddhist-nlp/sanskrit_classification2
收藏官方服务:
资源简介:
--- dataset_info: features: - name: sentences dtype: string - name: label dtype: string splits: - name: train num_bytes: 227616719 num_examples: 1528306 - name: validation num_bytes: 152710 num_examples: 1000 - name: test num_bytes: 149902 num_examples: 1000 download_size: 155584831 dataset_size: 227919331 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* ---
提供机构:
buddhist-nlp原始信息汇总
数据集概述
数据集特征
- sentences:数据类型为字符串。
- label:数据类型为字符串。
数据集分割
- 训练集:包含1528306个样本,总大小为227616719字节。
- 验证集:包含1000个样本,总大小为152710字节。
- 测试集:包含1000个样本,总大小为149902字节。
数据集大小
- 下载大小:155584831字节。
- 数据集总大小:227919331字节。
数据文件配置
- 默认配置:
- 训练集路径:
data/train-* - 验证集路径:
data/validation-* - 测试集路径:
data/test-*
- 训练集路径:



