judy93536/perigon-150k
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 146640869.6 num_examples: 120000 - name: test num_bytes: 36660217.4 num_examples: 30000 download_size: 92971443 dataset_size: 183301087.0 --- # Dataset Card for "perigon-150k" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称:default 数据文件: - 拆分集:训练集(train),路径:data/train-* - 拆分集:测试集(test),路径:data/test-* 数据集信息: 特征: - 名称:text,数据类型:字符串(string) - 名称:label,数据类型:int64 拆分集: - 名称:训练集(train),字节数:146640869.6,样本数量:120000 - 名称:测试集(test),字节数:36660217.4,样本数量:30000 下载大小:92971443 数据集总大小:183301087.0 --- # 「perigon-150k」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置
- 默认配置 (
default)- 数据文件路径:
- 训练集 (
train):data/train-* - 测试集 (
test):data/test-*
- 训练集 (
- 数据文件路径:
数据集信息
- 特征:
text: 数据类型为stringlabel: 数据类型为int64
- 数据分割:
- 训练集 (
train):- 字节数: 146640869.6
- 样本数: 120000
- 测试集 (
test):- 字节数: 36660217.4
- 样本数: 30000
- 训练集 (
- 下载大小: 92971443
- 数据集大小: 183301087.0



