bassie96code/train_wettekst
收藏资源简介:
--- dataset_info: features: - name: tok_wettekst sequence: string - name: aantal tokens dtype: int64 - name: label lijsten sequence: int64 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 32598 num_examples: 80 download_size: 10866 dataset_size: 32598 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "train_wettekst" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
dataset_info: 数据集信息: 特征字段: - 字段名: 分词文本(tok_wettekst),类型: 字符串序列 - 字段名: Token 数量(Token),数据类型: int64 - 字段名: 标签列表(label lijsten),类型: 整数序列 - 字段名: __index_level_0__,数据类型: int64 数据划分: - 划分名称: train(训练集),数据字节数: 32598,样本数量: 80 下载大小: 10866 数据集总大小: 32598 配置项: - 配置名称: default(默认),数据文件: - 对应划分: train(训练集),路径: data/train-* --- # 「train_wettekst」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
-
特征信息:
tok_wettekst: 字符串序列aantal tokens: 整数类型label lijsten: 整数序列__index_level_0__: 整数类型
-
数据分割:
train:- 字节数: 32598
- 样本数: 80
-
数据集大小:
- 下载大小: 10866 字节
- 实际大小: 32598 字节
配置信息
- 配置名称: default
- 数据文件:
train: 路径为data/train-*



