遇见数据集

bassie96code/train_wettekst

收藏
Hugging Face2023-11-15 更新2024-03-04 收录
官方服务:

资源简介:

--- dataset_info: features: - name: tok_wettekst sequence: string - name: aantal tokens dtype: int64 - name: label lijsten sequence: int64 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 32598 num_examples: 80 download_size: 10866 dataset_size: 32598 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "train_wettekst" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

dataset_info: 数据集信息: 特征字段: - 字段名: 分词文本(tok_wettekst),类型: 字符串序列 - 字段名: Token 数量(Token),数据类型: int64 - 字段名: 标签列表(label lijsten),类型: 整数序列 - 字段名: __index_level_0__,数据类型: int64 数据划分: - 划分名称: train(训练集),数据字节数: 32598,样本数量: 80 下载大小: 10866 数据集总大小: 32598 配置项: - 配置名称: default(默认),数据文件: - 对应划分: train(训练集),路径: data/train-* --- # 「train_wettekst」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

提供机构:
bassie96code
原始信息汇总

数据集概述

数据集信息

  • 特征信息:

    • tok_wettekst: 字符串序列
    • aantal tokens: 整数类型
    • label lijsten: 整数序列
    • __index_level_0__: 整数类型
  • 数据分割:

    • train:
      • 字节数: 32598
      • 样本数: 80
  • 数据集大小:

    • 下载大小: 10866 字节
    • 实际大小: 32598 字节

配置信息

  • 配置名称: default
  • 数据文件:
    • train: 路径为 data/train-*
二维码
社区交流群
二维码
科研交流群
商业服务