Lollitor/MarkedDataset
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: ID dtype: string - name: LABEL dtype: float64 - name: INPUT dtype: string - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 5541840 num_examples: 7638 - name: validation num_bytes: 611074 num_examples: 849 download_size: 3257011 dataset_size: 6152914 --- # Dataset Card for "MarkedDataset" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称:default 数据文件: - 划分集:训练集,路径:data/train-* - 划分集:验证集,路径:data/validation-* 数据集信息: 特征字段: - 名称:ID,数据类型:字符串(string) - 名称:LABEL,数据类型:双精度浮点型(float64) - 名称:INPUT,数据类型:字符串(string) - 名称:__index_level_0__,数据类型:64位整型(int64) 划分集详情: - 名称:训练集,字节数:5541840,样本数量:7638 - 名称:验证集,字节数:611074,样本数量:849 下载大小:3257011 数据集总大小:6152914 # 「标记数据集(MarkedDataset)」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
MarkedDataset 数据集概述
数据集配置
- 默认配置 (
default)- 数据文件路径:
- 训练集 (
train):data/train-* - 验证集 (
validation):data/validation-*
- 训练集 (
- 数据文件路径:
数据集信息
-
特征字段:
ID: 类型为stringLABEL: 类型为float64INPUT: 类型为string__index_level_0__: 类型为int64
-
数据分割:
- 训练集 (
train):- 字节数: 5541840
- 样本数: 7638
- 验证集 (
validation):- 字节数: 611074
- 样本数: 849
- 训练集 (
-
数据集大小:
- 下载大小: 3257011 字节
- 数据集大小: 6152914 字节



