yzhuang/autotree_automl_default-of-credit-card-clients_gosdt_l512_d3_sd2
收藏资源简介:
--- dataset_info: features: - name: id dtype: int64 - name: input_x sequence: sequence: float64 - name: input_y sequence: sequence: float32 - name: rtg sequence: float64 - name: status sequence: sequence: float32 - name: split_threshold sequence: sequence: float64 - name: split_dimension sequence: int64 splits: - name: train num_bytes: 10863200000 num_examples: 100000 - name: validation num_bytes: 1086320000 num_examples: 10000 download_size: 2039406876 dataset_size: 11949520000 --- # Dataset Card for "autotree_automl_default-of-credit-card-clients_gosdt_l512_d3_sd2" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征: - 字段名:id,数据类型:int64 - 字段名:input_x,为序列的序列,元素数据类型为float64 - 字段名:input_y,为序列的序列,元素数据类型为float32 - 字段名:rtg,为序列,元素数据类型为float64 - 字段名:status(状态),为序列的序列,元素数据类型为float32 - 字段名:split_threshold(分割阈值),为序列的序列,元素数据类型为float64 - 字段名:split_dimension(分割维度),为序列,元素数据类型为int64 划分集: - 名称:训练集(train),占用字节数:10863200000,样本总量:100000 - 名称:验证集(validation),占用字节数:1086320000,样本总量:10000 下载大小:2039406876 数据集总大小:11949520000 # "autotree_automl_default-of-credit-card-clients_gosdt_l512_d3_sd2"数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
特征
- id: 数据类型为
int64 - input_x: 序列类型为
float64 - input_y: 序列类型为
float32 - rtg: 数据类型为
float64 - status: 序列类型为
float32 - split_threshold: 序列类型为
float64 - split_dimension: 数据类型为
int64
数据分割
- train: 包含 100,000 个样本,总字节数为 10,863,200,000
- validation: 包含 10,000 个样本,总字节数为 1,086,320,000
数据大小
- 下载大小: 2,039,406,876 字节
- 数据集大小: 11,949,520,000 字节



