yzhuang/autotree_automl_100000_Diabetes130US_sgosdt_l256_dim7_d3_sd0
收藏资源简介:
--- dataset_info: features: - name: id dtype: int64 - name: input_x sequence: sequence: float32 - name: input_y sequence: sequence: float32 - name: input_y_clean sequence: sequence: float32 - name: rtg sequence: float64 - name: status sequence: sequence: float32 - name: split_threshold sequence: sequence: float32 - name: split_dimension sequence: int64 splits: - name: train num_bytes: 2057200000 num_examples: 100000 - name: validation num_bytes: 205720000 num_examples: 10000 download_size: 257403365 dataset_size: 2262920000 --- # Dataset Card for "autotree_automl_100000_Diabetes130US_sgosdt_l256_dim7_d3_sd0" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征: - 名称:id,数据类型:int64 - 名称:input_x,类型:二维float32序列(即序列的序列,元素为float32类型) - 名称:input_y,类型:二维float32序列(即序列的序列,元素为float32类型) - 名称:input_y_clean,类型:二维float32序列(即序列的序列,元素为float32类型) - 名称:rtg,数据类型:float64 - 名称:status,类型:二维float32序列(即序列的序列,元素为float32类型) - 名称:split_threshold,类型:二维float32序列(即序列的序列,元素为float32类型) - 名称:split_dimension,数据类型:int64 数据集划分: - 划分集名称:train,占用字节数:2057200000,样本数量:100000 - 划分集名称:validation,占用字节数:205720000,样本数量:10000 下载大小:257403365 数据集总大小:2262920000 # 数据集卡片 "autotree_automl_100000_Diabetes130US_sgosdt_l256_dim7_d3_sd0" 需补充更多信息(详见:https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
-
特征列表:
id: 类型为int64input_x: 序列类型为float32input_y: 序列类型为float32input_y_clean: 序列类型为float32rtg: 序列类型为float64status: 序列类型为float32split_threshold: 序列类型为float32split_dimension: 类型为int64
-
数据分割:
train: 字节数为 2057200000,样本数为 100000validation: 字节数为 205720000,样本数为 10000
-
数据集大小:
- 下载大小:257403365 字节
- 数据集大小:2262920000 字节




