gigant/tib_dependency_graphs
收藏资源简介:
--- dataset_info: features: - name: id dtype: int64 - name: receivers sequence: uint16 - name: senders sequence: uint16 - name: graph_mask sequence: bool splits: - name: train num_bytes: 1896216603 num_examples: 7251 - name: valid num_bytes: 235053230 num_examples: 904 - name: test num_bytes: 238694116 num_examples: 910 download_size: 2118206109 dataset_size: 2369963949 configs: - config_name: default data_files: - split: train path: data/train-* - split: valid path: data/valid-* - split: test path: data/test-* ---
数据集信息: 特征项: - 名称:id,数据类型:int64 - 名称:接收者(receivers),数据类型:uint16 序列 - 名称:发送者(senders),数据类型:uint16 序列 - 名称:图掩码(graph_mask),数据类型:bool 序列 数据集划分: - 划分名称:train(训练集),字节大小:1896216603,样本数量:7251 - 划分名称:valid(验证集),字节大小:235053230,样本数量:904 - 划分名称:test(测试集),字节大小:238694116,样本数量:910 下载大小:2118206109 数据集总大小:2369963949 配置项: - 配置名称:default(默认配置),数据文件: - 训练集拆分对应路径:data/train-* - 验证集拆分对应路径:data/valid-* - 测试集拆分对应路径:data/test-*
数据集概述
特征信息
- id: 数据类型为
int64 - receivers: 数据类型为
uint16的序列 - senders: 数据类型为
uint16的序列 - graph_mask: 数据类型为
bool的序列
数据分割
- train: 包含 7251 个样本,总字节数为 1896216603
- valid: 包含 904 个样本,总字节数为 235053230
- test: 包含 910 个样本,总字节数为 238694116
数据集大小
- 下载大小: 2118206109 字节
- 数据集大小: 2369963949 字节
配置信息
- default 配置包含以下数据文件路径:
- train:
data/train-* - valid:
data/valid-* - test:
data/test-*
- train:



