bigheiniuJ/JimmyLuAugSeedAug13
收藏资源简介:
--- dataset_info: features: - name: output dtype: string - name: input dtype: string - name: split dtype: string - name: task dtype: string - name: options sequence: string - name: aug_id dtype: string - name: aug_type dtype: string - name: aug_time dtype: int64 - name: id dtype: int64 - name: seed dtype: string splits: - name: train num_bytes: 2024656 num_examples: 6158 download_size: 657722 dataset_size: 2024656 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 名称:输出(output),数据类型:字符串 - 名称:输入(input),数据类型:字符串 - 名称:数据集划分(split),数据类型:字符串 - 名称:任务(task),数据类型:字符串 - 名称:选项(options),数据类型:字符串序列 - 名称:数据增强ID(aug_id),数据类型:字符串 - 名称:数据增强类型(aug_type),数据类型:字符串 - 名称:数据增强时长(aug_time),数据类型:int64 - 名称:样本ID(id),数据类型:int64 - 名称:随机种子(seed),数据类型:字符串 数据集划分: - 名称:训练集(train),字节占用:2024656,样本数量:6158 下载大小:657722 数据集总大小:2024656 配置项: - 配置名称:default,数据文件: - 划分集:训练集(train),路径:data/train-*
数据集概述
数据特征
- output: 数据类型为字符串。
- input: 数据类型为字符串。
- split: 数据类型为字符串。
- task: 数据类型为字符串。
- options: 序列类型为字符串。
- aug_id: 数据类型为字符串。
- aug_type: 数据类型为字符串。
- aug_time: 数据类型为整数(int64)。
- id: 数据类型为整数(int64)。
- seed: 数据类型为字符串。
数据分割
- train: 包含6158个样本,占用2024656字节。
数据集大小
- 下载大小: 657722字节。
- 数据集大小: 2024656字节。
配置
- default: 包含训练数据文件,路径为
data/train-*。



