Pav17/T3-gen-dataset
收藏官方服务:
资源简介:
--- dataset_info: features: - name: task_id dtype: int32 - name: text dtype: string - name: code dtype: string - name: test_list sequence: string - name: test_setup_code dtype: string - name: challenge_test_list sequence: string - name: input dtype: string splits: - name: train num_bytes: 377899 num_examples: 374 - name: test num_bytes: 519921 num_examples: 500 - name: validation num_bytes: 90750 num_examples: 90 - name: prompt num_bytes: 9760 num_examples: 10 download_size: 459451 dataset_size: 998330 configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* - split: validation path: data/validation-* - split: prompt path: data/prompt-* ---
提供机构:
Pav17原始信息汇总
数据集概述
数据集特征
- task_id: 数据类型为 int32。
- text: 数据类型为 string。
- code: 数据类型为 string。
- test_list: 数据类型为 sequence of string。
- test_setup_code: 数据类型为 string。
- challenge_test_list: 数据类型为 sequence of string。
- input: 数据类型为 string。
数据集分割
- train: 包含374个样本,占用377899字节。
- test: 包含500个样本,占用519921字节。
- validation: 包含90个样本,占用90750字节。
- prompt: 包含10个样本,占用9760字节。
数据集大小
- 下载大小: 459451字节。
- 数据集总大小: 998330字节。
数据文件配置
- config_name: default
- 数据文件路径:
- train: data/train-*
- test: data/test-*
- validation: data/validation-*
- prompt: data/prompt-*



