franlucc/py_all_renames_may3_seed-0-1_starcoderbase-1b_typechecked
收藏资源简介:
--- dataset_info: features: - name: mutated_program dtype: string - name: mutations sequence: string - name: key dtype: string - name: prefix dtype: string - name: suffix dtype: string - name: middle dtype: string - name: correct dtype: bool - name: model dtype: string - name: fim_type dtype: string - name: fim_program dtype: string - name: hexsha dtype: string - name: mutated_generated_text dtype: string splits: - name: train num_bytes: 82802038 num_examples: 9386 download_size: 33530682 dataset_size: 82802038 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "py_all_renames_may3_seed-0-1_starcoderbase-1b_typechecked" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
- 名称: py_all_renames_may3_seed-0-1_starcoderbase-1b_typechecked
数据集特征
- mutated_program: 数据类型为字符串
- mutations: 数据类型为字符串序列
- key: 数据类型为字符串
- prefix: 数据类型为字符串
- suffix: 数据类型为字符串
- middle: 数据类型为字符串
- correct: 数据类型为布尔值
- model: 数据类型为字符串
- fim_type: 数据类型为字符串
- fim_program: 数据类型为字符串
- hexsha: 数据类型为字符串
- mutated_generated_text: 数据类型为字符串
数据集拆分
- 拆分名称: train
- 数据大小: 82802038字节
- 示例数量: 9386
数据集大小
- 下载大小: 33530682字节
- 数据集总大小: 82802038字节
配置信息
- 配置名称: default
- 数据文件路径: data/train-*



