遇见数据集

aholovko/pep8_e111_compliance_large

收藏
Hugging Face2024-07-09 更新2024-07-22 收录
官方服务:

资源简介:

该数据集包含两个主要特征:code和label。label是一个分类标签,包含两个类别:non-compliant(不符合)和compliant(符合)。数据集分为训练集和验证集,训练集包含4800个样本,验证集包含1200个样本。数据集的总下载大小为752640字节,总数据集大小为1451398字节。

This dataset is primarily used for classification tasks, containing code and corresponding compliance labels. The dataset is divided into a training set and a validation set, which are used for model training and performance evaluation, respectively.

提供机构:
aholovko
原始信息汇总

数据集概述

数据集特征

  • code: 数据类型为字符串。
  • label: 数据类型为分类标签,包含两个类别:
    • 0: non-compliant
    • 1: compliant

数据集划分

  • train:
    • 字节数: 1157817
    • 样本数: 4800
  • validation:
    • 字节数: 293581
    • 样本数: 1200

数据集大小

  • 下载大小: 752640 字节
  • 数据集总大小: 1451398 字节

配置信息

  • config_name: default
    • data_files:
      • train: data/train-*
      • validation: data/validation-*
二维码
社区交流群
二维码
科研交流群
商业服务