stefanocarrera/autophagycode_D_he_train-mercury_Qwen3-4B_strategy_trust_t1.25_g2_run2_metrics
收藏资源简介:
该数据集包含164个训练样本,每个样本具有代码质量相关的特征,包括任务ID、入口点、可执行性、正确性、测试通过/失败数量、运行时间、错误类型、Halstead复杂度指标(词汇量、长度、体积、难度、工作量、时间)、圈复杂度、可维护性指数、代码行数、有效代码行数、注释百分比、类型令牌比、令牌字典、香农熵、预测熵等。适用于代码质量分析、复杂性度量、可维护性评估等研究。
This dataset contains 164 training samples, each with code quality-related features including task ID, entry point, executability, correctness, number of tests passed/failed, runtime, error type, Halstead complexity metrics (vocabulary, length, volume, difficulty, effort, time), cyclomatic complexity, maintainability index, lines of code, source lines of code, comment percentage, type-token ratio, token dictionary, Shannon entropy, predictive entropy, etc. It is suitable for research on code quality analysis, complexity measurement, maintainability assessment, etc.




