stefanocarrera/autophagycode_D_he_train-mercury_Qwen3-4B_strategy_trust_t1.1_g3_run2_metrics
收藏资源简介:
该数据集包含164个训练示例,专注于代码任务执行和质量度量分析。每个示例具有多个特征:task_id(任务标识符)、entry_point(入口点)、is_executable(是否可执行)、is_correct(是否正确)、tests_passed(通过的测试数)、tests_failed(失败的测试数)、test_run_time_ms(测试运行时间,但当前为null)、error_type(错误类型),以及代码复杂度指标如halstead_vocabulary(Halstead词汇量)、halstead_length(Halstead长度)、halstead_volume(Halstead体积)、halstead_difficulty(Halstead难度)、halstead_effort(Halstead工作量)、halstead_time(Halstead时间)、cyclomatic_complexity(圈复杂度)、maintainability_index(可维护性指数)、loc(代码行数)、sloc(源代码行数)、comment_percentage(注释百分比)、TTR(类型标记比)、token_dict(令牌字典)、shannon_entropy(香农熵)、mean_predictive_entropy(平均预测熵)、max_predictive_entropy(最大预测熵)、n_func_defined(定义函数数)、entry_point_repeated(入口点是否重复)。数据集用于分析代码执行结果、测试性能和软件质量,适用于软件工程、代码评估或机器学习研究。
本数据集包含164条训练样本,聚焦于代码任务执行与质量度量分析。每条样本均涵盖多项特征:task_id(任务标识符)、entry_point(入口点)、is_executable(可执行性标识)、is_correct(正确性标识)、tests_passed(通过测试数)、tests_failed(失败测试数)、test_run_time_ms(测试运行时长,当前暂为空值)、error_type(错误类型),以及各类代码复杂度指标:halstead_vocabulary(哈尔斯特德词汇量,Halstead Vocabulary)、halstead_length(哈尔斯特德长度,Halstead Length)、halstead_volume(哈尔斯特德体积,Halstead Volume)、halstead_difficulty(哈尔斯特德难度,Halstead Difficulty)、halstead_effort(哈尔斯特德工作量,Halstead Effort)、halstead_time(哈尔斯特德耗时,Halstead Time)、cyclomatic_complexity(圈复杂度,Cyclomatic Complexity)、maintainability_index(可维护性指数,Maintainability Index)、loc(代码行数,Lines of Code, LOC)、sloc(源代码行数,Source Lines of Code, SLOC)、comment_percentage(注释占比)、TTR(类型标记比,Type-Token Ratio)、token_dict(令牌字典,Token Dictionary)、shannon_entropy(香农熵,Shannon Entropy)、mean_predictive_entropy(平均预测熵,Mean Predictive Entropy)、max_predictive_entropy(最大预测熵,Max Predictive Entropy)、n_func_defined(已定义函数数量)、entry_point_repeated(入口点重复标识)。本数据集可用于分析代码执行结果、测试性能与软件质量,适用于软件工程、代码评估或机器学习相关研究。




