hf-coding-tools-dashboard-v2
收藏资源简介:
HuggingFace AI Coding Tools Dashboard(增强版)是一个用于评估AI编程工具的增强基准数据集。该数据集包含四个主要部分:results(增强结果,包含查询/运行元数据和新鲜度标志)、queries(基准查询定义,包含query_set和intent列)、runs(运行元数据和工具/模型配置)以及products(HuggingFace产品目录,包含检测关键词)。数据集规模在1K到10K之间,支持英语和代码语言。增强的results部分新增了query_set(v1或v2)、intent(构建、修复、集成、优化、发现)、run_name(可读运行名称)、run_date(运行开始时间)和freshness_flag(标记过时的引用)等字段。该数据集适用于文本生成任务,特别是AI编程工具的性能评估和意图分析。
HuggingFace AI Coding Tools Dashboard (Enhanced) is an enhanced benchmark dataset for evaluating AI coding tools. The dataset consists of four main parts: results (enhanced results, including query/run metadata and freshness flags), queries (benchmark query definitions, including query_set and intent columns), runs (run metadata and tool/model configurations), and products (HuggingFace product catalog, including detection keywords). The dataset size ranges from 1K to 10K, supporting English and code languages. The enhanced results section includes new fields such as query_set (v1 or v2), intent (build, fix, integrate, optimize, discover), run_name (human-readable run name), run_date (run start time), and freshness_flag (flagging outdated references). This dataset is suitable for text generation tasks, particularly for performance evaluation and intent analysis of AI programming tools.
数据集概述
基本信息
- 数据集名称:HuggingFace AI Coding Tools Dashboard (Enhanced)
- 许可证:CC-BY-4.0
- 语言:英文、代码
- 任务类别:文本生成
- 标签:benchmark、ai-coding-tools、huggingface、v2
- 数据规模:1,000 < 样本数 < 10,000
数据集描述
该数据集是 HuggingFace AI Dashboard 的增强版基准测试数据,包含查询元数据(query_set、intent)、运行元数据(run_name、run_date)以及用于标记过时引用的新鲜度标志(freshness_flag)。本数据集为 v2 增强版本,原始数据集为 davidkling/hf-coding-tools-dashboard。
数据结构
数据集包含四个配置(config),每个配置对应一个数据文件:
| 配置名 | 描述 | 行数 |
|---|---|---|
results |
增强的结果数据,包含查询/运行元数据和新鲜度标志 | 1,999 |
queries |
基准查询定义,包含 query_set 和 intent 列 | 404 |
runs |
运行元数据和工具/模型配置 | 2 |
products |
HuggingFace 产品目录及检测关键词 | 44 |
增强字段(results)
在基础数据集字段之上新增以下字段:
- query_set:使用的查询集(
v1或v2) - intent:查询意图分类(
build、fix、integrate、optimize、discover) - run_name:可读的运行名称
- run_date:运行开始时间
- freshness_flag:
ok或stale_reference——标记引用了已弃用模型/资源的响应
查询集
- v1:原始 32 类查询集,涵盖通用 AI 编码工具使用场景
- v2:扩展查询集,包含带有意图标签的查询,用于更深层次分析
意图分类
| 意图 | 描述 |
|---|---|
build |
从零开始构建新内容 |
fix |
调试或修复问题 |
integrate |
连接工具/服务 |
optimize |
提升性能或效率 |
discover |
探索选项和学习 |
数据加载示例
Python 加载数据集: python from datasets import load_dataset results = load_dataset("davidkling/hf-coding-tools-dashboard-v2", "results", split="train") build_results = results.filter(lambda x: x["intent"] == "build")
Pandas 读取 Parquet 文件: python import pandas as pd df = pd.read_parquet("hf://datasets/davidkling/hf-coding-tools-dashboard-v2/data/results-00000-of-00001.parquet") print(df.groupby(["tool", "freshness_flag"]).size().unstack(fill_value=0))




