登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Semantic source code labels
Semantic source code labels
收藏
Figshare
2022-12-07 更新
2026-04-28 收录
代码语义理解
软件工程标注
数据链接:
https://figshare.com/articles/dataset/Semantic_source_code_labels/21686273
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This is dataset of semantic source code labels.
应用场景:
创建时间:
2022-12-07
相关数据集
CodeT5SmallCAPS/CAPS_Java
代码语义理解
语言处理
--- configs: - config_name: default data_files: - split: train path: data/train-* dataset_info: features: - name: code dtype: string - name: code_sememe dtype: string - name: t
Hugging Face
2023-07-31 更新
10
0
Semantics_based_source_code_ labels.xlsx
代码语义理解
源代码分类
This is the dataset of semantic labels from all labelled notebooks.
NIAID Data Ecosystem
7
0
Code4ML 2.0
机器学习代码生成
代码语义理解
This is an enriched version of the Code4ML dataset, a large-scale corpus of annotated Python code snippets, competition summaries, and data descriptions sourced from Kaggle. The initial release includ
Zenodo
2025-05-19 更新
4
0
AxiomicLabs/NPset-2-Python-Edu
代码语义理解
逻辑推理训练
NPset-2 (Python-Edu) 是一个标准化的半合成Python数据集,用于训练小语言模型在代码逻辑上,而无需处理原始代码语法的开销。它通过基于AST的转换器将Python源代码规范化,去除语法噪声,同时保留程序的完整逻辑结构,生成完全由自然语言标记组成的伪代码表示,使模型能够专注于代码的功能而非形式。
Hugging Face
2026-05-07 更新
8
0
mopsa-dataset-debug
程序静态分析
代码语义理解
Mopsa数据集是一个统一的、包含静态分析跟踪、具体执行跟踪以及生成的自然语言跟踪的数据集。数据集的核心是源代码及其对应的多层次语义表示。每个数据样本包含原始源代码、经过清理的Mopsa静态分析跟踪、用于对齐跟踪的代码片段,以及将静态注释与这些代码片段对齐后的结果。此外,数据集还提供了具体的执行跟踪(包括原始和投影后的状态),以及将这些执行状态与代码片段对齐的结果。数据集记录了样本的来源数据集名称
Hugging Face
2026-05-12 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广