官方服务:
资源简介:
open-sourse syntetyc coding dataset
开源合成代码数据集
应用场景:
创建时间:
2026-07-29
相关数据集
Fsoft-AIC/RepoExec
RepoExec是一个新颖的基准,旨在通过强调可执行性和正确性来评估仓库级别的代码生成。该基准通过关注现实世界的适用性,并提供代码功能的全面评估,填补了现有系统的空白。它旨在为代码功能和与开发者意图的一致性提供全面的评估,为现实场景中更可靠和适用的CodeLLMs铺平道路。
Hugging Face2024-06-23 更新330
mj33/SimCoPilot
SimCoPilot是一个用于评估大型语言模型(LLMs)作为交互式编码助手能力的基准测试。它测试LLMs在复杂现实世界软件环境中添加和完成代码的能力,并分析LLMs如何管理不同的代码依赖和逻辑复杂性。数据集包含Python和Java代码,主要用于程序合成、基准测试和研究新编码工具的开发。数据集结构包括11个字段,详细描述了代码任务的类型、代码段的位置、代码的前后内容以及逻辑组件的使用情况。数据集
Hugging Face2024-06-13 更新150
mytestdpo/qwmathbase_raw_raft_step40_minerva_math
该数据集包含问题的索引、问题文本、预期输出(gt_cot和gt)、问题类型、解决方案文本、代码序列、预测结果、评估报告以及一个布尔分数字段。数据集被划分为训练集,包含272个示例,数据集大小为4370163字节。从字段和配置来看,这个数据集可能是用于编程问题解决或代码生成的任务。
Hugging Face2025-03-19 更新90
verifiers-for-code/gold_tester_llama
该数据集包含多个与任务相关的字段,包括任务ID、提示、规范解决方案、测试、入口点等。此外,还包含了多个与Sonnet和Phi-3模型相关的生成和清理后的计划字段。数据集仅包含一个测试分割,包含164个示例,总大小为2520009字节。
Hugging Face2024-07-03 更新180
formermagic/github_python_1m
--- annotations_creators: - found language_creators: - found language: - py license: - mit multilinguality: - monolingual size_categories: - 100K<n<1M source_datasets: - original task_categories: - se
Hugging Face2022-10-21 更新100



