登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Vincentvmt/CrossCodeEval
Vincentvmt/CrossCodeEval
收藏
Hugging Face
2024-01-26 更新
2024-03-04 收录
跨语言代码生成评估
代码生成基准测试
数据链接:
https://hf-mirror.com/datasets/Vincentvmt/CrossCodeEval
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
许可证:Apache 2.0
应用场景:
提供机构:
Vincentvmt
原始信息汇总
数据集许可证
许可证类型:Apache 2.0
相关数据集
eee_test
大型语言模型评估
代码生成基准测试
该数据集包含多个字符串类型的特征字段,如排行榜信息、开发者信息、模型信息等。数据集分为两个部分:hfopenllmv2和livecodebenchpro,每个部分包含不同数量的示例和字节数。数据集总大小为8997579字节,下载大小为1350403字节。
Hugging Face
2025-11-27 更新
12
0
LoneResearch/TinyLiveCodeBench
编程评估
代码生成基准测试
--- dataset_info: config_name: v4_v5 features: - name: question_id dtype: string - name: full_prompt dtype: string - name: question_title dtype: string - name: platform dty
Hugging Face
2026-03-25 更新
11
0
ShahzebKhoso/local-code-arena-starcoder2_3b
代码生成基准测试
语言模型性能
该仓库存储了针对下一代StarCoder2 3B基础基础模型运行大多数基本Python问题(MBPP)基准测试所捕获的原始评估指标、执行遥测日志和结构语法输出。此特定分区记录了现代原始基础权重在自动对话管道内的行为动态,突显了指令对齐层的持续必要性。
Hugging Face
2026-05-28 更新
5
0
bigcode/bigcodebench-results
代码生成模型评估
代码生成基准测试
BigCodeBench数据集包含多个特征,如模型名称、链接、是否为混合专家模型、模型大小、激活参数、类型、是否懒惰加载、完成度、指令遵循度和ELO MLE评分。数据集分为一个训练集,包含100个样本,总大小为12780字节。
Hugging Face
2024-07-21 更新
12
0
math-extraction-comp/SenseLLM__ReflectionCoder-DS-33B
语言模型评估
代码生成基准测试
该数据集是一个文本数据集,包含问题、参考答案、预测答案、不同评分系统的答案抽取结果和得分等信息。数据集包含一个训练集部分,提供了具体的字节数和示例数量。
Hugging Face
2025-01-26 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广