登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Music Learning Performance Dataset
Music Learning Performance Dataset
收藏
kaggle
2025-09-23 更新
2025-10-25 收录
音乐教育
人工智能评估
数据链接:
https://www.kaggle.com/datasets/zyan1999/music-learning-performance-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Learner Metrics and Progress for AI Assessment
面向人工智能测评的学习者指标与学习进度
应用场景:
创建时间:
2025-09-23
相关数据集
OmniEarth-Bench
地球系统科学
人工智能评估
OmniEarth-Bench是第一个全面覆盖地球科学六大圈层(大气圈、岩石圈、海洋圈、冰冻圈、生物圈和人类活动圈)及跨圈层交互的多模态基准数据集,包含一百个专家策划的评价维度。数据集利用卫星传感器和现场测量的观测数据,整合了29,779个标注,涵盖四个层次:感知、一般推理、科学知识推理和思维链(CoT)推理。
github
2025-05-30 更新
51
0
CosmoPaperQA
宇宙学
人工智能评估
CosmoPaperQA是一个专为测试AI RAG(检索增强生成)在宇宙学研究应用中表现而设计的数据集。该数据集还包括一个名为Embed_AI的概念验证自动AI评估算法。
github
2025-05-10 更新
37
0
ControlBench
控制工程
人工智能评估
ControlBench是由伊利诺伊大学厄巴纳-香槟分校等机构创建的数据集,包含147个本科控制工程问题,旨在评估大型语言模型如GPT-4、Claude 3 Opus和Gemini 1.0 Ultra在解决控制工程问题上的能力。该数据集涵盖了控制设计的广度、深度和复杂性,包括系统动力学、PID/loopshaping设计及稳定性/鲁棒性分析等。数据集的创建过程经过精心设计,确保每个问题都经过人工验
arXiv
2024-04-05 更新
22
0
R2-AVSBench
自然语言处理
人工智能评估
R2-AVSBench是一个新的评估基准,设计用于包含更多具有语言多样性和推理密集性的参考。它旨在更好地评估模型在跨引用场景中的性能。该数据集由 Mohamed Bin Zayed University of Artificial Intelligence, National University of Singapore, University of Science and Technology
arXiv
2025-08-06 更新
40
0
WITNESS’ Truly Innovative and Effective AI Detection (TRIED) Benchmark
人工智能评估
检测工具评估
WITNESS开发的“真正创新和有效的人工智能检测”(TRIED)基准是一个新的框架,用于评估检测工具的真正影响和创新能力。该数据集基于一线经验、欺骗性AI案例和全球咨询,旨在解决AI检测工具在现实世界场景中的局限性,如可解释性、公平性、可访问性和上下文相关性等方面的挑战。通过采用TRIED基准,利益相关者可以推动创新,保护公众信任,加强人工智能素养,并为更强大的全球信息可信度做出贡献。
arXiv
2025-04-30 更新
25
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广