遇见数据集

categories-benchmark-eval

收藏
huggingface.co2025-03-24 收录
官方服务:

资源简介:

lmarena-ai/categories-benchmark-eval dataset hosted on Hugging Face and contributed by the HF Datasets community

由 Hugging Face 平台托管,并由 HF 数据集社区贡献的 lmarena-ai 分类基准评估数据集。

提供机构:
huggingface.co
搜集汇总
数据集介绍
categories-benchmark-eval 数据集图片
背景与挑战
背景概述
该数据集是一个用于评估模型分类性能的基准数据集,包含候选模型的预测标签和基于多个大型模型投票生成的地面真值标签。数据集需要用户同意共享联系信息才能访问,总大小为393 MB,适用于模型比较和验证任务。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务