相关数据集
open-llm-leaderboard-old/details_AIDC-ai-business__Marcoroni-70B
该数据集是在Open LLM Leaderboard上对模型AIDC-ai-business/Marcoroni-70B进行评估时自动创建的。数据集由61个配置组成,每个配置对应一个评估任务。数据集由4次运行生成,每次运行的结果作为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置存储了所有运行的聚合结果,用于在Open LLM
Hugging Face2023-09-19 更新160
Wikipedia Talk Corpus
We provide a corpus of discussion comments from English Wikipedia talk pages. Comments are grouped into different files by year. Comments are generated by computing diffs over the full revision histor
figshare.com2017-01-23 更新70
kevykibbz/Consumer_goods_reviews
亚马逊产品评论数据集(2023)包含来自亚马逊客户的商品评论。该数据集包括产品信息、评论详情以及留下评论的客户的相关元数据。这个数据集可以用于各种自然语言处理(NLP)任务,包括情感分析、评论预测、推荐系统等。每个评论条目包括评审者ID、产品ID、评论文本、总体评分、评论摘要、评论时间、有帮助的投票数、产品类别、产品品牌和评论时的产品价格。
Hugging Face2025-02-06 更新40
CharToM-QA
CharToM-QA是一个包含1035个基于经典小说角色的理论心灵(ToM)问题的数据集,用于评估模型在故事情节背景下的ToM相关问题回答能力。数据集涵盖了信念、意图、情感和欲望四个维度,并支持生成式问题和多项选择题两种QA实验形式。
Hugging Face2025-04-07 更新130
AbderrahmanSkiredj1/ahadith_translation_34k
该数据集包含三个特征:文本(text)、标签(label)和提示(prompt),数据类型均为字符串。数据集包含一个训练集(train),大小为56339232字节,包含34088个样本。下载大小为19500537字节,数据集总大小为56339232字节。数据集的任务类别为翻译(translation),语言为阿拉伯语(ar)。
Hugging Face2024-07-15 更新60



