相关数据集
open-llm-leaderboard-old/details_AIDC-ai-business__Marcoroni-70B
该数据集是在Open LLM Leaderboard上对模型AIDC-ai-business/Marcoroni-70B进行评估时自动创建的。数据集由61个配置组成,每个配置对应一个评估任务。数据集由4次运行生成,每次运行的结果作为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置存储了所有运行的聚合结果,用于在Open LLM
Hugging Face2023-09-19 更新160
AbderrahmanSkiredj1/ahadith_translation_34k
该数据集包含三个特征:文本(text)、标签(label)和提示(prompt),数据类型均为字符串。数据集包含一个训练集(train),大小为56339232字节,包含34088个样本。下载大小为19500537字节,数据集总大小为56339232字节。数据集的任务类别为翻译(translation),语言为阿拉伯语(ar)。
Hugging Face2024-07-15 更新60
owm-cog-behaviors
该数据集包含对话信息,每个对话信息包括内容和角色两个子特征,还有一个后缀特征。数据集分为训练集和测试集,训练集包含26910个示例,测试集包含1417个示例。
Hugging Face2025-04-05 更新30
Wikipedia Talk Corpus
We provide a corpus of discussion comments from English Wikipedia talk pages. Comments are grouped into different files by year. Comments are generated by computing diffs over the full revision histor
figshare.com2017-01-23 更新70
artfultom/dataset_from_groq
俄罗斯语拼写校正数据集,包含1200对俄语句子,其中每对句子包含一个错误版本(input)和一个正确版本(target)。这些句子通常是由电影名称或演员名字组成的。该数据集适用于拼写和语法错误修正、语音识别后处理以及文本自动校正模型的训练。
Hugging Face2025-10-12 更新40



