相关数据集
taresco/OPENAI-MMLU-FILTERED-MATH
该数据集包含三个配置:AR_XY、SW_KE和YO_NG,每个配置下都有测试集,每个测试集包含748个样本。数据集的特征包括问题的文本、四个选项的文本、正确答案的文本以及科目的文本。
Hugging Face2025-12-25 更新180
taresco/details_taresco__persona_math_verified_llama_3_8b_instruct
数据集是在评估模型 [taresco/persona_math_verified_llama_3_8b_instruct](https://huggingface.co/taresco/persona_math_verified_llama_3_8b_instruct) 时自动创建的。该数据集由7个配置组成,每个配置对应一个评估任务。数据集已从7次运行中创建。每个运行都可以在每个配置中找到,作为特
Hugging Face2025-05-12 更新120
taresco/niv2_submix_filtered
该数据集包含多个字符串类型的特征,包括inputs、targets、task_source、task_name和template_type。数据集主要包含一个训练集,该训练集的大小为8536484049.561275字节,包含5415268个示例。数据集的下载大小为4886727442字节,总数据集大小与训练集相同。数据集的配置文件指定了默认配置,其中数据文件路径指向训练集数据。
Hugging Face2024-10-15 更新120
taresco/details__home_oogundep_runs_llama3instruct_no_instruction_mask_10k
在模型_llama3instruct_no_instruction_mask_10k的评价运行期间自动创建的数据集,包含14个配置,每个配置对应一个评估任务。数据集由14次运行创建,每次运行在每个配置中都有一个特定的分割,使用运行的时戳命名。train分割始终指向最新的结果,还有一个额外的results配置用于存储所有运行聚合的结果。
Hugging Face2025-04-02 更新160
taresco/big_math_translated_african_languages
这是一个名为Big Math Translated - African Languages的数据集,包含41,000个从Big-Math-RL-Verified翻译而来的数学问题,涉及9种非洲语言(豪萨语、约鲁巴语、伊博语、索马里语、斯瓦希里语、南非荷兰语、阿拉伯语、祖鲁语)。数据集通过Azure/GPT-4o进行翻译,并经过随机采样和语言均衡处理。
Hugging Face2025-12-25 更新120



