相关数据集
LangAGI-Lab/WebRewardBench
该数据集包含了用户的交互信息,如意图、浏览历史、动作历史等,以及相关的URL和文本信息。数据集还包含了图片列表和用户对某些项的选择与拒绝信息。每个样本都有唯一的任务ID、步骤ID和注释ID,以及标识数据来源的来源名称。测试集包含了776个示例,数据集大小为524,885,616字节。
Hugging Face2025-05-22 更新150
LangAGI-Lab/code-dpo-classification
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: eval path: data/eval-* dataset_info: features: - name: description dtype: string - na
Hugging Face2023-11-05 更新110
LangAGI-Lab/limo-summary
该数据集包含了问题、解决方案、答案等字段,适用于文本处理相关的任务。数据集分为训练集,其中包含了817个示例,总大小约为18MB。每个示例包含了问题、答案和相关上下文信息,以及用于模型训练的其他特征,如API响应、指令和摘要等。
Hugging Face2025-02-13 更新90
LangAGI-Lab/train-rl-o1-mini-annotated-math-numina-22k
该数据集使用MIT许可,包含英语语言的数据,大小在10K到100K之间。具体的数据集内容、用途和结构没有在README中描述。
Hugging Face2025-02-06 更新120
LangAGI-Lab/COFFEE-Dataset-both-correct-and-incorrect-edit-feedback
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: eval path: data/eval-* dataset_info: features: - name: problem_id dtype: string - nam
Hugging Face2024-06-03 更新100



