OpenThoughts-114k, OpenR1-Math-220k, GeneralThought-195K, SYNTHETIC-1, Natural-reasoning, Big-Math-RL-Verified, Chinese-DeepSeek-R1-Distill-data-110k, medical-o1-reasoning-SFT, Medical-R1-Distill-Data-Chinese
收藏资源简介:
OpenThoughts-114k: 包含114k条开放思想的强化学习数据集。OpenR1-Math-220k: 包含220k条数学问题的强化学习数据集。GeneralThought-195K: 包含195K条通用思考的强化学习数据集。SYNTHETIC-1: 合成数据集,用于强化学习研究。Natural-reasoning: 自然推理数据集,用于强化学习。Big-Math-RL-Verified: 包含大量数学问题的强化学习数据集,经过验证。Chinese-DeepSeek-R1-Distill-data-110k: 包含110k条中文DeepSeek R1蒸馏数据的强化学习数据集。medical-o1-reasoning-SFT: 医学推理数据集,用于强化学习。Medical-R1-Distill-Data-Chinese: 中文医学R1蒸馏数据,用于强化学习。
OpenThoughts-114k: A reinforcement learning dataset containing 114k open-ended thought samples. OpenR1-Math-220k: A reinforcement learning dataset with 220k mathematical problem-solving samples. GeneralThought-195K: A reinforcement learning dataset encompassing 195K general thought samples. SYNTHETIC-1: A synthetic dataset intended for reinforcement learning research. Natural-reasoning: A natural reasoning dataset for reinforcement learning studies. Big-Math-RL-Verified: A verified reinforcement learning dataset featuring a large volume of mathematical problem samples. Chinese-DeepSeek-R1-Distill-data-110k: A reinforcement learning dataset consisting of 110k Chinese DeepSeek R1 distillation samples. medical-o1-reasoning-SFT: A medical reasoning dataset for reinforcement learning applications. Medical-R1-Distill-Data-Chinese: A Chinese medical R1 distillation dataset for reinforcement learning research.
数据集概述
数据集列表
-
OpenThoughts-114k
- 地址: https://huggingface.co/datasets/open-thoughts/OpenThoughts-114k
-
OpenR1-Math-220k
- 地址: https://huggingface.co/datasets/open-r1/OpenR1-Math-220k
-
GeneralThought-195K
- 地址: https://huggingface.co/datasets/GeneralReasoning/GeneralThought-195K
-
SYNTHETIC-1
- 地址: https://huggingface.co/datasets/PrimeIntellect/SYNTHETIC-1
-
Natural-reasoning
- 地址: https://huggingface.co/datasets/facebook/natural_reasoning
-
Big-Math-RL-Verified
- 地址: https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified
-
Chinese-DeepSeek-R1-Distill-data-110k
- 地址: https://huggingface.co/datasets/Congliu/Chinese-DeepSeek-R1-Distill-data-110k
-
medical-o1-reasoning-SFT
- 地址: https://huggingface.co/datasets/FreedomIntelligence/medical-o1-reasoning-SFT
-
Medical-R1-Distill-Data-Chinese
- 地址: https://huggingface.co/datasets/FreedomIntelligence/Medical-R1-Distill-Data-Chinese
数据集描述
- 这些数据集主要涉及强化学习(Reinforcement Learning, RL)领域,特别是在大语言模型(LLMs)和多模态模型的背景下。
- 数据集涵盖了从数学推理到医学推理的多个领域,部分数据集还涉及中文数据。
- 数据集来源包括OpenAI、Facebook、SynthLabsAI等知名机构。
其他资源




