登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Kwai-Klear/Klear-Qwen3-Thinking-Preview
Kwai-Klear/Klear-Qwen3-Thinking-Preview
收藏
Hugging Face
2025-07-25 更新
2025-09-13 收录
数据链接:
https://hf-mirror.com/datasets/Kwai-Klear/Klear-Qwen3-Thinking-Preview
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
Kwai-Klear
相关数据集
Kwai-Klear/RLEP_dataset
数学推理
强化学习
该数据集包含了用于论文RLEP: 基于经验回放的LLM推理强化学习中的实验数据。数据集遵循DAPO schema,分为测试集和训练集,其中测试集包含了AIME-2024、AIME-2025和AMC-2023数据,而训练集则包含了17k个数学问题,每个问题都有经验池存储在reward_model.candidates字段中。数据集的设计旨在优化数学推理任务的模型学习过程,通过回放高质量样本来避免无效
Hugging Face
2025-07-18 更新
15
0
Kwai-Klear/KlearReasoner-CodeSub-15K
代码推理
强化学习
这是一个来自Klear-Reasoner Code RL数据集的高质量子集,该数据集是从rllm项目使用的RL数据中派生出来的。这部分数据被用于训练Klear-Reasoner的代码推理模型。数据集经过仔细的清洗和筛选,只包含适用于强化学习的可靠样本。使用这个数据集训练的模型在各种代码推理基准测试中表现出显著的性能提升。
Hugging Face
2025-09-27 更新
15
0
Kwai-Klear/GoLongRL-Eval
长文本强化学习
序列建模评估
该存储库包含用于GoLongRL论文的评估基准数据集。
Hugging Face
2026-05-20 更新
1
0
Kwai-Klear/SWE-smith-mini_swe_agent_plus-trajectories-66k
问题解决
机器学习
这是一个包含约6.6万个问题解决轨迹的数据集,使用mini-swe-agent-plus工具在SWE-smith问题上收集。每个轨迹详细记录了代理从开始到结束处理问题的全过程。数据集适用于训练和评估问题解决模型。
Hugging Face
2025-11-06 更新
15
0
Kwai-Klear/KlearReasoner-MathSub-30K
数学推理
机器学习
这是一个从Klear-Reasoner Math RL数据集筛选出的30K条记录的子集,通过DeepSeek-R1-0120模型输出的结果进行筛选,确保了数学正确性和格式合规性。数据集适用于强化学习,并提供了高质量的样本,确保了准确的奖励信号。
Hugging Face
2026-01-06 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广