登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
eval_so101_rollout_try_00
eval_so101_rollout_try_00
收藏
Hugging Face
2026-04-05 更新
2026-04-05 收录
机器人
强化学习
数据链接:
https://huggingface.co/datasets/narina02/eval_so101_rollout_try_00
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该数据集为HuggingFace LeRobot格式机器人数据集。
应用场景:
提供机构:
narina02
创建时间:
2026-04-05
相关数据集
skandermoalla/qrpo-paper-mistral-nosft-magpieair-armorm-temp1-ref50-offpolicy2best-armorm
强化学习
对齐
--- license: mit tags: - reinforcement-learning - alignment - qrpo --- # qrpo-paper-mistral-nosft-magpieair-armorm-temp1-ref50-offpolicy2best-armorm Dataset with reference completions and rewards fo
Hugging Face
2025-12-08 更新
7
0
koch_sim_pick_test
机器人
模拟测试
该数据集为HuggingFace LeRobot格式机器人数据集。
Hugging Face
2024-10-23 更新
5
0
maanas-writer/mem_agent-model_based-rl-memoryagent-7b-barexamqa-train-c256-t128-10s-agnostic-nocontext
强化学习
机器学习
该数据集包含了问题、上下文、正确答案、模型回答等字段,适用于训练和评估自然语言处理模型。数据集分为训练集,包含了大量的示例,用于机器学习模型的训练。
Hugging Face
2025-11-13 更新
4
0
DCAgent3/financeagent_terminal_a3_rl_DCAgent_exp_rpt_e2egit_v2_10_8B_20260527_202838
强化学习
智能体决策
该数据集是一个包含对话记录和相关元数据的数据集,用于训练或评估人工智能模型。数据特征包括对话内容(conversations,包含角色和文本)、代理(agent)、模型(model)、模型提供商(model_provider)、日期(date)、任务(task)、片段(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_
Hugging Face
2026-05-27 更新
6
0
skandermoalla/qrpo-paper-mistral-sft-magpieair-armorm-temp1-ref50-offpolicy2random-armorm
强化学习
对齐
--- license: mit tags: - reinforcement-learning - alignment - qrpo --- # qrpo-paper-mistral-sft-magpieair-armorm-temp1-ref50-offpolicy2random-armorm Dataset with reference completions and rewards fo
Hugging Face
2025-12-08 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广