数据链接:
官方服务:
资源简介:
Supporting data of a2c project under the GNoME effort
应用场景:
创建时间:
2024-11-21
相关数据集
ScheduleNet: Learn to solve multi-agent scheduling problems with reinforcement learning
We propose ScheduleNet, a RL-based real-time scheduler, that can solve various types of multi-agent scheduling problems. We formulate these problems as a semi-MDP with episodic reward (makespan) and l
DataCite Commons2025-11-20 更新140
CognitiveLab/hh-rlhf-formatted
--- dataset_info: features: - name: prompt dtype: string - name: chosen dtype: string - name: rejected dtype: string splits: - name: train num_bytes: 327229899 num_exam
Hugging Face2024-01-18 更新80
Hang917/robot_assets
机器人资产数据集,包含机器人的几何形状、URDF、MuJoCo XML文件以及相关的网格资源,适用于机器人学和强化学习等相关领域。
Hugging Face2025-11-08 更新60
Flightmare Simulator
Flightmare 由两个主要组件组成:基于 Unity 构建的可配置渲染引擎和用于动态模拟的灵活物理引擎。这两个组件完全解耦,可以彼此独立运行。 Flightmare 具有几个理想的功能:(i)大型多模式传感器套件,包括提取场景 3D 点云的界面; (ii) 用于强化学习的 API,可以并行模拟数百个四旋翼; (iii) 与虚拟现实耳机的集成,用于与模拟环境进行交互。 Flightmare 可
OpenXLab80
luca0621/multi-RLHF-processed-llama1B-dataset-with-1000-rewards
该数据集包含查询(query)、响应(response)和奖励(reward)三个特征,其中查询和响应为字符串类型,奖励为浮点数类型。数据集分为训练集和测试集,训练集包含8000个样本,测试集包含2000个样本。总下载大小为2276183字节,数据集总大小为7148705字节。
Hugging Face2024-11-30 更新70



