登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Transformer_Reinforcement_Learning
Transformer_Reinforcement_Learning
收藏
kaggle
2024-04-12 更新
2024-05-06 收录
强化学习
Transformer模型
数据链接:
https://www.kaggle.com/datasets/zjp2origin/transformer-reinforcement-learning
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
It may be deleted at any time.
本内容可能随时被删除。
应用场景:
创建时间:
2024-04-12
相关数据集
visnavdataset/lavn
视觉导航
强化学习
LAVN数据集是一个用于视觉导航、代理地图、路径点、强化学习和对比学习的数据集。数据集包含虚拟环境和真实环境中的轨迹数据,虚拟环境的数据来自Gibson和Matterport,真实环境的数据来自校园场景。每个轨迹数据包括RGB图像、深度图像(仅虚拟环境)和元数据(存储在worker_graph.json文件中)。元数据包括图像路径、深度路径、位置、方向、点击点、动作等信息。数据集还制定了长期维护计
Hugging Face
2024-06-05 更新
53
0
pe-nlp/Big-Math-RL-Verified-Filtered
数学问题求解
强化学习
该数据集包含问题、答案、来源、领域和解决率等信息,适用于机器学习模型训练,特别是自然语言处理任务。数据集划分为训练集,共有184352个示例。
Hugging Face
2025-03-03 更新
9
0
SemyonXu616/HFlibero-object-addreward-preview
机器人技术
强化学习
LeRobot数据集是一个机器人任务数据集,包含了观察图像、状态、动作、时间戳、帧索引、剧集索引、索引、任务索引和奖励等信息。数据集使用Apache-2.0许可证发布,分为训练集,共有66984个示例。数据集以Parquet和MP4格式存储,总大小约为9.25GB。
Hugging Face
2025-11-03 更新
8
0
kpriyanshu256/v0-hh-rlhf-train-Hindi-0-20000
自然语言处理
强化学习
该数据集包含三个主要字段:chosen、rejected和prompt,每个字段都包含content和role两个子字段,数据类型均为字符串。数据集包含一个训练分割(train),包含20,000个样本,总大小为43,517,254字节。下载大小为15,493,513字节。
Hugging Face
2024-06-18 更新
11
0
qgallouedec/prj_gia_dataset_metaworld_coffee_button_v2_1111
强化学习
智能代理
--- library_name: gia tags: - deep-reinforcement-learning - reinforcement-learning - gia - multi-task - multi-modal - imitation-learning - offline-reinforcement-learning --- An imitation learning env
Hugging Face
2023-03-08 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广