Gridworld RL Trajectories:100K Agent Decision Logs
收藏数据链接:
官方服务:
资源简介:
100K agent steps, rewards, and state transitions for offline RL modeling.
该数据集包含十万组AI智能体(AI Agent)交互步、奖励及状态转移数据,用于离线强化学习建模
创建时间:
2026-08-22

100K agent steps, rewards, and state transitions for offline RL modeling.
该数据集包含十万组AI智能体(AI Agent)交互步、奖励及状态转移数据,用于离线强化学习建模