登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Reinforcement learning adaptive PID controller design steps.
Reinforcement learning adaptive PID controller design steps.
收藏
Figshare
2025-08-13 更新
2026-04-28 收录
自适应控制
强化学习
数据链接:
https://figshare.com/articles/dataset/Reinforcement_learning_adaptive_PID_controller_design_steps_/29904723
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Reinforcement learning adaptive PID controller design steps.
应用场景:
创建时间:
2025-08-13
相关数据集
nlile/NuminaMath-1.5-RL-Verifiable
数学问题生成
强化学习
NuminaMath-1.5-RL-Verifiable是一个专门为强化学习应用设计的数学问题数据集,包含了经过严格筛选的131,063个数学单词问题。这些问题都有明确的数值答案,并经过了问题和解决方案的验证,确保来源是高质量的非合成内容。数据集覆盖了代数、几何、数论等多个数学领域。
Hugging Face
2025-03-25 更新
17
0
CodeDPO/rl_dataset_llama3_instruct_8b_20241230_human_eval_format
强化学习
自然语言处理
该数据集包含了问题ID、样本ID、预处理提示文本、处理后的响应、未处理的响应等信息的文本数据,适用于自然语言处理任务。数据集分为训练集,共包含284,419个示例,总大小为1,650,704,840字节。
Hugging Face
2025-01-03 更新
6
0
maanas-writer/mem_agent-model_based-rl-memoryagent-14b-gsminf-ops_12-c4096-t2048-10s-agnostic
强化学习
问答系统
这是一个包含问题、上下文、正确答案、响应等信息的文本数据集,适用于问答或机器阅读理解等NLP任务。数据集分为训练集,共有80个示例。
Hugging Face
2025-11-07 更新
5
0
visual_distracting_metaworld
强化学习
机器人操作
该数据集包含三个配置:'metaworld_hammer'、'metaworld_hammer_distractor'和'metaworld_hammer_distractor_low'。每个配置包含以下特征:观察(图像)、状态(float32列表,长度39)、掩码(图像)、动作(float32列表,长度4)、奖励(float32)、终止(布尔值)和截断(布尔值)。数据集提供训练集分割,每个配置的
Hugging Face
2026-02-03 更新
10
0
FractalAIResearch/Fathom-V0.4-RL-Compression
学科文本生成
强化学习
Ramanujan-Ganit-R1-14B-RL是一个英文文本生成数据集,可能包含数学相关的文本内容,并在模型预训练后进行了后处理。具体的数据集内容和用途在README中未详细说明。
Hugging Face
2025-05-13 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广