【MATLAB强化学习工具箱】学习笔记--在Simulink环境中训练智能体Create Simulink Environment and Train Agent

本文介绍了如何在Simulink环境中将传统的PI控制器替换为神经网络控制器,以优化水箱模型的控制效果。首先展示PI控制器的控制场景,然后详细阐述了替换步骤,包括删除PID模块、添加RLAgent模块、定义观测器和奖励函数、设置终止条件以及构建Simulink环境接口。接着,利用DDPG算法创建并训练神经网络控制器,最后展示了训练结果和验证效果。

Simulink中便于搭建各类动力学与控制模型,通过将原有的控制器替换为AI控制器,可以方便使用已有模型,提供增量效果。

本节的重点是如何引入Simulink模型作为env,其他的内容在之前的文章中已有说明。

以水箱模型watertank为例,如下图所示:

 采用PI控制器,控制效果如下所示:

 将此PI控制器替换为神经网络控制器后,系统架构如下图所示:

 具体替换策略如下所示:

(1)删去PID控制器;

(2)增加RL Agent模块;

(3)观测器模块:

观测向量为:[\int e\mathrm{dt} \ e \ h]^T,其中h为水箱高度,

评论 13
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值