主要内容
自科版推荐

基于深度强化学习的水下机器人最优轨迹控制


发布者:tcl,发布时间:2018/4/9 15:34:05,阅读:


 

基于深度强化学习的水下机器人最优轨迹控制

马琼雄1,余润笙1,石振宇2,黄晁星1,李腾龙1 
1. 华南师范大学信息光电子科技学院 
2. 华南师范大学

摘要 为了实现水下机器人在跟踪复杂轨迹时具有出较高的精度和稳定性,提出了利用深度强化学习实现水下机器人最优轨迹控制的方法:首先,建立基于2个深度神经网络(Actor网络和Critic网络)的水下机器人控制模型,其中Actor网络用来选择动作,Critic网络用来评估Actor网络的训练结果;其次,构造合适的奖励信号使得深度强化学习算法适用于水下机器人的动力学模型;最后,提出了基于奖励信号标准差的网络训练成功评判条件,使得水下机器人在确保精度的同时保证稳定性. 仿真实验结果表明:在解决一定精度内的水下机器人复杂轨迹跟踪问题时,该算法与传统PID控制算法相比具有更优的性能.

引用本文: 马琼雄 余润笙 石振宇 黄晁星 李腾龙. 基于深度强化学习的水下机器人最优轨迹控制[J]. 华南师范大学学报(自然科学版), 2018, 50(1): 118-123.

链接本文: http://journal.scnu.edu.cn:8080/jwk_xbzrb/CN/