基于深度强化学习的水下机器人最优轨迹控制-华南师范大学学报.PDF

基于深度强化学习的水下机器人最优轨迹控制-华南师范大学学报.PDF

华南师范大学学报自然科学版基于深度强化学习的水下机器人最优轨迹控制马琼雄余润笙石振宇黄晁星李腾龙华南师范大学信息光电子科技学院广州摘要为了实现水下机器人在跟踪复杂轨迹时具有较高的精度和稳定性提出了利用深度强化学习实现水下机器人最优轨迹控制的方法首先建立基于个深度神经网络网络和网络的水下机器人控制模型其中网络用来选择动作网络用来评估网络的训练结果其次构造合适的奖励信号使得深度强化学习算法适用于水下机器人的动力学模型最后提出了基于奖励信号标准差的网络训练成功评判条件使得水下机器人在确保精度的同时保证

( ) - 华南师范大学学报 自然科学版 2018,50(1):118123 JournalofSouthChinaNormalUniversity(NaturalScienceEdition) doi:10.6054/j.jscnun.2018037 基于深度强化学习的水下机器人最优轨迹控制

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档