- 12
- 0
- 约2.06万字
- 约 18页
- 2023-06-11 发布于四川
- 举报
本发明公开一种基于深度强化学习的变质量水下航行器避障方法及系统,包括:根据变质量水下航行器的运动状态和执行机构动作构建基于深度强化学习网络的避障仿真模型;将历史避障任务完整轨迹作为专家数据存入经验回放池,根据变质量水下航行器初始运动状态和高斯噪声得到当前执行动作,根据当前执行动作得到新运行状态和当前执行动作的奖励值,并存入经验回放池;根据经验回放池对避障仿真模型进行训练,根据当前训练的执行动作奖励值和历史训练的奖励平均值更新高斯噪声;以迭代训练完成后的基于深度强化学习网络的避障仿真模型得到变质量
(19)中华人民共和国国家知识产权局
(12)发明专利
(10)授权公告号 CN 113010963 B
(45)授权公告日 2022.04.29
(21)申请号 202110240036.7 (51)Int.Cl.
原创力文档

文档评论(0)