- 6
- 0
- 约2.24万字
- 约 18页
- 2023-05-10 发布于四川
- 举报
本发明一种基于深度强化学习的空空导弹越肩发射制导律设计方法,包括步骤如下:步骤1,对越肩发射进行归一化动力学建模;对模型进行归一化使各状态量具有相近的量级,从而使神经网络的权重更新能够更加稳定;步骤2,为了适应强化学习的研究范式,需要将步骤1中的研究问题建模为马尔科夫决策过程;步骤3,搭建算法网络,设置算法参数;选用的深度学习算法为近端策略优化算法PPO,步骤4,在训练达到目标奖励值或最大步数之前,智能体将根据PPO算法不断收集状态转移数据及奖励,并不断迭代更新Actor网络和Critic网络的
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 114519292 A
(43)申请公布日 2022.05.20
(21)申请号 202111550831.2
(22)申请日 2021.12.17
(71)申请人 北京航空航天大学
地址 10019
您可能关注的文档
最近下载
- 辅警行政职业能力测验真题及答案.docx VIP
- 2026中邮金融资产投资有限公司社会招聘笔试历年参考题库附带答案详解.docx
- 上海市奉贤中学2024-2025学年高一上学期期中考试 化学试卷(原卷版+解析版).docx VIP
- 2026年贵州省高考化学真题卷(含答案与解析).pdf VIP
- 煤矿行业全员安全职业病防治培训教案.ppt VIP
- 高压柜安装检验批.xls VIP
- 2024年贵州省高考化学真题卷(含答案与解析)_8616.pdf VIP
- 腹腔镜子宫悬吊术手术配合.pptx
- 从江瑶浴基本药材目录.pdf VIP
- 蔚来汽车技术规范 横移机技术规范 NIO-CCRM-03-H007.pdf VIP
原创力文档

文档评论(0)