- 2
- 0
- 约1.58万字
- 约 13页
- 2023-11-25 发布于四川
- 举报
本发明属于智能控制领域,具体涉及一种单交叉口信号控制模型迁移至目标环境的方法,本专利将控制模型从源训练环境迁移到目标环境,首先搭建信号控制模型的DQN深度强化学习框架;其次对控制模型的迁移环境进行交叉口参数匹配以及DQN参数校准,判断是否满足目标环境;然后基于控制模型在源训练环境下得到的先验知识,对目标环境中原始控制模型的神经网络权重进行初始化设置,得到迁移至目标环境的控制模型;最后在目标环境下对控制模型优化训练,待模型收敛后,停止优化训练。实验表明可以节省在控制模型迁移至新环境中,可以减少训练
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 117114079 A
(43)申请公布日 2023.11.24
(21)申请号 202311387091.4 (51)Int.Cl .
原创力文档

文档评论(0)