- 10
- 0
- 约1.37万字
- 约 14页
- 2023-06-10 发布于四川
- 举报
本发明公开了基于超参数网络权重分配深度强化学习的车辆调度方法,包括:获取多智能体的调度区域,调度区域包括局部区域和全局区域,其中智能体为被调度的车辆;基于局部区域,得到多智能体的局部状态,基于局部状态,通过策略网络,得到当前的调度策略;基于全局区域,得到多智能体的全局状态,基于全局状态,通过价值网络,得到全局状态价值;通过评价网络,得到多智能体的状态‑联合动作价值;基于状态价值与状态‑联合动作价值,得到新的目标函数;基于目标函数,优化调度策略,最终实现车辆调度。本发明通过以上技术方案,能够提高订
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 115713130 A
(43)申请公布日 2023.02.24
(21)申请号 202211088592.8
(22)申请日 2022.09.07
(71)申请人 华东交通大学
地址 330013
原创力文档

文档评论(0)