一种基于深度强化学习的混合资源调度方法.pdfVIP

  • 13
  • 0
  • 约1.6万字
  • 约 11页
  • 2023-11-25 发布于四川
  • 举报

一种基于深度强化学习的混合资源调度方法.pdf

本发明公开了一种基于深度强化学习的混合资源调度方法,属于计算机技术领域;该方法包括以下步骤:构建马尔可夫决策过程的数学框架;构建深度强化学习模型;深度强化学习模型包括评价网络和目标网络;对构建的深度强化学习模型进行训练;利用深度强化学习模型获得初始化粒子群;采用分层学习划分粒子群,并计算粒子群的粒子适应值;对粒子群进行更新,位于低层的粒子随机选取高层的粒子作为参考进行速度及位置的更新,从而得到全局最优解即最优的资源调度方案。本发明通过将深度强化学习模型、分层学习的策略以及粒子群算法相结合,提高算

(19)国家知识产权局 (12)发明专利申请 (10)申请公布号 CN 117112207 A (43)申请公布日 2023.11.24 (21)申请号 202311037605.3 G06N 3/092 (2023.01)

文档评论(0)

1亿VIP精品文档

相关文档