- 13
- 0
- 约1.6万字
- 约 11页
- 2023-11-25 发布于四川
- 举报
本发明公开了一种基于深度强化学习的混合资源调度方法,属于计算机技术领域;该方法包括以下步骤:构建马尔可夫决策过程的数学框架;构建深度强化学习模型;深度强化学习模型包括评价网络和目标网络;对构建的深度强化学习模型进行训练;利用深度强化学习模型获得初始化粒子群;采用分层学习划分粒子群,并计算粒子群的粒子适应值;对粒子群进行更新,位于低层的粒子随机选取高层的粒子作为参考进行速度及位置的更新,从而得到全局最优解即最优的资源调度方案。本发明通过将深度强化学习模型、分层学习的策略以及粒子群算法相结合,提高算
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 117112207 A
(43)申请公布日 2023.11.24
(21)申请号 202311037605.3 G06N 3/092 (2023.01)
您可能关注的文档
最近下载
- 孕产期甲状腺疾病防治管理指南2022解读.pptx VIP
- 中国假肢适配指南(2025版).docx VIP
- 新课标高中英语词汇精练 【精品】.doc VIP
- 地质调查员地质灾害方向职业技能竞赛模拟试题(附答案).docx VIP
- 地质调查员地质灾害方向职业技能竞赛模拟试题(含答案).docx VIP
- CSCO滤泡上皮来源甲状腺癌诊疗指南(2025版).pdf VIP
- 解码国家安全智慧树知到期末考试答案2024年.docx VIP
- 2026年中医师承及确有专长考核真题(附答案).docx VIP
- 2026年中小学教育政策与法规考试试卷及答案.docx VIP
- 合肥工业大学学位授予工作暂行实施细则.docx VIP
原创力文档

文档评论(0)