- 31
- 0
- 约1.22万字
- 约 11页
- 2024-02-21 发布于四川
- 举报
本发明公开了一种知识数据混合驱动深度强化学习的网络资源调度方法,旨在解决现有无线网络资源调度中计算成本高、相关开销大和时间成本高、实时性差的问题。本发明实现的步骤是:获取无线网络历史调度方案和实时信道信息,计算每个用户与基站的接入矩阵;利用无线网络的历史性能指标修正无线网络的奖励值;以样本集奖励值中值分类抽样样本集的样本后生成训练集,训练目标Actor子网络。本发明能在保证无线网络的性能指标的同时,降低了基于深度强化学习的无线网络资源调度方法的计算成本和时间成本,提高了无线网络资源调度的总体收益
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号CN117580175A
(43)申请公布日2024.02.20
(21)申请号202311492383.4
(22)申请日2023.11.10
(71)申请人西安电子科技大学
原创力文档

文档评论(0)