- 0
- 0
- 约7.15千字
- 约 8页
- 2023-05-11 发布于四川
- 举报
本发明提供了一种基于强化学习的极化码屏蔽矩阵构建方法,该方法能根据当前信道条件选择最佳的凿孔位置与缩短位置,从而获得相应的屏蔽矩阵。主要内容包括:将屏蔽矩阵构造过程类比为马尔可夫决策过程,并且通过强化学习进行模型的构建;根据屏蔽矩阵的性质,对模型的各种参数进行相应的设置;采用Q‑learning算法在训练时对模型进行Q表的更新,并且根据Q表进行动作的选择。由于模型最终状态的奖励值只由译码的误帧率所决定,所以适用于不同的信道。本发明方法相对穷举法在保证性能的情况下复杂度有一定的降低。
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 114584154 A
(43)申请公布日 2022.06.03
(21)申请号 202210221579.9
(22)申请日 2022.03.09
(71)申请人 中国计量大学
地址 310018
原创力文档

文档评论(0)