- 2
- 0
- 约2.18万字
- 约 45页
- 2026-08-07 发布于广东
- 举报
强化学习算法原理及其在典型场景中的应用
目录
强化学习算法概述........................................2
1.1强化学习基本概念.......................................2
1.2强化学习与监督学习、无监督学习的区别...................4
1.3强化学习算法的分类.....................................6
强化学习算法原理........................................8
2.1动机与奖励.............................................8
2.2状态、动作与价值函数..................................12
2.3策略迭代与值迭代......................................13
2.4Q学习算法.............................................16
2.5策略梯度算法..........................................18
典型强化学习算法分析...................................19
3.1深度Q网络
原创力文档

文档评论(0)