- 191
- 0
- 约6.24万字
- 约 100页
- 2018-11-26 发布于天津
- 举报
强化学习pdf-智能科学与人工智能强化学习pdf-智能科学与人工智能
高级人工智能
第十章
强化学习
Reinforcement Learning
史忠植
中国科学院计算技术研究所
内容提要
引言
强化学习模型
动态规划
蒙特卡罗方法
时序差分学习
Q学习
强化学习中的函数估计
应用
2015/5/6 史忠植 强化学习 2
引言
人类通常从与外界环境的交互中学习。所谓强化
(reinforcement)学习是指从环境状态到行为映射的学
习,以使系统行为从环境中获得的累积奖励值最大。在强
化学习中,我们设计算法来把外界环境转化为最大化奖励
量的方式的动作。我们并没有直接告诉主体要做什么或者
要采取
您可能关注的文档
最近下载
- IATF16949标准题库(含答案).doc
- J-BT-3926.13-1999 垂直斗式提升机 圆环链链轮参数尺寸.pdf VIP
- 工程施工方案的编制依据(3篇).docx
- 2025年人格七宗罪测试题及答案.doc VIP
- CZ2209--92改进型50km钢轨9号单开道岔总布置图(中铁轨道系统公司2009).pdf VIP
- 08 第二章 第四节 海洋空间资源开发与国家安全.pptx VIP
- 《屋顶分布式光伏发电系统施工技术规范》.pdf VIP
- 2023年某能源电解铝项目阳极组装车间施工方案方案模板.pptx VIP
- 《湿式排水一体化预制泵站》.pdf VIP
- 电气控制与S7-1200 PLC应用教程 课件 项目15:步进电机驱动的工作台PLC控制系统设计安装与调试.ppt
原创力文档

文档评论(0)