强化学习pdf-智能科学与人工智能.pdfVIP

  • 191
  • 0
  • 约6.24万字
  • 约 100页
  • 2018-11-26 发布于天津
  • 举报
强化学习pdf-智能科学与人工智能强化学习pdf-智能科学与人工智能

高级人工智能 第十章 强化学习 Reinforcement Learning 史忠植 中国科学院计算技术研究所 内容提要  引言  强化学习模型  动态规划  蒙特卡罗方法  时序差分学习  Q学习  强化学习中的函数估计  应用 2015/5/6 史忠植 强化学习 2 引言 人类通常从与外界环境的交互中学习。所谓强化 (reinforcement)学习是指从环境状态到行为映射的学 习,以使系统行为从环境中获得的累积奖励值最大。在强 化学习中,我们设计算法来把外界环境转化为最大化奖励 量的方式的动作。我们并没有直接告诉主体要做什么或者 要采取

文档评论(0)

1亿VIP精品文档

相关文档