机器学习方法及应用课件 第8章 强化学习.pdfVIP

  • 1
  • 0
  • 约1.46万字
  • 约 31页
  • 2026-09-14 发布于山东
  • 举报

机器学习方法及应用课件 第8章 强化学习.pdf

第8章

强化学习

ReinforcementLearning

00目录

1.强化学习概述

2.马尔可夫决策过程

3.Q-Learning算法

4.强化学习应用

5.强化学习案例分析

6.本章小结及习题

01强化学习概述

⚫强化学习定义

➢强化学习是机器学习的一个分支,与传统的机器学习方法不同,需要对情景及恰当的决策

之间进行搜索,根据反馈对这种搜索策略进行奖罚,是一种序列多步决策问题。

➢智能体通过与环境的持续交互,学习最优决策策略,最终实现长期累积奖励最大化的目标。

它模拟了人类学习的过程,通过尝试和错误,最终找到解决问题的最佳方法。

⚫有监督学习VS强化学习

有监督学习强化学习

→y

数据类型静态的标签数据(输入x输出的成对样本)

文档评论(0)

1亿VIP精品文档

相关文档