- 17
- 0
- 约3.67万字
- 约 54页
- 2023-09-19 发布于湖北
- 举报
PAGE 0
基于强化学习的倒立摆控制研究
基于强化学习的倒立摆控制研究
基于强化学习的倒立摆控制研究
摘 要
强化学习采用“试验——评价——调整”机制,利用环境交互的评价信号进行学习,通过最大化动作带来的累积回报期望调整动作选择概率,从而寻找最优策略。学习算法的优势在于在没有先验知识的条件下,能够解决无模型的控制问题。
倒立摆系统是一个经典的复杂物理系统,直线一级倒立摆系统通常包含摆杆偏角和角速度、小车位移和速度四个状态变量。由于系统是单输入控制的高阶物理系统,控制难度较高,常被用于分析检验控制算法有效性、精确性和快速性。此控制系统可反映控制算法的稳定性、实时性、随动性等效果。
原创力文档

文档评论(0)