- 0
- 0
- 约7.59万字
- 约 14页
- 2026-08-26 发布于江苏
- 举报
2021年IEEE国际机器人与自动化会议(ICRA
2021)2021年5月31日至日,
基于增强对抗逆强化学习的自动驾驶决策方法
1刘大鹏23李晗晗41
——在复杂驾驶环境中进行决策对自主智能体而言具[2],以及对抗逆强化学习(AIRL)[8]。其中,AIRL能
有性。模仿学习方法在该领域展现出巨大潜力。对抗性逆够同时学习策略和函数,并表现出更优性能。在原
向强化学习(AIRL)作为最先进的模仿学习方法之一,可同研究中,AIRL仅在简单静态环境中得到验证,例如
时学习行为策略与函数,但现有研究仅验证了其在无交互
OpenAI
Gym中的二维质点迷宫导航和四足蚂蚁奔跑任
的简单静态环境中的有效性。本文通过在学习框架中引入语义
务。这些任务未涉及与动态对象的交互。
,改进并稳定了AIRL的性能表现。此外,增强版
AIRL应用于自动驾驶高交互环境下的实际复杂决策任务。所
提方法与四种基
原创力文档

文档评论(0)