基于增强对抗逆强化学习自动驾驶变道决策研究.pdfVIP

  • 0
  • 0
  • 约7.59万字
  • 约 14页
  • 2026-08-26 发布于江苏
  • 举报

基于增强对抗逆强化学习自动驾驶变道决策研究.pdf

2021年IEEE国际机器人与自动化会议(ICRA

2021)2021年5月31日至日,

基于增强对抗逆强化学习的自动驾驶决策方法

1刘大鹏23李晗晗41

——在复杂驾驶环境中进行决策对自主智能体而言具[2],以及对抗逆强化学习(AIRL)[8]。其中,AIRL能

有性。模仿学习方法在该领域展现出巨大潜力。对抗性逆够同时学习策略和函数,并表现出更优性能。在原

向强化学习(AIRL)作为最先进的模仿学习方法之一,可同研究中,AIRL仅在简单静态环境中得到验证,例如

时学习行为策略与函数,但现有研究仅验证了其在无交互

OpenAI

Gym中的二维质点迷宫导航和四足蚂蚁奔跑任

的简单静态环境中的有效性。本文通过在学习框架中引入语义

务。这些任务未涉及与动态对象的交互。

,改进并稳定了AIRL的性能表现。此外,增强版

AIRL应用于自动驾驶高交互环境下的实际复杂决策任务。所

提方法与四种基

文档评论(0)

1亿VIP精品文档

相关文档