无需探索鲁棒驾驶策略学习方法.pdfVIP

  • 0
  • 0
  • 约8.64万字
  • 约 20页
  • 2026-08-10 发布于北京
  • 举报

2021IEEE国际机器人与自动化会议(ICRA2021)2021年5月31日‑6月4西安

无需探索的学习鲁棒驾驶策略

11111

丹尼尔·格雷夫斯,阮nhật明,基米娅·哈桑扎德,,

—我们提出了一种多时间尺度预测表示学习方法,能

够在离线方式下高效地学习鲁棒的驾驶策略,这些策略能够很

好地泛化到新的道路几何形状、受损和干扰的车道条件,而这

些条件在离线训练数据中并未涵盖。我们展示了所表示

学习方法可以轻松应用于离线(批处理)强化学习设置,与标

准的批处理RL方法相比,在新条件下具有更好的泛化能力和

效率。我们的方法完全利用了在现实世界中收集的离线训练数

据,消除了对密集探索的需求,这了将深度强化学习

应用于现实世界的机器人训练。为了评估和分析我们观

点,我们在模拟器和现实世界场景中进行了各种实验。

图1:使用基于视觉的反预测在未来多个时间尺度上的车道居

文档评论(0)

1亿VIP精品文档

相关文档