- 0
- 0
- 约8.64万字
- 约 20页
- 2026-08-10 发布于北京
- 举报
2021IEEE国际机器人与自动化会议(ICRA2021)2021年5月31日‑6月4西安
无需探索的学习鲁棒驾驶策略
11111
丹尼尔·格雷夫斯,阮nhật明,基米娅·哈桑扎德,,
—我们提出了一种多时间尺度预测表示学习方法,能
够在离线方式下高效地学习鲁棒的驾驶策略,这些策略能够很
好地泛化到新的道路几何形状、受损和干扰的车道条件,而这
些条件在离线训练数据中并未涵盖。我们展示了所表示
学习方法可以轻松应用于离线(批处理)强化学习设置,与标
准的批处理RL方法相比,在新条件下具有更好的泛化能力和
效率。我们的方法完全利用了在现实世界中收集的离线训练数
据,消除了对密集探索的需求,这了将深度强化学习
应用于现实世界的机器人训练。为了评估和分析我们观
点,我们在模拟器和现实世界场景中进行了各种实验。
图1:使用基于视觉的反预测在未来多个时间尺度上的车道居
您可能关注的文档
最近下载
- 高中英语2024届高考动词的时态语态和主谓一致易错题练习(高考真题,附参考答案和解析).doc VIP
- 大润发招商简介唐勐教学内容.ppt VIP
- (2026秋新版)教科版六年级科学上册新教材解读PPT课件.pptx
- 全国职业院校技能大赛高职组(中药传统技能赛项)考试题及答案 .docx VIP
- Q CR 9204-2015 铁路建设项目工程试验室管理标准.pdf VIP
- Q∕CR 9006-2014 铁路建设工程风险管理技术规范.pdf VIP
- 体育行业智慧体育与健身服务方案.pdf VIP
- Q-CR 9202-2015铁路建设项目现场管理规范(OCR).pdf VIP
- 高考志愿规划师必修课.pptx VIP
- (正式版)DB13 1577-2012 《环境空气质量 非甲烷总烃限值》.pdf VIP
原创力文档

文档评论(0)