《计算机工程与应用杂志》发表论文赏析

改进行为克隆与DDPG的无人驾驶决策模型

来源:计算机工程与应用杂志2024年第14期北京时间:

作者:李伟东, 黄振柱, 何精武, 马草原, 葛程

单位:大连理工大学 汽车工程学院,辽宁 大连 116024

摘要:无人驾驶技术的关键是决策层根据感知环节输入信息做出准确指令。强化学习和模仿学习比传统规则更适用于复杂场景。但以行为克隆为代表的模仿学习存在复合误差问题,使用优先经验回放算法对行为克隆进行改进,提升模型对演示数据集的拟合能力;原DDPG(deep deterministic policy gradient)算法存在探索效率低下问题,使用经验池分离以及随机网络蒸馏技术(random network distillation,RND)对DDPG算法进行改进,提升DDPG算法训练效率。使用改进后的算法进行联合训练,减少DDPG训练前期的无用探索。通过TORCS(the open racing car simulator)仿真平台验证,实验结果表明该方法在相同的训练次数内,能够探索出更稳定的道路保持、速度保持和避障能力。

关键词:无人驾驶,强化学习,模仿学习,决策算法,TORCS

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!