《电子测量技术杂志》发表论文赏析
作者:尹旷,王红斌,方健,莫文雄,叶建斌,张宇
单位:广东电网有限责任公司广州供电局电力试验研究院 广州 510410
摘要:随着信息化程度不断加深,移动机器人的应用越来越广泛,但在很多情况下,移动机器人需要工作在不断变化且复杂的环境中,由于无法提前获取环境信息,往往难以对移动机器人进行路径规划并寻找到一条合适的路径。针对这一问题,本文提出了一种移动机器人路径规划方法。该方法运用栅格法建立环境模型,利用探索步数定义回报值,并通过强化学习不断优化路径;针对强化学习中对环境的探索与利用的平衡问题,提出一种变化的ε-decreasing动作选择策略和学习率选择方法,使探索因子随着智能体对环境探索程度的增加而动态变化,从而加快了学习算法的收敛速度。仿真结果表明,该方法能够实现移动机器人在复杂的环境下的自主导航和快速路径规划,在获得相同路径长度的前提下,迭代次数相比于传统强化学习算法减少了约32%,有效的加快了收敛速度。
关键词:路径规划; 环境信息; 强化学习; 探索因子