《计算机集成制造系统杂志》发表论文赏析
作者:贺辉腾, 周勇, 胡楷雄, 李卫东
单位:1.武汉理工大学交通与物流工程学院2.上海理工大学机械工程学院
摘要:为解决机器人自主抓取领域中,抓取区域内存在明显遮挡且相互堆叠现象导致的抓取成功率不高的问题,提出一种多视角下基于深度强化学习的“抓取”和“推动”协同抓取策略。该策略利用基于RGB-D相机获取的三维点云作为状态输入,通过两个深度Q网络算法分别拟合抓取和推动策略,并通过奖励函数的合理设计,学习抓取和推动的相互配合,旨在用推动动作改变物体的分布,为抓取提供有利条件。在此基础上,针对抓取动作空间的复杂性导致算法抓取成功率不高的问题,提出了一种基于法线掩码的动作空间优化策略,通过基于估计法线的先验知识对抓取和推动动作的探索空间进行限制,从而提升了算法的性能。最后,利用UR5机器人在真实世界中进行协同抓取策略实验,验证了所提出协同抓取策略的有效性。
关键词:深度强化学习,机器人抓取,三维点云,多动作协同
基金资助:国家自然科学基金资助项目(51975444)。