《计算机应用研究杂志》发表论文赏析

基于目标的域随机化方法在机器人操作方面的研究

来源:计算机应用研究杂志2022年第10期北京时间:

作者:张夏禹,陈小平,

单位:中国科学技术大学,合肥230026;

摘要:使用强化学习解决机器人操作问题有着诸多优势,然而传统的强化学习算法面临着奖励稀疏的困难,且得到的策略难以直接应用到现实环境中。为了提高策略从仿真到现实迁移的成功率,提出了基于目标的域随机化方法。使用基于目标的强化学习算法对模型进行训练,可以有效地应对机器人操作任务奖励稀疏的情况,得到的策略可以在仿真环境下良好运行。与此同时在算法中还使用了目标驱动的域随机化方法,在提高策略泛用性以及克服仿真和现实环境之间的差距上有着良好的效果,仿真环境下的策略容易迁移到现实环境中并成功执行。结果表明,使用了基于目标的域随机化方法的强化学习算法有助于提高策略从仿真到现实迁移的成功率。

关键词:强化学习,域随机化,机器人操作,仿真到现实迁移,

基金资助:国家重点研发计划资助项目(2019YFE0125200);;

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!