《计算机工程与应用杂志》发表论文赏析

基于强化学习的舰船目标跟踪有限理性博弈算法研究

来源:计算机工程与应用杂志2024年第20期北京时间:

作者:陈素霞, 徐清雯, 刘久富, 解晖, 刘向武

单位:1.河南轻工职业学院 计算机与艺术设计系,郑州 450008;2.南京航空航天大学 自动化学院,南京 211106

摘要:针对现实中的决策者并非总能完全理性分析问题的情况,提出有限理性下的追逃博弈算法。建立追逃博弈模型,先求解完全理性下博弈双方的鞍点策略。引入有限理性level-k模型,对追击者和躲避者思考策略的层次进行结构性假设,允许追逃双方具备不同的策略推理能力,并给出相应等级的值函数和策略,策略满足HJI方程。随着等级的增加,策略最终会趋于纳什均衡。由于HJI方程难以直接求解,基于强化学习的actor-critic算法进行求解,设计算法使追击者能够估算出躲避者的思维等级并采取合适的策略。以舰船为对象,将舰船运动简化为二维的数学模型,建立舰船追逃博弈模型,对其进行算法仿真验证。

关键词:追逃博弈,目标跟踪,强化学习,有限理性

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!