《交通运输系统工程与信息杂志》发表论文赏析

人机混合驾驶协同合流的多智能体近端策略优化算法

来源:交通运输系统工程与信息杂志2026年第1期北京时间:

作者:蒋贤才, 曲悦, 魏贺迪

单位:东北林业大学,土木与交通学院,哈尔滨150040

摘要:为平衡高速公路合流区网联自动驾驶车辆(CAV)与人工驾驶车辆(HDV)协同控制的安全与效率问题,本文以多智能体近端策略优化(Multi-Agent Proximal Policy Optimization, MAPPO)算法为基础,引入静态与动态双层动作掩码过滤规则,建立基于任务紧迫性、空间临界性和时间风险性的优先级指数,并采用近端策略优化(Proximal Policy Optimization, PPO)裁剪与广义优势估计(Generalized Advantage Estimation,GAE)长程收益估计优化“策略-价值网络”协同机制,提出融合优先级安全监管与动作掩码的混合交通协同合流多智能体近端策略优化算法——Priority-SAAM MAPPO。仿真结果表明,Priority-SAAM MAPPO在基础及复杂异构场景中的学习收敛性好,策略与价值网络协同优化稳定;安全性能方面,基础异构场景碰撞风险率低于4%,较MAPPO下降了50%,复杂异构场景碰撞风险率约8%,优于MAPPO(12%)和QMIX(一种基于单调价值函数分解的深度多智能体强化学习算法,18%);效率表现上,平均奖励均高于基准算法,且合流区时空密度从无序波动转为规则分布,交通流有序性显著增强,验证了其在合流区混合交通流协同控制中的有效性和鲁棒性。进一步分析表明,Priority-SAAM MAPPO适用于高交通密度和HDV行为异构性强的混合交通流合流控制。

关键词:智能交通,混合交通,多智能体近端策略优化,协同控制,合流区

基金资助:黑龙江省自然科学基金(PL2024E012)。

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!