《电讯技术杂志》发表论文赏析
作者:伍元胜
单位:(中国西南电子技术研究所,成都 610036)
摘要:针对现有智能路由技术无法适用于动态拓扑的不足,提出了一种面向动态拓扑的深度强化学习智能路由技术,通过使用图神经网络近似PPO(Proximal Policy Optimization)强化学习算法中的策略函数与值函数、策略函数输出所有链路的权值、基于链路权值计算最小成本路径的方法,实现了路由智能体对不同网络拓扑的泛化。仿真结果表明,所提方法可适应动态拓扑的变化并具有比传统的最短路由算法更高的网络吞吐量。
关键词:智能通信网络;智能路由;深度强化学习;图神经网络;动态拓扑;