《电子与信息学报杂志》发表论文赏析
作者:何威振, 谭晶磊, 张帅, 程国振, 张帆, 郭云飞
单位:1.信息工程大学信息技术研究所 郑州 4500012.网络空间安全教育部重点实验室 郑州 450001
摘要:针对当前网络拓扑欺骗防御方法仅从空间维度进行决策,没有考虑云原生网络环境下如何进行时空多维度拓扑欺骗防御的问题,该文提出基于深度强化学习的多阶段Flipit博弈网络拓扑欺骗防御方法来混淆云原生网络中的侦察攻击。首先分析了云原生网络环境下的拓扑欺骗攻防模型,接着在引入折扣因子和转移概率的基础上,构建了基于Flipit的多阶段博弈网络拓扑欺骗防御模型。在分析博弈攻防策略的前提下,构建了基于深度强化学习的拓扑欺骗生成方法求解多阶段博弈模型的拓扑欺骗防御策略。最后,通过搭建实验环境,验证了所提方法能够有效建模分析云原生网络的拓扑欺骗攻防场景,且所提算法相比于其他算法具有明显的优势。
关键词:云原生网络, 拓扑欺骗, 多阶段Flipit博弈, 深度强化学习, 深度确定性策略梯度算法
基金资助:河南省重大科技专项(221100211200)