有效

基于深度强化学习的最短路阻断方法和装置

朱先强、戴周璇、张橹、朱承、丁兆云、周鋆、汤罗浩、张维明、刘斌
中国人民解放军国防科技大学

摘要

本申请涉及一种基于深度强化学习的最短路阻断方法和装置。所述方法包括:获取网络图,采用编码器将网络图映射至低维向量空间,得到动作表示向量和图状态表示向量,将动作表示向量作为强化学习的动作,图状态表示向量作为强化学习的状态,输入至解码器中,通过解码器将动作和状态建模为深度Q网络,并对深度Q网络进行训练,在输入待阻断网络图后,输出待阻断网络图的最优阻断方案。采用本方法使得深度学习解决最短路阻断问题成为可能。