在审

一种基于前景理论和Q学习演化博弈方法的冗余执行体动态调度方法及系统

王一凡、张波、赵新建、李俊娥、钟旭、席泽生、何川、王云帆、张颂、沈力
武汉大学

摘要

本发明提供一种基于前景理论和Q学习演化博弈方法的冗余执行体动态调度方法及系统,方法包括:构建执行体的策略空间、收益结构和策略演化动态以及增强型分析器‑调节器的奖惩机制;执行体在三方博弈框架下模拟交互,迭代循环,循环结束输出拟态防御系统的策略空间作为冗余执行体的动态调度方法,其中,模拟交互过程包括:增强型分析器‑调节器实时监测获取各执行体的客观收益并根据执行体的收益结构计算各执行体的主观感知效用,后根据增强型分析器‑调节器的奖惩机制调整拟态防御系统的主观感知效用,各执行体根据调整后的主观感知效用以及策略演化动态更新各执行体的策略空间。

暂无引用专利