1.一种无人机集群多目标的分布式决策方法,其特征在于,所述方法包括:构建无人机集群中无人机的分布式决策有限状态机以及博弈决策神经网络;所述分布式决策有限状态机中所述无人机的状态包括:决策保持者、正常决策者、纠结者以及迷失者;在当前决策轮次,根据无人机存储的上一决策轮次存储的决策数据以及当前获取的实时数据,对所述博弈决策神经网络进行实时参数调整;设置所述分布式决策有限状态机中状态跳转规则;所述状态跳转规则包括:若无人机的分布式决策有限状态机的状态为正常决策者,判断无人机与任意任务目标的距离均大于无人机决策距离阈值,则判断无人机的状态跳转为决策保持者;若判断无人机短时决策跳变大于无人机短时决策记忆容量乘以无人机短时决策容忍跳变率,则判断无人机的状态跳转为纠结者;跳转为决策保持者的无人机若离任意任务目标的距离小于决策距离阈值,则决策保持者的无人机的状态跳转为正常决策者,处于决策保持者的无人机若当前迷失者状态位为1,则决策保持者的无人机的状态跳转为迷失者,跳转为纠结者的无人机若离任意任务目标的距离大于决策距离阈值,则纠结者的无人机的状态跳转为决策保持者,跳转为纠结者的无人机若离所有任务目标的距离均变大或者变小,则纠结者的无人机的状态跳转为迷失者,跳转为迷失者的无人机若所统计步数达到阈值,则迷失者的无人机的状态跳转为正常决策者;处于所述正常决策者和纠结者状态的无人机通过实时调整参数后的博弈决策神经网络进行决策输出,处于所述迷失者的无人机通过任务目标数量和预设距离内无人机数量的比较关系,确定迷失者的最优任务目标作为决策输出,处于所述决策保持者的无人机保持上一决策轮次的决策。
2.根据权利要求1所述的方法,其特征在于,所述方法还包括:当处于正常决策者的无人机同时满足纠结者和决策保持者的跳转条件,若正常决策者成为纠结者之后满足迷失者条件则优先跳转纠结者;若正常决策者成为纠结者之后不满足迷失者条件则优先跳转决策保持者。
3.根据权利要求1所述的方法,其特征在于,所述方法还包括:无人机的状态在正常决策者和纠结者状态下,若纠结者在同时满足迷失者和决策保持者的跳转条件,则优先进入迷失者状态,若不满足迷失者状态条件则成为决策保持者,正常决策者满足决策保持者的进入条件则直接成为决策保持者。
4.根据权利要求1所述的方法,其特征在于,所述方法还包括:设置决策保持标志位、纠结者标志位以及迷失者标志位;当无人机的状态处于决策保持者时,所述决策保持标志位置1,否则为0;当无人机的状态处于纠结者时,所述纠结者标志位置1,否则为0;当无人机的状态处于迷失者时,所述迷失者标志位置1,否则为0。
5.根据权利要求1所述的方法,其特征在于,处于所述迷失者的无人机通过任务目标数量和预设距离内无人机数量的比较关系,确定迷失者的最优任务目标作为决策输出,包括:若处于所述迷失者的无人机预设距离内无人机数量等于任务目标数量,则处于所述迷失者的无人机选择距离最近的任务目标为最优任务目标作为决策输出,否则处于所述迷失者的无人机选择差额最小的任务目标为最优任务目标作为决策输出。
6.根据权利要求1至5任一项所述的方法,其特征在于,在当前决策轮次,根据无人机存储的上一决策轮次存储的决策数据以及当前获取的实时数据,对所述博弈决策神经网络进行实时参数调整,包括:给每个决策变量分配决策变量权重,以及根据所述决策变量权重构建博弈决策神经网络为: ;其中, 为博弈决策神经网络, 表示网络系数,决策变量权重 根据网络系数 归一化得到, 表示网络参数;在当前决策轮次,将无人机存储的上一决策轮次存储的决策数据以及当前获取的实时数据输入所述博弈决策神经网络,以此对所述博弈决策神经网络进行实时参数调整。
7.根据权利要求6所述的方法,其特征在于,对所述博弈决策神经网络进行实时参数调整,包括:根据所述决策变量的任意两个决策变量计算得到一组决策变量权重,然后根据计算得到的一组决策变量权重和另一组决策变量权重进行拓展,得到第三个决策变量权重,以此计算得到所有决策变量权重。
8.一种无人机集群多目标的分布式决策装置,其特征在于,所述装置包括:框架构建模块,用于构建无人机集群中无人机的分布式决策有限状态机以及博弈决策神经网络;所述分布式决策有限状态机中所述无人机的状态包括:决策保持者、正常决策者、纠结者以及迷失者;参数调整模块,用于在当前决策轮次,根据无人机存储的上一决策轮次存储的决策数据以及当前获取的实时数据,对所述博弈决策神经网络进行实时参数调整;状态跳转逻辑设置模块,用于设置所述分布式决策有限状态机中状态跳转规则;所述状态跳转规则包括:若无人机的分布式决策有限状态机的状态为正常决策者,判断无人机与任意任务目标的距离均大于无人机决策距离阈值,则判断无人机的状态跳转为决策保持者;若判断无人机短时决策跳变大于无人机短时决策记忆容量乘以无人机短时决策容忍跳变率,则判断无人机的状态跳转为纠结者;跳转为决策保持者的无人机若离任意任务目标的距离小于决策距离阈值,则决策保持者的无人机的状态跳转为正常决策者,处于决策保持者的无人机若当前迷失者状态位为1,则决策保持者的无人机的状态跳转为迷失者,跳转为纠结者的无人机若离任意任务目标的距离大于决策距离阈值,则纠结者的无人机的状态跳转为决策保持者,跳转为纠结者的无人机若离所有任务目标的距离均变大或者变小,则纠结者的无人机的状态跳转为迷失者,跳转为迷失者的无人机若所统计步数达到阈值,则迷失者的无人机的状态跳转为正常决策者;决策输出模块,用于处于所述正常决策者和纠结者状态的无人机通过实时调整参数后的博弈决策神经网络进行决策输出,处于所述迷失者的无人机通过任务目标数量和预设距离内无人机数量的比较关系,确定迷失者的最优任务目标作为决策输出,处于所述决策保持者的无人机保持上一决策轮次的决策。