在审

一种基于增量强化学习的目标搜索方法及装置

王博、张博、马亚辉、闫小伟、孙浚杰
中国电子科技集团有限公司电子科学研究院

摘要

本申请公开了一种基于增量强化学习的目标搜索方法,包括:对无人机执行第一搜索任务所在的目标空间进行网格化处理,生成环境数据网;基于环境数据网中无人机对应的当前状态、当前状态采取的动作以及下一状态,设计奖励函数,基于奖励函数和预设的搜索策略,生成强化学习训练模型;在无人机执行第二搜索任务的情况下,响应于第二搜索任务对强化学习训练模型进行评估的评估结果为对模型进行再训练,则以强化学习训练模型为第一网络分支,以第二搜索任务对应的模型参数训练生成的模型为第二网络分支,进行网络结构的设计,生成基于增量学习的新任务适配模型;基于新任务适配模型,对目标进行搜索,应用本方法,能够实现高效的目标搜索。

暂无引用专利