有效
基于目标识别的机器人导航决策方法
张圳、曾继荷、苏福松、徐浩、吴继冰、李璇、陈海文、赵翔
中国人民解放军国防科技大学
摘要
本发明涉及机器人导航技术领域,具体涉及基于目标识别的机器人导航决策方法,包括以下步骤:S1,获取环境图像与图像预处理:获取机器人周围环境的实时图像数据;S2,目标识别与特征提取:识别出环境中的目标物体;S3,环境建模:生成环境地图;S4,路径规划:计算机器人从当前位置到目标点的最优路径;S5,路径预测与修正:动态调整和优化机器人导航路径;S6,导航决策与动态调整:指导机器人进行实时导航;S7,反馈机制与优化:不断优化目标识别和导航决策。本发明确保机器人在复杂动态环境中能够灵活应对障碍物和其他突发情况,显著提升了导航系统的可靠性和安全性。
1.基于目标识别的机器人导航决策方法,其特征在于,包括以下步骤:S1:利用摄像头以及图像传感器获取机器人周围环境的实时图像数据,并对获取的图像数据进行预处理,包括图像去噪、灰度化以及边缘检测;S2:对预处理后的图像数据进行目标识别,识别出环境中的目标物体,并从识别出的目标物体中提取特征信息;S3:整合特征信息,并用栅格地图将整合的特征信息构建为栅格环境模型,生成环境地图,环境地图包括目标物体的位置、形状和相关信息;S4:基于构建的环境模型,计算机器人从当前位置到目标点的最优路径;S5:基于路径规划的结果,引入生成对抗网络进行路径预测与修正,动态调整和优化机器人导航路径,具体包括:S51:利用生成对抗网络生成潜在路径,并对生成的潜在路径进行评估,输出每条生成路径的可行性评分;具体包括:生成器不仅输入随机噪声,还输入当前环境模型、机器人位置信息和路径约束,生成潜在路径;判别器输入生成的路径和真实路径,并结合环境特征和多尺度特征进行评估,输出路径的可行性评分;通过生成器和判别器的对抗训练;生成器的损失函数为: ;其中, 为随机噪声, 为环境特征向量, 为路径约束, 为多尺度特征, 为噪声的概率分布, 为环境特征的概率分布, 为路径约束的概率分布,D表示识别器, 是期望;S52:根据可行性评分的结果,选择可行性最高的路径作为当前导航路径;S53:在机器人实际导航过程中,实时监控环境变化,通过生成对抗网络动态修正路径;S6:根据路径预测与修正的结果,结合机器人当前的位置、速度和方向,生成导航指令,指导机器人进行实时导航,动态调整导航决策;S7:通过实时图像数据和导航结果的反馈,不断优化目标识别和导航决策。
2.根据权利要求1所述的基于目标识别的机器人导航决策方法,其特征在于,所述S1步骤包括:S11,图像数据获取:利用安装在机器人的摄像头和图像传感器获取机器人周围环境的实时图像数据;S12,图像去噪处理:采用高斯滤波器对获取的图像数据进行去噪处理;S13,图像灰度化处理:使用加权平均法将去噪后的图像数据进行灰度化处理,将彩色图像转换为灰度图像;S14,边缘检测处理:采用Canny边缘检测算法对灰度化后的图像进行边缘检测,提取图像中的边缘信息。
3.根据权利要求1所述的基于目标识别的机器人导航决策方法,其特征在于,所述S2步骤包括:S21,目标识别:采用卷积神经网络模型对预处理后的图像数据进行目标识别,识别出环境中的目标物体,包括障碍物、目标点和导航标志;S22,特征提取:从识别出的目标物体中提取特征信息,包括目标物体的形状、大小、位置和运动状态,具体包括:S221,形状特征提取:利用Canny边缘检测算法提取目标物体的轮廓和边缘,计算形状特征,包括周长、面积和轮廓近似多边形;S222,大小特征提取:计算目标物体的边界框,得到其宽度、高度和面积;S223,位置特征提取:确定目标物体在图像中的位置,计算其质心坐标;S224,运动状态特征提取:通过连续多帧图像数据计算目标物体的运动轨迹和速度,利用光流算法估计目标物体的运动矢量。
4.根据权利要求3所述的基于目标识别的机器人导航决策方法,其特征在于,步骤S3步骤具体包括:S31,特征信息整合:将从目标识别和特征提取中获得的目标物体的特征信息进行整合;S32,环境模型构建:基于整合的特征信息,采用栅格地图的方法构建栅格环境模型;所述栅格地图将环境划分为若干栅格,每个栅格包含一个概率值,表示对应区域被占据的可能性,利用目标物体的位置和大小信息更新栅格的占据概率,生成包含目标物体的栅格地图;栅格环境模型的数学公式为: ;其中, 是第 个栅格被占据的概率, 是栅格的对数几率, 为从时间1到 的传感器测量值;S33,环境地图生成:将构建的环境模型转换为环境地图。
5.根据权利要求4所述的基于目标识别的机器人导航决策方法,其特征在于,所述S4步骤包括:S41,规划路径:基于构建的栅格环境模型,采用A*算法计算机器人从当前位置到目标点的最优路径;S42,路径优化:在路径规划过程中,考虑机器人尺寸和运动能力,使用样条插值方法对路径进行平滑处理,计算公式为: ;其中, 为平滑路径上的点, 为控制点, 为参数。
6.根据权利要求1所述的基于目标识别的机器人导航决策方法,其特征在于,所述S51步骤包括:S511,生成器计算公式为: ;其中, 为随机噪声, 为环境特征向量, 为路径约束, 为生成器的权重矩阵, 为第一偏置, 为激活函数, 表示生成器;S512,判别器计算公式为: ;其中, 为输入路径, 为环境特征向量, 为多尺度特征, 为判别器的权重矩阵, 为第二偏置, 为激活函数;S513,生成对抗训练中,判别器的损失函数为: ;其中, 为真实路径数据, 为环境特征向量, 为多尺度特征, 为真实路径数据的概率分布, 为环境特征的概率分布, 为多尺度特征的概率分布;S514,路径生成与评估:路径生成:生成器输入随机噪声、环境特征和路径约束,生成潜在路径,计算公式为: ;路径评估:判别器输入生成的路径、环境特征和多尺度特征,输出路径的可行性评分,计算公式为: ;真实路径评估:判别器输入真实路径、环境特征和多尺度特征,输出真实路径的可行性评分,计算公式为: 。
7.根据权利要求6所述的基于目标识别的机器人导航决策方法,其特征在于,所述S52步骤包括:S521,路径评分排序:对所有生成的潜在路径 的可行性评分 进行排序,得到按评分降序排列的路径列表 ,对应的 ,计算公式为: ;其中, 为判别器对路径 的可行性评分, 为环境特征向量, 为多尺度特征;S522,选择最佳路径:从排序后的路径列表中选择可行性评分最高的路径 作为当前导航路径,计算公式为: ;其中, 为可行性评分最高的路径, 为其对应的评分。
8.根据权利要求7所述的基于目标识别的机器人导航决策方法,其特征在于,所述S53步骤包括:S531,环境变化监控:利用摄像头和传感器实时获取机器人周围环境的最新图像数据和传感器数据,更新环境特征向量 ,计算公式为: ;其中, 和 分别为最新的图像数据和传感器数据, 为环境特征提取函数;S532,路径再生成:生成器输入随机噪声 、更新后的环境特征向量 和路径约束 ,生成新的潜在路径 ,计算公式为: ;其中, 为生成器函数, 为生成器的权重矩阵, 为第一偏置, 为激活函数;S533,路径再评估:判别器输入新的潜在路径 、更新后的环境特征向量 和多尺度特征 ,输出新的路径可行性评分 ,计算公式为: ;其中, 为判别器函数, 为判别器的权重矩阵, 为第二偏置, 为激活函数;S534,路径选择与切换:根据新的路径可行性评分 ,选择可行性评分最高的路径 作为当前导航路径,实时切换机器人导航路径,计算公式为: 。
9.根据权利要求8所述的基于目标识别的机器人导航决策方法,其特征在于,所述S6步骤包括:S61,导航决策:根据路径预测与修正的结果,结合机器人当前的位置、速度和方向,生成导航指令,指导机器人进行实时导航,具体包括:S611,路径信息获取:从路径修正中获取当前选定的最佳路径 ;S612,状态信息更新:实时获取机器人的当前位置 、速度 和方向 ,计算公式为: ;S613,导航指令生成:根据最佳路径 和机器人的当前状态,使用模型预测控制算法生成导航指令 ,指导机器人进行实时导航,计算公式为: ;其中, 为控制输入, 和 为权重矩阵, 为欧几里得距离, 表示时刻,T是导航总时间;S62,动态调整:在机器人导航过程中,实时监测环境变化和机器人的状态变化,动态调整导航决策。
10.根据权利要求9所述的基于目标识别的机器人导航决策方法,其特征在于,所述S7步骤包括:S71,反馈机制:通过实时获取的图像数据和导航结果,建立反馈机制,以不断优化目标识别和导航决策,具体包括:S711,实时数据获取:利用摄像头和传感器实时获取机器人导航过程中的图像数据和传感器数据;S712,导航结果记录:记录机器人导航过程中的路径选择、避障情况和导航效果,包括实际路径 、避障点 和到达目标的时间 ;S713,数据反馈:对实时获取的图像数据、传感器数据和导航结果进行反馈,计算公式为: ;其中, 是实时图像数据, 是实时传感器数据, 是导航结果;S72,目标识别优化:根据反馈机制的结果,采用在线学习算法更新卷积神经网络模型的权重,计算公式为: ;其中, 为模型参数, 为学习率, 为损失函数, 是梯度计算;S73,导航决策优化:根据反馈机制的结果,利用强化学习算法更新导航策略,计算公式为: ;其中, 为当前状态, 为动作,s' 为下一时刻状态,a' 为下一时刻动作, 为即时奖励, 为折扣因子, 为学习率。



