1.一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述方法包括:从视频中提取音频部分;截取音频中第一频段的音频特征,并计算获取音频能量分布;将音频能量按区间划分,并建立恐慌行为音频特征识别矩阵模型;根据音频特征识别矩阵模型判定音频中的行为类型及性别。
2.根据权利要求1所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述第一频段为0-750Hz频段。
3.根据权利要求1所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述截取音频中第一频段的音频特征并计算音频能量分布的过程包括:对音频数据进行傅里叶变换,获取音频信号的波形与频谱;从音频信号的频谱中截取第一频段的音频特征;对第一频段的音频能量进行归一化处理,计算音频能量分布。
4.根据权利要求1所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述音频能量按区间划分的过程包括:获取恐慌行人尖叫行为音频数据集;随机选取数据集中男性恐慌行为音频和女性恐慌行为音频,分析第一频段音频的能量分布;绘制男性恐慌行为音频和女性恐慌行为音频能量正态分布拟合图,计算能量均值与能量标准差;结合不同性别的音频能量正态分布拟合图、能量均值与能量标准差,对音频能量进行区间划分。
5.根据权利要求4所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述音频能量的划分区间包括:[0,0.009]、[0.009,0.053]、[0.053,0.076]、[0.076,0.172]、[0.172,0.178]、[0.178,0.206]、[0.206,0.634]和[0.634,1]。
6.根据权利要求1所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述恐慌行为音频特征识别矩阵模型的建立过程包括:截取音频中的一帧,并计算此帧音频在第一频段的能量值;归一化处理音频能量值;将归一化处理后的音频能量值归入对应划分区间中,并将对应划分区间置1;重复上述步骤,逐帧处理完整音频,最终建立恐慌行为音频特征识别矩阵模型。
7.根据权利要求1所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述恐慌行为音频特征识别矩阵模型的表达式为:其中,C 1 、C 2 、C 3 、C 4 、C 5 、C 6 、C 7 、C 8 为音频能量的划分区间。
8.根据权利要求7所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,所述C 1 、C 3 和C 5 为恐慌行为但性别区分模糊音频的划分区间,C 2 为女性恐慌行为音频的划分区间,C 4 为男性恐慌行为音频的划分区间,C 6 和C 8 为无法区分行为音频的划分区间,C 7 为正常交流行为音频的划分区间。
9.根据权利要求7所述的一种恐慌行人尖叫行为音频特征识别方法,其特征在于,根据音频特征识别矩阵模型中音频能量主要集中落入的划分区间类型,判断音频中的行为类型及性别。
10.一种电子装置,其特征在于,包括:一个或多个处理器;存储器;被存储在存储器中的一个或多个程序,所述一个或多个程序包括用于执行如权利要求1-9任一所述恐慌行人尖叫行为音频特征识别方法的指令。