有效

目标对象语音的获取方法、装置、设备及可读存储介质

马征、王玮犀、杨柳、郝莉、向吴优、郑佳雯
西南交通大学

摘要

本发明提供了目标对象语音的获取方法、装置、设备及可读存储介质,所述方法包括:获取混合语音数据,所述混合语音数据由多个对象的语音混合而成,多个所述对象中包含所述目标对象;基于卷积神经网络模型框架,对时域音频分离网络进行优化,得到优化后的时域音频分离网络;基于排列问题算法,利用所述优化后的时域音频分离网络对所述混合语音数据进行处理,得到只包含所述目标对象语音的语音数据。在本发明中,优化后的TasNet神经网络框架的语音分离具有一定的鲁棒性,适用于普遍的情况。此外,提出的基于排列问题的语音分离算法,可以解决嘈杂环境下分离出目标人声的问题,在时间效率上相较于原始的TasNet框架得到了较大的提升。

暂无引用专利