有效

一种基于实体替换的语音数据增强方法

汤闻易、刘泽原、丁辉、王菡、王硕、李恒辉
中国电子科技集团公司第二十八研究所

摘要

本发明提供了一种基于实体替换的语音数据增强方法,包括:构建语音识别模型,获取语音样本并进行标注,得到带标注的语音;根据语音样本和标注构建关注实体集合;根据语音识别模型和关注实体集合,构建实体定位模型,用于寻找带标注语音中每个实体的起止时刻,输出全部起止时候集合;采用关注实体集合中同类实体替换文本中的实体,并根据起止时刻替换对应语音数据,形成新的带标注语音集合;将新的带标注语音集合与原先的带标注语音集合合并,形成新的语音识别训练样本集合。本发明可用于带标注语音的数据扩增,通过结合实体定位和实体替换方法,实现了语音识别训练样本的数据增强,提高了语音识别训练数据的规模。