有效

语音识别模型的训练方法、装置、设备以及存储介质

叶万余、江嘉铭、阮国恒、钟业荣、阮伟聪、彭泽武、陈韵、余恒奇、郭惜
广东电网有限责任公司

摘要

本发明公开了一种语音识别模型的训练方法、装置、设备以及存储介质,属于计算机技术领域。该方法包括:将样本语音特征输入至初始模型的编码网络,得到声学编码特征,并根据所述声学编码特征和样本语音特征的特征监督数据,确定编码损失;将所述声学编码特征输入至所述初始模型的解码网络,得到语音识别内容,并根据所述语音识别内容、样本语音特征的内容监督数据、以及所述声学编码特征,确定识别损失;根据所述编码损失和所述识别损失,确定所述初始模型的总损失;根据所述总损失,对所述初始模型进行训练,得到目标语音识别模型。通过上述技术方案,实现利用训练数据的文本信息直接训练端到端的模型。