在审

一种多说话人的语音分离识别方法、装置、终端设备及存储介质

刘振华、李紫京、杨英勃、王帅、陶飞达、谭火超、陈宋、彭若馨、伍广斌、张立慧、叶枝平、李静、皮伟丰、简冬琳、熊樱
广东电网有限责任公司供电服务中心
刘振华 专利 112
广东电网有限责任公司供电服务中心
自然语言处理数据存储检索电子数据处理
李紫京 专利 35
广东电网有限责任公司供电服务中心
自然语言处理计算技术物理仪器
杨英勃 专利 42
广东电网有限责任公司佛山供电局
物理仪器计算技术语音识别
王帅 专利 59
广东电网有限责任公司供电服务中心
计算技术物理仪器自然语言处理
陶飞达 专利 66
广东电网有限责任公司河源供电局
物理仪器计算技术电子数据处理
谭火超 专利 65
广东电网有限责任公司供电服务中心
电子数据处理计算技术物理仪器
陈宋 专利 39
广东电网有限责任公司
物理仪器计算技术语音识别
彭若馨 专利 20
广东电网有限责任公司供电服务中心
物理仪器语音识别语音音频处理
伍广斌 专利 45
广东电网有限责任公司供电服务中心
计算技术物理仪器商业
张立慧 专利 21
广东电网有限责任公司供电服务中心
计算技术物理仪器电子数据处理
叶枝平 专利 22
广东电网有限责任公司供电服务中心
自然语言处理计算技术物理仪器
李静 专利 56
广东电网有限责任公司供电服务中心
物理仪器躯体约束计算技术
皮伟丰 专利 13
广东电网有限责任公司供电服务中心
物理仪器计算技术数据存储检索
简冬琳 专利 22
广东电网有限责任公司
物理仪器计算技术语音识别
熊樱 专利 8
广东电网有限责任公司供电服务中心
物理仪器计算技术电子数据处理

摘要

本发明公开了一种多说话人的语音分离识别方法、装置、终端设备及存储介质,上述方法包括:获取待分离识别的多说话人语音信号,输入至预设语音分离识别模型提取出语音特征,并根据语音特征将多说话人语音信号进行分离,得到若干单人语音信号;然后将单人语音信号以及语音特征输入至预设语音分离识别模型中的语音文本识别模型,识别出单人语音信号中,每一语音帧所对应的文本字符的概率分布,并根据WFST算法对进行加权计算,得到每一单人语音信号的文本信息;最后根据单人语音信号以及对应的文本信息,得到多说话人语音信号的分离识别结果。通过实施本发明,可以对含有多说话人的混合语音信号,进行分离和识别。

暂无引用专利