在审

基于自然语言表示学习的语义检索方法、装置和终端设备

苏立伟、陶飞达、刘振华、康峰、谭火超、廖鹏、曹彦朝、杨秋勇、李庭磊、苏林峰、李波、李凯、叶枝平、舒畅、杨骐铭
广东电网有限责任公司

摘要

本发明公开了一种基于自然语言表示学习的语义检索方法、装置和终端设备,所述方法包括:获取待检索文本;将待检索文本输入到预设的编码模型中,以使编码模型根据所述待检索文本,生成对应的语义向量;计算语义向量与预设数据集中的各个文本分别对应的相似度,并将最高相似度对应的文本作为检索结果。而编码模型的训练,是通过对比学习目标和去噪学习目标对编码器和解码器进行分别训练,并通过解码器将从噪声数据和原始数据中提取出的语义特征,作为编码器进行对比学习的监督信号,使得编码器的监督信号来源于样本数据内的语义,从而可以使得编码器能够更好地理解文本的语义,则通过本发明的编码器,可以进一步提高语义检索的准确性。

暂无引用专利