1.针对结构化信息的基于语义分析的问答方法,其特征在于,所述方法包括:S1、接收结构化数据,对结构化数据进行预处理,将预处理后数据存储进数据库;所述预处理包括确定所述结构化数据的主题、主题属性及数据合并;所述主题对应传统数据库系统中的表;S2、对预处理后数据进行标注,形成标注数据,基于标注数据训练语义分析模型;接收用户问句,输入所述语义分析模型,获得输出答案;S3、基于标注数据训练语义判断模型;语义判断模型接收所述输出答案,生成查询语句;S4、基于所述查询语句,查询并输出精准答案;所述语义分析模型中,由6个级联的编码器构对输入数据进行编码,形成编码信息;所述编码信息同时分别输入6个级联的解码器,同时,上一级解码器将处理后数据输入下一级解码器中,由最后一级解码器输出所述语义分析模型的输出答案;其中,所述编码器的输入矩阵维度与输出矩阵维度相同;所述语义判断模型为:以多头自注意力层作为模型的输入层,多头自注意力层连接第一残差连接层,模型的输入数据同时输入多头自注意力层、第一残差连接层;第一残差连接层依次连接前向传播层、第二残差连接层,第一残差连接层的输出同时输入前向传播层、第二残差连接层;第二残差连接层的输出通过一个全连接层,映射到一个有两节点的输出层,该输出层的输出数据通过softmax函数转换为概率分布,以进行二分类;所述S3中,生成查询语句进一步包括:S31、主题解析:中文属性名为语义分析模型解析出的主题,将中文主题名转换为英文主题名,并且判断是否存在相应主题数据,如不存在相应主题数据则结束流程;S32、属性解析:属性解析包括属性名解析和属性值解析;属性名解析是将语义分析模型结果中的中文属性名转换为英文属性名,如果对应主题下不存在相应属性,则结束流程;在属性名解析后,进行对应的属性值解析;S33、聚合类型、条件和关系解析:将语义分析模型生成的聚合类型、条件和关系解析为对应信息系统数据库系统的查询关键字;S34、生成查询语句:结合解析后的主题、属性以及解析后的聚合类型、条件和关系按实际数据库系统的语法规则生成查询语句。
2.根据权利要求1所述的方法,其特征在于,所述S2中接收用户问句后进一步包括:S21、获取用户问句中每个单词的表示向量X,所述表示向量X包括单词向量和单词位置向量;S22、将所述表示向量X输入所述语义分析模型中的编码器,得到编码信息矩阵C;S23、编码信息矩阵C发送至所述语义分析模型中的6个相互级联的解码器中,解码器依据当前已翻译的单词预测下一个单词,直至生成完整的输出答案。
3.根据权利要求2所述的方法,其特征在于,所述单词位置向量的计算方式为: ; ;其中,pos表示单词在句子中的位置,d model 表示单词位置向量的总维度,2i表示偶数维度,2i+1表示奇数维度,i表示单词是序列中的第i个位置。
4.根据权利要求2所述的方法,其特征在于,所述编码器引入自注意力计算,以对编码器的输入进行加权处理,所述自注意力计算的方式为: ;其中,Q为查询矩阵,K为键矩阵、V为值矩阵,d K 表示键向量的维度。
5.根据权利要求4所述的方法,其特征在于,所述解码器基于输入数据计算查询矩阵Q,将其与键矩阵K进行相似度计算,再通过softmax函数进行归一化,得到注意力权重;所述注意力权重用于对编码信息矩阵C进行加权求和,以实现对下一单词的预测,直至生成完整的输出答案。
6.根据权利要求1所述的方法,其特征在于,所述S2中,训练语义分析模型中,损失函数为: ;其中,y表示真实标签,p表示模型生成的预测概率,n表示类别的数量,y i 表示真实标签的第i个类别的概率,p i 表示模型生成的预测概率的第i个类别。
7.针对结构化信息的基于语义分析的问答系统,其特征在于,所述系统包括:数据处理模块,用于接收结构化数据,对结构化数据进行预处理,将预处理后数据存储进数据库;所述预处理包括确定所述结构化数据的主题、主题属性及数据合并;所述主题对应传统数据库系统中的表;数据标注模块,用于对预处理后数据进行标注,形成标注数据;语义分析模块,用于接收用户问句,获得输出答案;语义判断模块,用于接收所述输出答案,生成查询语句;查询模块,用于基于查询语句,查询并输出精准答案;数据库,用于存储历史数据及中间数据;所述语义分析模块中,由6个级联的编码器构对输入数据进行编码,形成编码信息;所述编码信息同时分别输入6个级联的解码器,同时,上一级解码器将处理后数据输入下一级解码器中,由最后一级解码器输出语义分析模型的输出答案;其中,所述编码器的输入矩阵维度与输出矩阵维度相同;所述语义判断模块设置为:以多头自注意力层作为模型的输入层,多头自注意力层连接第一残差连接层,模型的输入数据同时输入多头自注意力层、第一残差连接层;第一残差连接层依次连接前向传播层、第二残差连接层,第一残差连接层的输出同时输入前向传播层、第二残差连接层;第二残差连接层的输出通过一个全连接层,映射到一个有两节点的输出层,该输出层的输出数据通过softmax函数转换为概率分布,以进行二分类;所述语义判断模块中,生成查询语句的过程进一步包括:S31、主题解析:中文属性名为语义分析模型解析出的主题,将中文主题名转换为英文主题名,并且判断是否存在相应主题数据,如不存在相应主题数据则结束流程;S32、属性解析:属性解析包括属性名解析和属性值解析;属性名解析是将语义分析模型结果中的中文属性名转换为英文属性名,如果对应主题下不存在相应属性,则结束流程;在属性名解析后,进行对应的属性值解析;S33、聚合类型、条件和关系解析:将语义分析模型生成的聚合类型、条件和关系解析为对应数据库系统的查询关键字;S34、生成查询语句:结合解析后的主题、属性以及解析后的聚合类型、条件和关系按数据库系统的语法规则生成查询语句。
8.针对结构化信息的基于语义分析的问答设备,其特征在于,所述设备包括处理器、存储器,所述处理器调用存储器中的指令,以执行权利要求1-6任一所述的针对结构化信息的基于语义分析的问答方法。