失效
一种基于课程学习的强化学习知识图谱推理方法
摘要
本发明公开了一种基于课程学习的强化学习知识图谱推理方法。该发明针对在实体关系补全过程中出现的错误关系难题,深入研究基于课程学习的强化学习模型来解决虚假路径发现问题,即智能体游走得到的训练序列(路径)不完美导致智能体被误导,提出了一种结合课程学习策略使用基于知识的软奖励方法,该方法将智能体在环境中游走得到的路径映射到LSTM策略网络,再使用实体和关系嵌入作为参数组成的打分函数进行软奖励构造,同时在路径中多次跳转上采用智能体的动作丢弃策略进行出边的随机掩盖,最终实现较为准确的实体关系路径学习。
暂无引用专利





