国内刊号:31-1289/TP
国际刊号:1000-3428
发布日期:
作者:李世宝, 李贺, 赵庆帅, 殷乐乐, 刘建航, 黄庭培
单位:中国石油大学(华东) 海洋与空间信息学院, 山东 青岛 266580
关键词:中文文本蕴含,自然语言推理,注意力机制,双向长短期记忆网络,知网,词林
基金:国家自然科学基金(61972417,61872385);中央高校基本科研业务费专项资金(18CX02134A,19CX05003A-4,18CX02137A)。
基于神经网络的文本蕴含识别模型通常仅从训练数据中学习推理知识,导致模型泛化能力较弱。提出一种融合外部语义知识的中文知识增强推理模型(CKEIM)。根据知网知识库的特点提取词级语义知识特征以构建注意力权重矩阵,同时从同义词词林知识库中选取词语相似度特征和上下位特征组成特征向量,并将注意力权重矩阵、特征向量与编码后的文本向量相结合融入神经网络的模型训练过程,实现中文文本蕴含的增强识别。实验结果表明,与增强序列推理模型相比,CKEIM在15%、50%和100%数据规模的CNLI训练集下识别准确率分别提升了3.7%、1.5%和0.9%,具有更好的中文文本蕴含识别性能和泛化能力。
来源:2021年第1期
《计算机工程》期刊编辑部