首页 期刊 计算机工程与设计 加权平均Word2Vec实体对齐方法 【正文】

加权平均Word2Vec实体对齐方法

作者:罗钰敏; 刘丹; 尹凯; 赵宏森 电子科技大学电子科学技术研究院; 四川成都611731
词嵌入   命名实体识别   中文组织机构名   实体对齐   词向量  

摘要:针对已有文本相似度计算方法应用在实体对齐上准确率低的问题,提出一种加权平均Word2Vec的实体对齐方法。利用Word2Vec训练文本,得到词向量模型;使用LTP(language technology platform)工具抽取文本中的命名实体并对其进行分词、去停用词处理,由Word2Vec得到处理后的词向量;根据分词后出现相同词的情况进行加权归一,得到各实体的特征向量;利用特征向量计算余弦相似度得到对齐结果。实验结果表明,与已有的文本相似度方法及未改进的Word2Vec方法对比,所提方法降低了实体对齐的漏检率,提高了准确性。

注:因版权方要求,不能公开全文,如需全文,请咨询杂志社

学术咨询 免费咨询 杂志订阅