- 406
- 0
- 约4.4万字
- 约 11页
- 2019-02-07 发布于天津
- 举报
文本相似度计算方法研究综述.PDF
总第6 期 2017 年 第6 期
文本相似度计算方法研究综述
陈二静 1,2 姜恩波 1
1( 中国科学院成都文献情报中心 成都 610041)
2( 中国科学院大学 北京 100049)
摘要: 【目的 】分析文本相似度计算方法, 了解该领域的发展态势。【文献范围】在CNKI 和Web of Science 中
分别以检索式“篇名: 文本相似度 OR 篇名: 词汇相似度 OR 篇名: 语义相似度”和“TI: ‘text similarity’ or
‘semantic similarity’ or ‘lexical similarity’ ”并限定文献类型进行检索, 最终得到69 篇重点文献。【方法】对文本相
似度计算方法进行系统梳理, 分析重点方法的基本思想、特点并总结未来发展方向。【结果】形成了较为全面的
分类描述体系, 文本相似度计算方法可分为4 类: 基于字符串的方法、基于语料库的方法、基于世界知识的方法
和其他方法。其中, 基于神经网络和基于世界知识的方法以及针对跨领域文本的相似度计算将成为该领域的发
展趋势。【局限】仅将不同方法本身作为探讨的核心, 未进一
原创力文档

文档评论(0)