基于多策略融合的专利术语自动抽取-计算机应用与软件.PDFVIP

  • 5
  • 0
  • 约2.42万字
  • 约 5页
  • 2018-11-26 发布于天津
  • 举报

基于多策略融合的专利术语自动抽取-计算机应用与软件.PDF

基于多策略融合的专利术语自动抽取-计算机应用与软件

第32卷第2期    计算机应用与软件 Vol32No.2 2015年2月   ComputerApplicationsandSoftware Feb.2015 基于多策略融合的专利术语自动抽取 周绍钧 吕学强 李 卓 都云程 (北京信息科技大学网络文化与数字传播北京市重点实验室 北京 100101) 摘 要  专利术语自动抽取是知识抽取与文本挖掘的关键环节。在构建专利文献停用词表以及提取特定规则的基础上,抽取候 选专利术语;通过分析专利术语与其所在句子的关联关系、相邻专利术语之间的影响以及常识性词语对专利术语抽取的干扰,分别 提出基于PageRank思想的STRank权重计算方法、专利术语区别度计算方法以及知网义原信息降权方法,并融合上述方法对专利术 语进行抽取。采用传感器领域的专利文献进行实验,在top1400、top1600级别上正确率为80.5%、79.7%,相对比CS+CC+CD方

文档评论(0)

1亿VIP精品文档

相关文档