外文检索系统的构造.docxVIP

  • 3
  • 0
  • 约2.34万字
  • 约 25页
  • 2019-07-03 发布于广东
  • 举报
外文检索系统的构造 摘要: 木文要求将150篇学术论文按关键词分类,并构造一个检索系统,使得当给 岀一组关键词吋,可以找到所要查找的文献。这个问题中,容易的地方是检索, 难点是找到一个好的分类方法。我们对问题进行了全面细致的分析,给出检索系 统的几个要求,假设论文唯一且均为英语论文,再从三个角度(关键字的涵义、 关键字的首字母、关键字的长度)建立模型将论文分类,并对这三种模型进行了 随机检验(任意输入一个单词检验正确率)和全面的比较(包括时间复杂性和适 用范围): 模型一仿照人的认识,通过构造一个人工智能将论文分类。分类的标准是关 键字出现的次数,次数越多说明其为一个类别的总概括,我们认为它是一个父类, 如此得到40类。该模型优点是从语义、逻辑关系上将关键字分类,符合人们的 日常认识。缺点是时间复杂性很高,大概为需要的时间为巴,编写的程序繁琐。 n 模型二将26个字母自成26类,相应首字母的关键字归为此类。。如果每一 类中的关键字还是很多,可以将每一类继续按字母分为26类。根据用户输入单 词的首字母确定第儿大类,再根据后面的字母确定相关论文。这样可分出26类, 其中每类至多可再分26类。 此模型优点是时间复杂性只有敗左右,使检索非常快捷。 n 模型三与模型二类似,只是将按字母分类改为按关键字的长度分类。其优点 也是时间复杂性低,只有虫 n 然后我们提出了三点改进的地方,并针对第一点

文档评论(0)

1亿VIP精品文档

相关文档