从SIGIR看信息检索技术的海南大学.pptVIP

  • 8
  • 0
  • 约1.1万字
  • 约 29页
  • 2022-03-17 发布于重庆
  • 举报
在这过去的三十年里,人们从最初开始探讨什么是信息检索,尝试设计信息检索系统的基本体系架构,研究应该如何高效地存储文档,如何判断文档与用户查询的相似性等最基本的问题开始,到在互联网上帮助人们进行信息查找的搜索引擎的出现并得到广泛应用,再到后来更多更高级更深层次的技术的提出,直到今天,人们开始感慨“搜索无处不在”,开始讨论什么是“下一代搜索引擎”。 三十年的时间里,我们都做了些什么?有哪些问题是研究者们所一直关注着的问题?又有哪些问题经过历史的发展已经渐渐被人们遗忘和冷落?有哪些是随着社会和技术的进步所提出的新的课题? 从最初起,信息检索的系统设计就是沿着两条路来走的:一是借鉴结构化数据处理的基础和知识,借助数据库等已较为成熟的技术来实现文档的全文检索;二是不拘泥于已有的技术思路,而从文档本身的特点出发,设计并实现专门用于信息检索的体系结构。 在开始的十年里,在这两条道路上不同的研究者们都分别进行了充分地尝试,研究并设计出了不同的信息检索体系结构。可以说,这时面向结构化数据的信息检索还占据了相当重要的地位。 但是当我们把目光转入90年代之后,就会发现与结构化数据存储和检索相关的研究在人们的视线中只是偶尔出现了。 直到进入2000年,这条分支似乎又有所复苏 —— 但是事实上,与二十年前相比,人们已经转变了思路,或者说开辟了一条新的道路——基于以xml为代表的半结构化数据的检索。于是,最

文档评论(0)

1亿VIP精品文档

相关文档