搜索论试卷及分析.docxVIP

  • 2
  • 0
  • 约1.26万字
  • 约 29页
  • 2026-08-05 发布于上海
  • 举报

搜索论试卷及分析

一、单项选择题(共10题,每题1分,共10分)

在信息检索领域,以下哪个模型是建立在概率论基础之上,旨在计算文档与查询相关的概率?

A.布尔模型

B.向量空间模型

C.概率检索模型

D.语言模型

答案:C

解析:概率检索模型(如经典的二元独立模型BIR)是建立在概率论基础上的,其核心思想是通过计算文档与查询相关的概率来进行排序。布尔模型是基于逻辑运算的精确匹配模型,向量空间模型是基于向量相似度的代数模型,语言模型则是基于统计语言学的模型,虽然也涉及概率,但其核心思想与经典的概率检索模型不同。

关于“查准率”和“查全率”的关系,下列描述最准确的是?

A.在同一个检索系统中,查准率和查全率总是可以同时提高

B.查准率与查全率之间通常存在此消彼长的关系

C.查全率是衡量检索系统返回结果相关性的指标

D.查准率是衡量检索系统找到所有相关文档能力的指标

答案:B

解析:查准率(Precision)指返回结果中相关文档的比例,查全率(Recall)指所有相关文档中被检索出来的比例。由于检索系统通常通过调整阈值来平衡二者,例如,降低阈值以返回更多文档可以提高查全率,但可能引入更多不相关结果从而降低查准率,因此二者通常存在权衡关系。选项C和D混淆了两个指标的定义,选项A的表述过于绝对且不符合实际情况。

在构建倒排索引时,以下哪个步骤通常不是必需的?

A.文档解析

文档评论(0)

1亿VIP精品文档

相关文档