- 2
- 0
- 约1.26万字
- 约 29页
- 2026-08-05 发布于上海
- 举报
搜索论试卷及分析
一、单项选择题(共10题,每题1分,共10分)
在信息检索领域,以下哪个模型是建立在概率论基础之上,旨在计算文档与查询相关的概率?
A.布尔模型
B.向量空间模型
C.概率检索模型
D.语言模型
答案:C
解析:概率检索模型(如经典的二元独立模型BIR)是建立在概率论基础上的,其核心思想是通过计算文档与查询相关的概率来进行排序。布尔模型是基于逻辑运算的精确匹配模型,向量空间模型是基于向量相似度的代数模型,语言模型则是基于统计语言学的模型,虽然也涉及概率,但其核心思想与经典的概率检索模型不同。
关于“查准率”和“查全率”的关系,下列描述最准确的是?
A.在同一个检索系统中,查准率和查全率总是可以同时提高
B.查准率与查全率之间通常存在此消彼长的关系
C.查全率是衡量检索系统返回结果相关性的指标
D.查准率是衡量检索系统找到所有相关文档能力的指标
答案:B
解析:查准率(Precision)指返回结果中相关文档的比例,查全率(Recall)指所有相关文档中被检索出来的比例。由于检索系统通常通过调整阈值来平衡二者,例如,降低阈值以返回更多文档可以提高查全率,但可能引入更多不相关结果从而降低查准率,因此二者通常存在权衡关系。选项C和D混淆了两个指标的定义,选项A的表述过于绝对且不符合实际情况。
在构建倒排索引时,以下哪个步骤通常不是必需的?
A.文档解析
原创力文档

文档评论(0)