2025-2026年大数据挖掘技术模拟试卷.docxVIP

  • 1
  • 0
  • 约7.95千字
  • 约 19页
  • 2026-09-28 发布于山东
  • 举报

2025-2026年大数据挖掘技术模拟试卷

一、单选题(本大题共10小题,每小题2分,共20分)

1.在大数据挖掘技术中,下列哪种算法通常用于处理高维稀疏数据且具有较好的可解释性?()

A.支持向量机(SVM)

B.K-近邻算法(KNN)

C.决策树

D.神经网络

2.以下哪个指标最适合用于评估聚类算法的聚类效果,尤其是在数据分布不均匀的情况下?()

A.准确率(Accuracy)

B.F1分数(F1-Score)

C.轮廓系数(SilhouetteCoefficient)

D.AUC(AreaUnderCurve)

3.在进行关联规则挖掘时,提升度(Lift)指标主要用于衡量什么?()

A.两个项集之间的统计显著性

B.一个项集对另一个项集的预测能力

C.两个项集同时出现的概率

D.两个项集之间的相关强度

4.以下哪种数据预处理技术最适合用于处理缺失值,尤其是在数据量较大的情况下?()

A.插值法

B.删除法

C.回归填充

D.K最近邻填充

5.在特征选择过程中,递归特征消除(RFE)算法的核心思想是什么?()

A.基于模型的特征重要性排序

B.基于统计检验的特征显著性评估

C.基于信息增益的

文档评论(0)

1亿VIP精品文档

相关文档