2026年数据科学与数据分析考试数据挖掘方法与技术.docxVIP

  • 1
  • 0
  • 约3.82千字
  • 约 12页
  • 2026-08-14 发布于福建
  • 举报

2026年数据科学与数据分析考试数据挖掘方法与技术.docx

第PAGE页共NUMPAGES页

2026年数据科学与数据分析考试数据挖掘方法与技术

一、单选题(共10题,每题2分,合计20分)

1.在数据挖掘过程中,以下哪项不属于数据预处理阶段的主要任务?

A.数据清洗

B.数据集成

C.特征工程

D.模型评估

答案:C

解析:数据预处理包括数据清洗(处理缺失值、异常值)、数据集成(合并多个数据源)、数据变换(特征缩放、规范化)等,而特征工程属于数据挖掘的建模阶段,不属于预处理范畴。

2.以下哪种算法属于无监督学习算法?

A.决策树

B.神经网络

C.K-Means聚类

D.支持向量机

答案:C

解析:K-Means聚类是一种典型的无监督学习算法,用于将数据点划分为不同的簇。决策树、神经网络、支持向量机均属于监督学习算法。

3.在处理高维数据时,以下哪种方法可以有效降低维度并保留重要信息?

A.主成分分析(PCA)

B.线性回归

C.决策树

D.逻辑回归

答案:A

解析:主成分分析(PCA)通过线性变换将高维数据投影到低维空间,同时保留大部分方差信息。线性回归、决策树、逻辑回归主要用于预测任务,不涉及维度降低。

4.在关联规则挖掘中,常用的评价指标是?

A.准确率

B.提升度(Lift)

C.召回率

D.F1分数

答案:B

解析:提升度(Lift)用于衡量规则A→B的预测能力是否高于随机猜

文档评论(0)

1亿VIP精品文档

相关文档