2026年数据挖掘工程师考核题库附答案.docxVIP

  • 1
  • 0
  • 约5.19千字
  • 约 15页
  • 2026-10-10 发布于四川
  • 举报

2026年数据挖掘工程师考核题库附答案.docx

2026年数据挖掘工程师考核题库附答案

一、单项选择题(每题2分,共40分)

1.以下哪种方法用于处理数据集中缺失值,且能保留样本数量?

A.删除含有缺失值的记录

B.用均值填充

C.删除缺失值所在列

D.直接忽略缺失值

答案:B

解析:均值填充可保留样本数量,但可能引入偏差;删除记录会丢失信息,直接忽略可能导致后续算法出错。

2.在决策树算法中,ID3算法选择分裂属性的依据是?

A.信息增益

B.增益率

C.基尼指数

D.均方误差

答案:A

解析:ID3使用信息增益,C4.5使用增益率,CART分类树使用基尼指数。

3.K-Means聚类算法中,K值的选择通常不依赖于?

A.肘部法则

B.轮廓系数

C.业务需求

D.样本数量

答案:D

解析:K值主要依据聚类质量指标(肘部法则、轮廓系数)或业务经验确定,样本数量影响计算量但不直接决定K值。

4.在逻辑回归中,输出值经过什么函数映射到[0

A.Sigmoid

B.ReLU

C.Tanh

D.Softmax

答案:A

解析:逻辑回归使用Sigmoid函数f(

5.以下哪个指标不适合用于评估不平衡数据集的分类模型?

A.准确率

B.召回率

C.F1分数

D.AUC

答案:A

解析:不平衡数据中多数类占比高,准确率可能虚高,不能反映少数类的识别能力,应使

文档评论(0)

1亿VIP精品文档

相关文档