数据挖掘与大数据分析技能测试题库及答案.docxVIP

  • 1
  • 0
  • 约1.04万字
  • 约 24页
  • 2026-09-07 发布于未知
  • 举报

数据挖掘与大数据分析技能测试题库及答案.docx

数据挖掘与大数据分析技能测试题库及答案

一、单项选择题(每题2分,共20分)

1.以下哪种数据清洗方法适用于处理数值型特征中的异常值?

A.众数填充法

B.Z-score标准化

C.分箱处理

D.独热编码

答案:C

解析:分箱处理(Binning)通过将连续数值划分为区间,可有效缓解异常值对模型的影响;Z-score用于标准化而非直接处理异常值;众数填充用于缺失值;独热编码用于类别特征离散化。

2.在分类任务中,若正负样本比例为1:100,且目标是最小化漏检正样本的情况,应优先选择以下哪个评估指标?

A.准确率(Accuracy)

B.F1-score

C.召回率(Recall)

D.精确率(Precision)

答案:C

解析:召回率衡量正样本被正确识别的比例,漏检正样本对应召回率低的场景,因此需优先优化召回率。

3.以下关于随机森林(RandomForest)和梯度提升树(GradientBoostingTree)的描述,错误的是?

A.随机森林通过Bagging集成,梯度提升树通过Boosting集成

B.随机森林的基分类器是并行训练,梯度提升树是串行训练

C.随机森林对异常值更敏感,梯度提升树鲁棒性更强

D.随机森林难以处理高维稀疏数据,梯度提升树可通过特征重要性筛选优化

文档评论(0)

1亿VIP精品文档

相关文档