2026年高级数据分析师考试题库(附答案和详细解析)(0311).docxVIP

  • 2
  • 0
  • 约7.79千字
  • 约 11页
  • 2026-04-22 发布于上海
  • 举报

2026年高级数据分析师考试题库(附答案和详细解析)(0311).docx

高级数据分析师考试试卷

一、单项选择题(共10题,每题1分,共10分)

以下关于数据清洗中缺失值处理的描述,正确的是()

A.对分类变量缺失值,优先使用均值填充

B.均值填充适用于数值型变量且数据服从正态分布的场景

C.所有缺失值都应直接删除以保证数据完整性

D.时间序列数据的缺失值只能用插值法处理

答案:B

解析:均值填充适用于数值型变量且数据分布接近正态(无严重偏态),此时均值能较好代表集中趋势(B正确)。分类变量缺失值应优先用众数填充(A错误);直接删除缺失值可能导致数据量大幅减少,需根据缺失比例选择处理方式(C错误);时间序列缺失值还可用前向/后向填充等方法(D错误)。

在分类模型评估中,若关注“识别所有正例”的能力,应重点考察()

A.准确率(Accuracy)

B.精确率(Precision)

C.召回率(Recall)

D.F1值

答案:C

解析:召回率(Recall)=真阳性/(真阳性+假阴性),反映模型覆盖所有正例的能力(C正确)。准确率是整体正确比例(A错误);精确率是预测为正的样本中实际为正的比例(B错误);F1是精确率与召回率的调和平均(D错误)。

以下哪项不是随机森林(RandomForest)的特点?()

A.基于Bagging集成方法

B.树之间存在强依赖关系

C.可输出特征重要性分数

D.对异常值有一定鲁棒性

答案:

文档评论(0)

1亿VIP精品文档

相关文档