2026年高级数据分析师考试题库(附答案和详细解析)(0207).docxVIP

  • 1
  • 0
  • 约9.31千字
  • 约 13页
  • 2026-03-30 发布于上海
  • 举报

2026年高级数据分析师考试题库(附答案和详细解析)(0207).docx

高级数据分析师考试试卷(总分100分)

一、单项选择题(共10题,每题1分,共10分)

在数据清洗过程中,针对高维度、非线性相关的缺失值,最适合的处理方法是()

A.直接删除缺失值所在行

B.用特征均值填充缺失值

C.采用随机森林模型插补缺失值

D.用相邻值前向填充(ffill)

答案:C

解析:随机森林插补(C)通过利用其他特征的信息预测缺失值,适用于高维度、非线性关系的数据,能保留变量间的复杂关联。直接删除行(A)会导致样本损失;均值填充(B)忽略变量间相关性;前向填充(D)适用于时间序列的局部缺失,对非线性关系效果差。

评估分类模型时,若业务场景更关注“减少漏判阳性样本”,应优先选择的指标是()

A.准确率(Accuracy)

B.精确率(Precision)

C.召回率(Recall)

D.F1分数

答案:C

解析:召回率(C)衡量模型正确识别阳性样本的比例(TP/(TP+FN)),漏判对应FN增加,提高召回率可减少漏判。准确率(A)是整体正确比例,无法区分漏判;精确率(B)关注预测阳性中的真实阳性,与漏判无关;F1分数(D)是精确率与召回率的调和平均,不直接针对漏判场景。

以下哪项不属于时间序列分解的常见成分?()

A.趋势(Trend)

B.季节性(Seasonality)

C.周期性(Cyclical)

D.白噪声(WhiteNoise

文档评论(0)

1亿VIP精品文档

相关文档