- 1
- 0
- 约9.31千字
- 约 13页
- 2026-03-30 发布于上海
- 举报
高级数据分析师考试试卷(总分100分)
一、单项选择题(共10题,每题1分,共10分)
在数据清洗过程中,针对高维度、非线性相关的缺失值,最适合的处理方法是()
A.直接删除缺失值所在行
B.用特征均值填充缺失值
C.采用随机森林模型插补缺失值
D.用相邻值前向填充(ffill)
答案:C
解析:随机森林插补(C)通过利用其他特征的信息预测缺失值,适用于高维度、非线性关系的数据,能保留变量间的复杂关联。直接删除行(A)会导致样本损失;均值填充(B)忽略变量间相关性;前向填充(D)适用于时间序列的局部缺失,对非线性关系效果差。
评估分类模型时,若业务场景更关注“减少漏判阳性样本”,应优先选择的指标是()
A.准确率(Accuracy)
B.精确率(Precision)
C.召回率(Recall)
D.F1分数
答案:C
解析:召回率(C)衡量模型正确识别阳性样本的比例(TP/(TP+FN)),漏判对应FN增加,提高召回率可减少漏判。准确率(A)是整体正确比例,无法区分漏判;精确率(B)关注预测阳性中的真实阳性,与漏判无关;F1分数(D)是精确率与召回率的调和平均,不直接针对漏判场景。
以下哪项不属于时间序列分解的常见成分?()
A.趋势(Trend)
B.季节性(Seasonality)
C.周期性(Cyclical)
D.白噪声(WhiteNoise
您可能关注的文档
- 2026年EAP咨询师考试题库(附答案和详细解析)(0312).docx
- 2026年注册交通工程师考试题库(附答案和详细解析)(0307).docx
- 2026年注册咨询工程师考试题库(附答案和详细解析)(0312).docx
- 2026年注册地质工程师考试题库(附答案和详细解析)(0226).docx
- 2026年注册节能评估师考试题库(附答案和详细解析)(0308).docx
- 2026年注册风险控制师(CRC)考试题库(附答案和详细解析)(0216).docx
- 2026年职业生涯规划师考试题库(附答案和详细解析)(0311).docx
- 2026年青少年心理成长导师考试题库(附答案和详细解析)(0222).docx
原创力文档

文档评论(0)