2026年高级数据分析师考试题库(附答案和详细解析)(0629).docxVIP

  • 1
  • 0
  • 约7.49千字
  • 约 8页
  • 2026-09-04 发布于上海
  • 举报

2026年高级数据分析师考试题库(附答案和详细解析)(0629).docx

高级数据分析师

一、单项选择题(共10题,每题1分,共10分)

在数据清洗过程中,对于存在缺失值的特征,当缺失比例低于5%且为随机缺失(MCAR)时,最稳健的处理方法是:A.直接删除该样本B.使用该特征的均值或中位数填充C.使用该特征众数填充D.使用回归模型预测并填充答案:A解析:A选项直接删除是处理少量缺失值的经典方法,既简单又不会引入偏差。B、C选项均值/众数填充会改变特征分布,D选项预测填充计算成本高且可能引入过拟合风险。

下列关于时间序列分解的描述中,错误的是:A.分解模型通常假设季节性因素是固定的B.添加型模型中,观测值等于趋势、季节性和随机成分之和C.乘法型模型适用于季节性波动随趋势增长的情况D.在分解前通常需要进行平稳性处理答案:A解析:A选项错误,现代时间序列分解(如STL)允许季节性因素随时间变化(可变季节性)。B选项正确,这是加法模型的基本假设。C选项正确,乘法模型用于季节性幅度随趋势线性增长的情况。D选项正确,平稳性是许多时间序列分析的前提。

在机器学习模型评估中,若类别极度不平衡(如欺诈检测中欺诈样本仅占0.1%),应优先考虑以下哪个指标:A.准确率B.精确率C.召回率D.F1分数答案:C解析:C选项召回率衡量模型找出所有正样本的能力。在欺诈检测中,宁可错杀(高召回率),不可漏过(低召回率),因为漏

文档评论(0)

1亿VIP精品文档

相关文档