2026年高级数据分析师考试题库(附答案和详细解析)(0618).docxVIP

  • 1
  • 0
  • 约6.36千字
  • 约 8页
  • 2026-08-05 发布于上海
  • 举报

2026年高级数据分析师考试题库(附答案和详细解析)(0618).docx

高级数据分析师

一、单项选择题(共10题,每题1分,共10分)

在数据预处理中,处理缺失值最常用的方法是?A.删除含有缺失值的行B.填充缺失值(如使用均值、中位数或众数)C.将缺失值视为一个独立类别D.使用机器学习模型预测缺失值答案:B解析:填充缺失值是最常用的方法,适用于数据量较大且缺失比例不高的情况。删除行会导致数据丢失,将缺失值视为独立类别可能引入偏差,机器学习预测缺失值复杂度高且未必准确。

下列哪种统计方法适用于分析两个分类变量之间的关系?A.线性回归B.皮尔逊相关系数C.卡方检验D.斯皮尔曼秩相关系数答案:C解析:卡方检验用于分析分类变量间的独立性。线性回归用于连续变量,皮尔逊相关系数用于连续变量线性关系,斯皮尔曼秩相关系数用于非参数连续变量。

在数据可视化中,哪个图表最适合展示时间序列数据趋势?A.饼图B.散点图C.折线图D.热力图答案:C解析:折线图能清晰展示数据随时间的变化趋势。饼图用于部分占比,散点图用于两个连续变量关系,热力图用于矩阵数据密度。

下列哪个不是机器学习模型评估的常用指标?A.准确率(Accuracy)B.F1分数C.决策树深度D.AUC(ROC曲线下面积)答案:C解析:决策树深度是模型结构参数,不是评估指标。其他均为分类模型常用评估标准。

在聚类分析中,K-means算

文档评论(0)

1亿VIP精品文档

相关文档