2026年高级数据分析师考试题库(附答案和详细解析)(0215).docxVIP

  • 3
  • 0
  • 约8.35千字
  • 约 12页
  • 2026-04-11 发布于上海
  • 举报

2026年高级数据分析师考试题库(附答案和详细解析)(0215).docx

高级数据分析师考试试卷

一、单项选择题(共10题,每题1分,共10分)

以下哪种场景最适合使用K-means聚类算法?

A.预测用户下一次购买时间(回归问题)

B.识别用户分群特征(无监督学习)

C.检测信用卡欺诈(异常检测)

D.分类用户是否为会员(监督学习)

答案:B

解析:K-means是无监督学习的聚类算法,核心目标是将数据划分为相似特征的群组。选项A需回归模型(如线性回归),选项C需孤立森林或LOF算法,选项D需分类模型(如逻辑回归),只有选项B符合聚类的应用场景。

在A/B测试中,若显著性水平(α)设为0.05,意味着?

A.有5%的概率拒绝正确的原假设(第一类错误)

B.有5%的概率接受错误的原假设(第二类错误)

C.测试结果有95%的概率显著

D.样本量需满足95%的统计效力

答案:A

解析:显著性水平α是犯第一类错误(弃真错误)的概率上限。选项B描述的是β(第二类错误概率),选项C混淆了显著性与实际效果,选项D中统计效力(1-β)通常需单独计算,与α无直接等价关系。

以下哪项不是数据特征工程中“特征缩放”的常用方法?

A.标准化(Z-score)

B.归一化(Min-Max)

C.分箱(Binning)

D.正则化(Regularization)

答案:D

解析:特征缩放用于统一特征量纲,包括标准化(A)和归一化(B);分箱(C)是离散化方

文档评论(0)

1亿VIP精品文档

相关文档