2026年数据科学专业认证(CDSP)考试题库(附答案和详细解析)(0630).docxVIP

  • 2
  • 0
  • 约6.88千字
  • 约 9页
  • 2026-09-16 发布于上海
  • 举报

2026年数据科学专业认证(CDSP)考试题库(附答案和详细解析)(0630).docx

数据科学专业认证(CDSP)

一、单项选择题(共10题,每题1分,共10分)

在数据预处理阶段,当特征之间的数量级差异巨大时,为了消除量纲影响,通常首选的标准化方法是:A.归一化(Min-MaxScaling)B.标准化(Z-ScoreNormalization)C.坐标轴旋转D.特征选择

答案:B解析:标准化(Z-Score)将数据转换为均值为0、标准差为1的分布,特别适用于数据呈现正态分布或受离群值影响较大的情况,且能保留数据的分布形态。归一化会将数据压缩到[0,1]区间,当数据中出现极端值时容易导致信息丢失。

以下哪项技术主要用于发现数据集中存在的异常点或离群值?A.K-Means聚类B.线性回归C.局部离群因子D.支持向量机(SVM)

答案:C解析:局部离群因子(LOF)是一种基于密度的异常检测算法,它通过比较一个数据点与其邻域点的局部密度,计算该点的局部可达密度,密度显著低于其邻域点的点被判定为异常点。K-Means是聚类算法,线性回归是监督学习回归算法,SVM是分类或回归算法,均非专门用于异常检测。

在决策树算法中,为了防止模型过拟合,常用的后剪枝策略是:A.增加树的深度B.限制树的最大深度或最小叶子节点样本数C.增加训练数据量D.使用多项式核函数

答案:B解析:后剪枝是指在生成完整的决策树后,通过修剪掉那些对

文档评论(0)

1亿VIP精品文档

相关文档