- 2
- 0
- 约6.88千字
- 约 9页
- 2026-09-16 发布于上海
- 举报
数据科学专业认证(CDSP)
一、单项选择题(共10题,每题1分,共10分)
在数据预处理阶段,当特征之间的数量级差异巨大时,为了消除量纲影响,通常首选的标准化方法是:A.归一化(Min-MaxScaling)B.标准化(Z-ScoreNormalization)C.坐标轴旋转D.特征选择
答案:B解析:标准化(Z-Score)将数据转换为均值为0、标准差为1的分布,特别适用于数据呈现正态分布或受离群值影响较大的情况,且能保留数据的分布形态。归一化会将数据压缩到[0,1]区间,当数据中出现极端值时容易导致信息丢失。
以下哪项技术主要用于发现数据集中存在的异常点或离群值?A.K-Means聚类B.线性回归C.局部离群因子D.支持向量机(SVM)
答案:C解析:局部离群因子(LOF)是一种基于密度的异常检测算法,它通过比较一个数据点与其邻域点的局部密度,计算该点的局部可达密度,密度显著低于其邻域点的点被判定为异常点。K-Means是聚类算法,线性回归是监督学习回归算法,SVM是分类或回归算法,均非专门用于异常检测。
在决策树算法中,为了防止模型过拟合,常用的后剪枝策略是:A.增加树的深度B.限制树的最大深度或最小叶子节点样本数C.增加训练数据量D.使用多项式核函数
答案:B解析:后剪枝是指在生成完整的决策树后,通过修剪掉那些对
您可能关注的文档
最近下载
- 梁启超PPT课件.ppt VIP
- CC-19系列化学品安全数据说明书MSDS.doc VIP
- BYK流平剂Levelingagents经典课件.ppt VIP
- 4.1 公有制为主体、多种所有制经济共同发展(课件)-中职思想政治《中国特色社会主义》(高教版2023·基础模块).pptx VIP
- DB13T 670-2005 无公害果品 金丝小枣.pdf VIP
- 2026年OTC药品市场营销现状与趋势.docx
- SHT 3405-2017 石油化工钢管尺寸系列.pdf VIP
- DB13T 669-2005 杨树溃疡病综合防治技术规程.pdf VIP
- 宣贯培训(2026年)《LDT 72.7-2008建设工程劳动定额 建筑工程-钢筋工程》.pptx VIP
- 新人教部编版道德与法治八年级上册同步练习:遵守规则.pdf VIP
原创力文档

文档评论(0)