- 1
- 0
- 约9.09千字
- 约 8页
- 2026-08-07 发布于上海
- 举报
数据科学专业认证(CDSP)
一、单项选择题(共10题,每题1分,共10分)1.以下缺失值处理方法中,最适合符合正态分布的连续数值型特征的是A.众数填充B.均值填充C.类别常量填充D.删除整条样本答案:B解析:正确选项依据:正态分布的连续特征均值处于数据分布中心位置,用均值填充不会大幅改变分布特征;错误选项说明:A选项众数填充更适合类别型特征,C选项类别常量填充仅适用于可解释缺失含义的类别特征,D选项删除样本会直接减少数据集规模,仅在缺失占比极低时适用,不属于正态连续特征的最优方案。2.分类模型评估指标召回率的核心含义是A.所有预测为正的样本中真实为正的比例B.所有真实为正的样本中被预测为正的比例C.所有预测为负的样本中真实为负的比例D.所有真实为负的样本中被预测为负的比例答案:B解析:正确选项依据:召回率(Recall)也叫查全率,衡量模型对正样本的覆盖能力,计算方式为TP/(TP+FN);错误选项说明:A选项是精确率的定义,C选项是负例精确率的定义,D选项是特异度的定义。3.以下属于无监督学习算法的是A.逻辑回归B.K近邻算法C.K-Means聚类D.支持向量机答案:C解析:正确选项依据:K-Means不需要标注样本标签,可自动挖掘数据的相似性分组,属于典型无监督算法;错误选项说明:A、B、D三类算法都必须
原创力文档

文档评论(0)