2026年数据科学项目实战案例习题集.docxVIP

  • 0
  • 0
  • 约8.95千字
  • 约 28页
  • 2026-10-01 发布于广东
  • 举报

2026年数据科学项目实战案例习题集

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在《2026年数据科学项目实战案例习题集》第3章中,关于数据预处理的方法,以下哪种技术最适合处理缺失值比例超过30%的表格数据?(每题2分)

A.使用均值或中位数填充

B.直接删除含有缺失值的行

C.采用K最近邻算法预测缺失值

D.应用多重插补法生成完整数据集

2.根据第4单元内容,在构建分类模型时,如果发现模型在训练集上表现良好但在测试集上表现差,最可能的原因是什么?(每题2分)

A.特征工程不足导致信息丢失

B.模型过拟合训练数据

C.数据标准化未正确执行

D.类别不平衡导致偏差

3.第5章介绍的聚类算法中,K-means算法在处理高维数据时面临的主要问题是?(每题2分)

A.计算复杂度随维度增加而线性下降

B.算法对初始质心选择敏感

C.无法处理非凸形状的簇

D.需要预先指定簇的数量k

4.在第6单元的推荐系统案例中,协同过滤算法的核心思想是什么?(每题2分)

A.基于物品相似度进行推荐

B.利用用户历史行为模式

C.采用矩阵分解技术降维

D.结合深度学习提取特征

5.第7章关于模型评估的内容中,以下哪种指标最适合评估不平衡数据集上的分类模型性能?(每题

文档评论(0)

1亿VIP精品文档

相关文档