华为数据挖掘笔试题.docxVIP

  • 1
  • 0
  • 约7.33千字
  • 约 11页
  • 2026-08-10 发布于上海
  • 举报

华为数据挖掘笔试题

考试时间:______分钟总分:______分姓名:______

一、选择题

1.在数据预处理阶段,对于缺失数据的处理方法,以下哪种方法可能会引入主观偏差?

A.使用均值或中位数填充

B.使用众数填充

C.直接删除含有缺失值的记录

D.使用模型预测缺失值

2.设有一个数据集,其中有1000个样本,每个样本有5个特征。如果使用K-Means聚类算法对这批数据进行聚类,且指定要分为4类,则初始质心通常是如何确定的?

A.随机选择4个样本作为初始质心

B.将数据集按4个维度分别排序,取排序后每维度的第一个样本作为初始质心

C.使用K-Means++算法智能地选择初始质心

D.将1000个样本平均分配到4个空间区域,每个区域中心作为初始质心

3.以下关于线性回归模型的描述,哪一项是正确的?

A.线性回归模型假设因变量与自变量之间存在严格的线性关系

B.线性回归模型的目标是最小化残差平方和

C.线性回归模型只能用于分类问题

D.线性回归模型对异常值不敏感

4.在评估一个分类模型(例如逻辑回归或决策树)的性能时,如果关注点在于模型对正类样本的识别能力,那么哪个指标最能反映这一点?

文档评论(0)

1亿VIP精品文档

相关文档