2026年数据挖掘算法实战演练试题.docxVIP

  • 1
  • 0
  • 约1.98万字
  • 约 64页
  • 2026-10-09 发布于山西
  • 举报

2026年数据挖掘算法实战演练试题

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在数据挖掘过程中,用于评估模型泛化能力的指标是()

A.过拟合度

B.训练误差

C.测试误差

D.特征冗余度

解析:本题考查数据挖掘模型评估的核心概念。泛化能力指模型对未见过数据的预测性能,因此测试误差最能反映泛化能力。过拟合度衡量模型对训练数据的过度拟合程度,训练误差仅反映模型在训练集上的表现,特征冗余度属于特征工程范畴。正确答案为C,测试误差。

2.决策树算法中,用于选择分裂属性的标准不包括()

A.信息增益

B.基尼系数

C.逻辑回归系数

D.Gini不纯度

解析:决策树分裂属性选择标准主要分为贪心算法和启发式算法两类。信息增益和Gini不纯度是贪心算法的典型代表,而逻辑回归系数属于线性模型参数,与决策树分裂标准无关。正确答案为C,逻辑回归系数。

3.在聚类算法中,K-means算法的缺点不包括()

A.对初始聚类中心敏感

B.无法处理非凸形状簇

C.对噪声数据鲁棒性强

D.计算复杂度较高

解析:K-means算法的典型缺点包括对初始聚类中心敏感(易陷入局部最优)、无法处理非凸形状簇、对噪声数据敏感(易受异常

文档评论(0)

1亿VIP精品文档

相关文档