2026年数据挖掘与数据科学实战习题集.docxVIP

  • 1
  • 0
  • 约6.12千字
  • 约 15页
  • 2026-09-21 发布于辽宁
  • 举报

2026年数据挖掘与数据科学实战习题集.docx

2026年数据挖掘与数据科学实战习题集

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在数据挖掘过程中,用于评估模型泛化能力的指标是()

A.过拟合率

B.训练集准确率

C.交叉验证误差

D.特征冗余度

解析:交叉验证误差通过多次数据分割评估模型在不同子集上的表现,能有效反映模型对未知数据的泛化能力。过拟合率衡量模型对训练数据的过度拟合程度,训练集准确率仅反映模型在训练数据上的表现,特征冗余度描述特征之间的相似性,均与泛化能力评估无关。

2.下列算法中,属于监督学习算法的是()

A.K-means聚类

B.主成分分析

C.决策树分类

D.系统聚类

解析:决策树分类通过训练数据学习决策规则对样本进行分类,属于监督学习。K-means和系统聚类属于无监督学习中的聚类算法,主成分分析是降维方法,均不属于监督学习。

3.在关联规则挖掘中,支持度衡量的是()

A.规则的置信度

B.项集在数据集中出现的频率

C.规则的预测误差

D.项集之间的相关性

解析:支持度表示同时包含规则中所有项的记录在总记录中的比例,衡量项集的普遍程度。置信度衡量规则前件出现时后件也出现的概率,预测误差反映模型预测准确性,相关性描述

文档评论(0)

1亿VIP精品文档

相关文档