2026年数据挖掘与数据治理专项训练习题集.docxVIP

  • 1
  • 0
  • 约8.37千字
  • 约 25页
  • 2026-09-25 发布于山西
  • 举报

2026年数据挖掘与数据治理专项训练习题集.docx

2026年数据挖掘与数据治理专项训练习题集

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在数据挖掘过程中,用于评估模型泛化能力的指标通常不包括以下哪一项?

A.准确率

B.召回率

C.F1分数

D.AUC值

解析:准确率、召回率和F1分数主要用于评估分类模型的性能,而AUC值(AreaUndertheROCCurve)是用于评估模型在不同阈值下的综合性能,更侧重于模型区分能力的全面衡量。泛化能力主要关注模型在未见过数据上的表现,AUC值虽然能反映模型性能,但不是直接评估泛化能力的指标。

2.数据治理中的数据质量维度通常不包括以下哪项?

A.完整性

B.一致性

C.及时性

D.可见性

解析:数据质量维度通常包括完整性(数据是否缺失)、准确性(数据是否正确)、一致性(数据是否矛盾)、及时性(数据是否最新)和有效性(数据是否符合预期格式)。可见性不属于标准的数据质量维度,而是数据可访问性的概念。

3.在数据预处理阶段,用于处理缺失值的多重插补法(MultipleImputation)的核心思想是:

A.用均值或中位数填充所有缺失值

B.基于其他变量生成多个可能的缺失值填充值

C.删除包含缺失值的记录

D.用回归模型预测缺失值

解析:多重插补法通过模拟缺失值的多

文档评论(0)

1亿VIP精品文档

相关文档