大数据挖掘题目及详解.docxVIP

  • 2
  • 0
  • 约8.03千字
  • 约 21页
  • 2026-07-22 发布于上海
  • 举报

大数据挖掘题目及详解

一、单项选择题(共10题,每题1分,共10分)

大数据挖掘中,处理缺失值的常用方法不包括以下哪一项?

A.直接删除包含缺失值的样本

B.用该属性的平均值填充缺失值

C.用模型预测缺失值的可能取值

D.直接忽略数据中的所有样本

答案:D

解析:大数据挖掘中处理缺失值的常见方法包括删除法、填充法(如均值、中位数、众数)、预测法(如用回归模型)等。选项D直接忽略所有样本会导致数据量严重减少,丢失有效信息,不是合理的处理方法,因此不属于常用方法,故答案为D。

关联规则挖掘中,用于衡量规则有用性的核心指标不包括?

A.支持度

B.置信度

C.准确率

D.提升度

答案:C

解析:关联规则的核心评价指标是支持度(衡量规则出现的频率)、置信度(衡量规则的可靠性)、提升度(衡量规则的关联强度)。准确率主要用于分类模型的评估,不属于关联规则的核心指标,故答案为C。

以下属于无监督式大数据挖掘任务的是?

A.垃圾邮件分类

B.用户消费群体聚类

C.商品销量预测

D.客户流失预警

答案:B

解析:无监督式挖掘任务不需要预先标注样本类别,仅通过样本间的相似性分析完成任务,聚类分析是典型的无监督任务。选项A、C、D均需要预先知道样本的标签(如“是否为垃圾邮件”“销量等级”),属于有监督任务,故答案为B。

大数据预处理阶段,将连续型特征转化为离散型特征的过程称为?

文档评论(0)

1亿VIP精品文档

相关文档