2025年数据挖掘计算试题及答案.docxVIP

  • 1
  • 0
  • 约6.51千字
  • 约 19页
  • 2026-08-24 发布于四川
  • 举报

2025年数据挖掘计算试题及答案

一、单项选择题(每题2分,共20分)

1.以下哪种数据挖掘方法主要用于发现数据中的相似性和差异性?()

A.分类

B.聚类

C.关联规则挖掘

D.回归分析

答案:B。聚类是将数据对象分组成为多个类或簇的过程,使得同一簇中的对象具有较高的相似性,不同簇中的对象具有较大的差异性。而分类是将数据对象划分到已知类别的过程;关联规则挖掘是发现数据项之间的关联关系;回归分析是用于预测数值型变量的值。

2.在关联规则挖掘中,支持度和置信度是两个重要的指标。如果一条关联规则“X→Y”的支持度为0.2,置信度为0.8,这意味着()

A.在所有事务中,同时包含X和Y的事务占20%,在包含X的事务中,包含Y的事务占80%

B.在所有事务中,同时包含X和Y的事务占80%,在包含X的事务中,包含Y的事务占20%

C.在所有事务中,包含X的事务占20%,包含Y的事务占80%

D.在所有事务中,包含X的事务占80%,包含Y的事务占20%

答案:A。支持度是指同时包含X和Y的事务在所有事务中所占的比例,置信度是指在包含X的事务中,包含Y的事务所占的比例。所以支持度为0.2表示在所有事务中,同时包含X和Y的事务占20%;置信度为0.8表示在包含X

文档评论(0)

1亿VIP精品文档

相关文档