2026年数据挖掘与数据仓库设计习题.docxVIP

  • 0
  • 0
  • 约1.05万字
  • 约 38页
  • 2026-09-30 发布于广东
  • 举报

2026年数据挖掘与数据仓库设计习题

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在数据仓库设计中,星型模式的主要优点不包括()

A.数据结构清晰,易于理解

B.支持快速查询,性能优越

C.维度表数量较少,简化设计

D.适合处理大规模、复杂的事务数据

解析:星型模式通过事实表和维度表的关联,形成类似星形的结构,其优点在于数据结构清晰、查询效率高、维度表数量少。选项D错误,星型模式更适合分析型数据处理而非事务处理,事务处理通常采用雪花模式以减少数据冗余。

2.数据挖掘中的关联规则挖掘算法Apriori的核心思想是()

A.基于决策树进行分类

B.利用贝叶斯网络进行预测

C.通过频繁项集生成关联规则

D.基于聚类分析进行分组

解析:Apriori算法采用频繁项集的所有非空子集也必须是频繁的这一先验原理,通过两阶段过程:首先找出所有频繁项集,然后生成关联规则。选项C准确描述了其核心机制,其他选项分别对应决策树分类、贝叶斯分类和聚类算法。

3.在数据仓库ETL过程中,数据清洗的主要任务不包括()

A.处理缺失值

B.统一数据格式

C.检测并修正异常值

D.压缩数据存储空间

解析:数据清洗是ETL过程中的重要环节,包括处理缺失值、修正异常值、统一数据

文档评论(0)

1亿VIP精品文档

相关文档