2026年国开电大大数据技术形考题库100道附答案【完整版】.docxVIP

  • 1
  • 0
  • 约2.46万字
  • 约 39页
  • 2026-03-09 发布于河南
  • 举报

2026年国开电大大数据技术形考题库100道附答案【完整版】.docx

2026年国开电大大数据技术形考题库100道

第一部分单选题(100题)

1、K-Means算法在数据挖掘中主要用于以下哪种任务?

A.分类(如垃圾邮件识别)

B.聚类(如用户分群)

C.回归(如预测销售额)

D.关联规则挖掘(如“啤酒与尿布”)

【答案】:B

解析:本题考察数据挖掘算法类型知识点。K-Means是经典的无监督学习聚类算法,通过计算数据点间距离将数据划分为K个簇(Clusters),用于用户分群、异常检测等场景。分类(A)需有监督学习(如决策树、SVM),回归(C)预测连续值(如线性回归),关联规则挖掘(D)(如Apriori算法)用于发现项集间关联关系,均与K-Means功能不同。

2、下列哪项不属于数据预处理的基本步骤?

A.数据清洗(处理缺失值、异常值)

B.数据加密(数据安全措施)

C.数据集成(合并多源数据)

D.数据规约(降维、压缩数据)

【答案】:B

解析:本题考察数据预处理步骤知识点。数据预处理基本步骤包括数据清洗、数据集成、数据转换、数据规约,主要解决数据质量问题。选项B“数据加密”属于数据安全技术,用于保护数据隐私,与数据预处理无关;A、C、D均为数据预处理的核心步骤。

3、Hadoop生态系统中负责分布式存储的核心组件是?

A.MapReduce

B.YARN

C.HDFS

D.Hive

【答案】:C

解析:本题

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档