2026年大数据技术与应用数据挖掘与分析能力测试题.docxVIP

  • 2
  • 0
  • 约4.51千字
  • 约 14页
  • 2026-08-09 发布于福建
  • 举报

2026年大数据技术与应用数据挖掘与分析能力测试题.docx

第PAGE页共NUMPAGES页

2026年大数据技术与应用数据挖掘与分析能力测试题

一、单选题(共10题,每题2分,合计20分)

1.在大数据处理中,下列哪项技术最适合用于处理海量、高速、多源异构的数据?

A.关系型数据库管理系统

B.分布式文件系统(如HDFS)

C.在线交易处理(OLTP)系统

D.数据仓库

答案:B

解析:分布式文件系统(如HDFS)通过分布式存储和计算,能够高效处理海量、高速、多源异构的数据,适用于大数据场景。关系型数据库管理系统主要用于结构化数据存储,OLTP系统侧重于实时事务处理,数据仓库则用于数据汇总和分析。

2.以下哪种算法属于监督学习算法?

A.K-means聚类

B.决策树

C.主成分分析(PCA)

D.Apriori关联规则

答案:B

解析:监督学习算法通过标注数据训练模型,决策树属于此类;K-means聚类和PCA属于无监督学习,Apriori关联规则属于关联规则挖掘。

3.在数据预处理中,处理缺失值最常用的方法是?

A.删除含有缺失值的记录

B.均值/中位数/众数填充

C.使用模型预测缺失值

D.以上都是

答案:D

解析:处理缺失值的方法包括删除记录、均值/中位数/众数填充、模型预测等,具体选择需根据数据特征和业务场景决定。

4.以下哪种指标最适合评估分类模型的性能?

A.均方误差(MSE)

文档评论(0)

1亿VIP精品文档

相关文档