2026年大数据分析基础与实战试题集.docxVIP

  • 1
  • 0
  • 约5.22千字
  • 约 16页
  • 2026-09-25 发布于福建
  • 举报

第PAGE页共NUMPAGES页

2026年大数据分析基础与实战试题集

一、单选题(每题2分,共20题)

1.在大数据分析中,Hadoop生态系统中的HDFS主要用于存储什么类型的数据?

A.实时交易数据

B.分布式文件数据

C.内存缓存数据

D.关系型数据库数据

2.以下哪种技术最适合处理海量、高维度的数据降维?

A.决策树

B.主成分分析(PCA)

C.逻辑回归

D.K-近邻算法

3.在大数据处理中,Spark与HadoopMapReduce的主要区别是什么?

A.Spark支持实时处理,而MapReduce不支持

B.Spark的内存管理更高效

C.Spark只能处理结构化数据,而MapReduce可以处理非结构化数据

D.Spark的学习曲线更陡峭

4.以下哪种数据库最适合存储半结构化和非结构化数据?

A.关系型数据库(如MySQL)

B.NoSQL数据库(如MongoDB)

C.数据仓库(如AmazonRedshift)

D.时序数据库(如InfluxDB)

5.在大数据分析中,K-means聚类算法的默认距离度量是什么?

A.曼哈顿距离

B.欧氏距离

C.余弦距离

D.切比雪夫距离

6.以下哪种工具最适合进行大数据的ETL(Extract,Transform,Load)操作?

A.A

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档