2026年大数据Hadoop与Spark实战练习题.docxVIP

  • 0
  • 0
  • 约5.37千字
  • 约 15页
  • 2026-08-11 发布于福建
  • 举报

第PAGE页共NUMPAGES页

2026年大数据Hadoop与Spark实战练习题

一、单选题(每题2分,共20题)

1.在Hadoop生态系统中,HDFS的主要设计目标是?

A.低延迟访问

B.高吞吐量存储

C.内存计算优化

D.实时数据查询

2.Hadoop的NameNode在集群中扮演的核心角色是?

A.数据块管理

B.任务调度

C.元数据存储

D.网络通信

3.Spark的RDD(弹性分布式数据集)的核心特性不包括?

A.可持久化

B.可恢复性

C.可广播优化

D.不可并行化

4.在Spark中,以下哪种操作属于转换操作(Transformation)?

A.`count()`

B.`collect()`

C.`map()`

D.`reduce()`

5.Hadoop的YARN(YetAnotherResourceNegotiator)架构主要解决了什么问题?

A.数据倾斜

B.资源调度

C.任务失败重试

D.数据压缩

6.在HDFS中,SecondaryNameNode的主要作用是?

A.提升NameNode性能

B.备份NameNode数据

C.定期合并元数据

D.监控数据块健康度

7.Spark的DataFrameAPI相较于RDD的主要优势是?

A.更高的容错性

B.更好的性

文档评论(0)

1亿VIP精品文档

相关文档