- 0
- 0
- 约3.72千字
- 约 12页
- 2026-08-11 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年分布式系统开发题集:Hadoop与Spark实战
一、单选题(每题2分,共20题)
1.在Hadoop生态中,HDFS的NameNode主要负责什么功能?
A.数据块管理
B.数据块分配
C.元数据管理
D.客户端请求调度
2.Spark的RDD(弹性分布式数据集)支持哪些操作?
A.仅有转换操作
B.仅有行动操作
C.转换和行动操作均可
D.无操作
3.HadoopMapReduce中,Mapper阶段的输出格式通常是什么?
A.JSON
B.XML
C.Text
D.Avro
4.SparkSession与SparkContext的主要区别是什么?
A.SparkSession支持更高级的SQL功能
B.SparkContext仅用于RDD操作
C.SparkSession不能进行低级优化
D.SparkContext比SparkSession更高效
5.Hadoop中,哪些文件系统支持HDFS的NameNode?
A.ext4
B.XFS
C.BothAandB
D.Noneoftheabove
6.Spark中,哪些操作是破坏性的?
A.map()
B.filter()
C.reduceByKey()
D.cache()
7.在Hadoop集
原创力文档

文档评论(0)