大数据引擎面试题目及答案.docxVIP

  • 1
  • 0
  • 约4.36千字
  • 约 14页
  • 2026-08-22 发布于河南
  • 举报

大数据引擎面试题目及答案

一、单选题(共10题,每题10分,总分100分)

1.在HadoopHDFS架构中,默认的Block大小是多少?

A.64MB

B.128MB

C.256MB

D.512MB

答案:B

2.在Spark中,将一个RDD转换为一个新RDD的操作被称为算子,以下哪个算子可以将一个元素映射为0个或多个元素?

A.map

B.flatMap

C.filter

D.reduceByKey

答案:B

3.在Kafka中,如果生产者设置了acks=all,并且min.insync.replicas大于1,那么发生什么情况会导致消息丢失?

A.生产者发送消息后立即返回成功

B.消息写入所有同步副本后返回成功

C.消息写入主副本后返回成功

D.消息写入日志文件后返回成功

答案:B

4.Flink中,用于处理无界数据流的窗口算子中,基于时间对数据进行分组的操作是?

A.KeyedStream

B.Window

C.ProcessWindowFunction

D.KeyBy

答案:D

5.HBase中,RegionServer负责管理哪些数据?

A.整个HBase表的数据

B.一部分表的数据,即Region

C.HDFS的元数据

D.ZooKeeper的节点

答案:B

6.在Hive中,以下哪种分区方式属于静态分区?

A.

文档评论(0)

1亿VIP精品文档

相关文档