- 1
- 0
- 约5.21千字
- 约 8页
- 2026-07-22 发布于河北
- 举报
联通数据开发岗位笔试真题及详细答案(真实考情版)
一、单项选择题(共15题,每题2分,共30分)
1、Hadoop生态中,负责集群资源调度与管理的核心组件是()
A.HDFSB.YARNC.MapReduceD.Hive
答案:B
解析:YARN是Hadoop的资源调度核心,负责CPU、内存资源分配和任务调度;HDFS是分布式存储,MapReduce是离线计算引擎,Hive是数据仓库工具。
2、联通5G基站实时测速、流量监控等低延迟数据场景,首选计算框架是()
A.HiveB.FlinkC.SparkCoreD.Impala
答案:B
解析:Flink支持毫秒级低延迟实时计算、支持状态管理,适配通信行业时延敏感的实时数据场景;Spark为微批处理,延迟高于Flink,Hive、Impala仅用于离线查询分析。
3、以下关于Hive分区表的说法,错误的是()
A.分区可减少查询扫描的数据量,提升查询效率
B.分区字段必须是表中真实存储的字段
C.常用分区维度为日期、地区、基站编号
D.静态分区适合批量离线数据写入
答案:B
解析:Hive分区字段为虚拟字段,仅用于目录分层存储,不会写入数据表实际数据中,是大数据分层存储的常用优化手段。
4、SQL中实现去重统计的关键字是()
A.DISTINCTB.UNIQUEC.EX
原创力文档

文档评论(0)