2025贵州遵义南国大数据有限公司招聘100人笔试历年难易错考点试卷带答案解析.docxVIP

  • 0
  • 0
  • 约1.4万字
  • 约 29页
  • 2026-08-12 发布于四川
  • 举报

2025贵州遵义南国大数据有限公司招聘100人笔试历年难易错考点试卷带答案解析.docx

2025贵州遵义南国大数据有限公司招聘100人笔试历年难易错考点试卷带答案解析

一、选择题

从给出的选项中选择正确答案(共50题)

1、在数据清洗过程中,若发现某字段存在大量缺失值且数据分布偏态,下列哪种处理方式最合适?

A.直接删除包含该字段的记录

B.用字段均值填充缺失值

C.用字段中位数填充缺失值

D.用众数填充缺失值

2、关于Hadoop和Spark在处理大规模数据时的核心差异,以下哪项描述正确?

A.Spark支持分布式文件系统而Hadoop不支持

B.Spark内存计算适合批处理任务

C.HadoopMapReduce比Spark更擅长迭代计算

D.Spark默认存储格式比Hadoop更高效

3、某公司计划构建大数据平台处理每日10亿条日志数据,以下哪项是大数据核心特征且易被误判?(A)高时效性(B)高一致性(C)海量性(D)低可扩展性

A.数据体量巨大(10亿条日志)

B.处理速度极快(实时分析)

C.数据类型多样(结构化+非结构化)

D.存储成本高昂(每TB成本超过$1000)

4、Hadoop框架中负责任务调度和资源分配的组件是(A)HDFS(B)YARN(C)MapReduce(D)ZooKeeper

A.管理分布式存储系统

B.协调计算任务与集群资源

C.实现分布式文件存储

D.提供分布式协调服

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档