- 31
- 0
- 约4.09万字
- 约 67页
- 2021-10-22 发布于河南
- 举报
大数据工程师面试题
1.选择题
1.1. 下面哪个程序负责 HDFS 数据存储。
a)NameNode b)Jobtracker c)Datanode d)secondaryNameNode e)tasktracker
答案 C datanode
1.2. HDfS 中的 block 默认保存几份
a)3 份 b)2 份 c)1 份 d)不确定
答案 A 默认 3 份
1.3. 下列哪个程序通常与 NameNode 在一个节点启
动?
a)SecondaryNameNode b)DataNode c)TaskTracker d)Jobtracker
答案 D
1.4. HDFS 默认 Block Size
a)32MB b)64MB c)128MB
答案:B
1.5. 下列哪项通常是集群的最主要瓶颈
a)CPU b)网络 c)磁盘 IO d) 内存
答案:C 磁盘
首先集群的目的是为了节省成本,用廉价的 pc 机,取代小型机及大型机。小型机和
大型机有什么特点
1.cpu 处理能力强
2. 内存够大,所以集群的瓶颈不可能是 a 和 d
3.如果是互联网有瓶颈,可以让集群搭建内网。每次写入数据都要通过网络(集群是
内网),然后还要写入 3 份数据,所以 IO 就会打折扣。
1.6. 关于 SecondaryNameNode 哪项是正确的
a)它是 NameNode 的热备 b)它对内存没有要求
c)它的目的是帮助 NameNode 合并编辑日志,减少 NameNode 启动时间
d)SecondaryNameNode 应与 NameNode 部署到一个节点
答案 C 。
1.7. 下列哪项可以作为集群的管理
a)Puppet b)Pdsh c)Cloudera Manager d)Zookeeper
答案 ABD
具体可查看什么是 Zookeeper ,Zookeeper 的作用是什么,在 Hadoop 及 hbase 中具
体作用是什么。
1.8. Client 端上传文件的时候下列哪项正确
a)数据经过 NameNode 传递给 DataNode
b)Client 端将文件切分为 Block ,依次上传
c)Client 只上传数据到一台 DataNode ,然后由 NameNode 负责 Block 复制工作
答案 B
分析:Client 向 NameNode 发起文件写入的请求。NameNode 根据文件大小和文件块
配置情况,返回给 Client 它所管理部分 DataNode 的信息。Client 将文件划分为多个
Block,根据 DataNode 的地址信息,按顺序写入到每一个 DataNode 块中。具体查看
HDFS 体系结构简介及优缺点。
1.9. 下列哪个是 Hadoop 运行的模式
a)单机版 b)伪分布式 c)分布式
答案 ABC 单机版,伪分布式只是学习用的。
2. 面试题
2.1. Hadoop 的核心配置是什么
Hadoop 的核心配置通过两个xml 文件来完成:1,hadoop-default.xml;2,hadoop-
site.xml 。这些文件都使用xml 格式,因此每个 xml 中都有一些属性,包括名称和值,
但是当下这些文件都已不复存在。
2.2. 那当下又该如何配置
Hadoop 现在拥有 3 个配置文件:1,core-site.xml ;2,hdfs-site.xml;3,mapred-
site.xml 。这些文件都保存在conf/子目录下。
2.3. “jps ”命令的用处
这个命令可以检查 Namenode、Datanode、Task Tracker 、 Job Tracker 是否正常工作。
2.4.
您可能关注的文档
最近下载
- 射线检验报告.pdf VIP
- 机械工程师(中级资格)试卷题库及答案.docx VIP
- 外国文学2知到智慧树期末考试答案题库2024年秋绍兴文理学院.docx VIP
- 高标准基本 农田项目施工总结报告教学教案.doc VIP
- 园林绿化养护合同(2025年小区).docx
- 人教版四年级数学下册第二单元观察物体(二)质量测评卷(含答案).pdf VIP
- 外国文学2智慧树知到期末考试答案章节答案2024年绍兴文理学院.docx VIP
- GB 55030-2022 建筑与市政工程防水通用规范.docx VIP
- 湘教版地理八年级下册 第六章 第一节 东北地区的地理位置与自然环境 课件.ppt
- 外国文学2知到智慧树期末考试答案题库2025年绍兴文理学院.docx VIP
原创力文档

文档评论(0)