会员中心     

《大数据面试题100道》PDF

津康制药
V 实名认证
内容提供者
热门搜索
大数据 面试试题
欧亿·体育(中国)有限公司大小:2273KB(压缩后)
文档格式:PDF(62页)
欧亿·体育(中国)有限公司语言:中文版/英文版/日文版
解压密码:m448
更新时间:2024/9/18(发布于天津)

类型:金牌欧亿·体育(中国)有限公司
积分:--
推荐:升级会员

   点此下载 ==>> 点击下载文档


“《大数据面试题100道》PDF”第1页图片 图片预览结束,如需查阅完整内容,请下载文档!
文本描述
大数据工程师面试题 1.选择题 1.1.下面哪个程序负责 HDFS 数据存储。 a)NameNode b)Jobtracker c)Datanode d)secondaryNameNode e)tasktracker 答案 C datanode 1.2.HDfS 中的 block 默认保存几份? a)3份 b)2份 c)1份 d)不确定 答案 A默认 3份 1.3.下列哪个程序通常与 NameNode在一个节点启动? a)SecondaryNameNode b)DataNode c)TaskTracker d)Jobtracker 答案 D 1.4.HDFS 默认 Block Size a)32MB b)64MB c)128MB 答案:B 1.5.下列哪项通常是集群的最主要瓶颈 a)CPU b)网络 c)磁盘 IO d)内存 答案:C磁盘 首先集群的目的是为了节省成本,用廉价的 pc机,取代小型机及大型机。小型机和大型机 有什么特点? 1.cpu处理能力强 2.内存够大,所以集群的瓶颈不可能是 a和 d 3.如果是互联网有瓶颈,可以让集群搭建内网。每次写入数据都要通过网络(集群是内网), 然后还要写入 3份数据,所以 IO就会打折扣。 1.6.关于 SecondaryNameNode 哪项是正确的? a)它是 NameNode的热备 b)它对内存没有要求 c)它的目的是帮助 NameNode合并编辑日志,减少 NameNode启动时间 d)SecondaryNameNode应与 NameNode部署到一个节点 答案 C。 1.7.下列哪项可以作为集群的管理? a)Puppet b)Pdsh c)Cloudera Manager d)Zookeeper 答案 ABD 具体可查看什么是 Zookeeper,Zookeeper的作用是什么,在 Hadoop及 hbase中具体作 用是什么。 1.8.Client 端上传文件的时候下列哪项正确 a)数据经过 NameNode传递给 DataNode b)Client端将文件切分为 Block,依次上传 c)Client只上传数据到一台 DataNode,然后由 NameNode负责 Block复制工作 答案 B 分析:Client向 NameNode发起文件写入的请求。NameNode根据文件大小和文件块配置 情况,返回给 Client它所管理部分 DataNode的信息。Client将文件划分为多个 Block,根 据 DataNode的地址信息,按顺序写入到每一个 DataNode块中。具体查看 HDFS体系结构 简介及优缺点。 1.9.下列哪个是 Hadoop 运行的模式 a)单机版 b)伪分布式 c)分布式 答案 ABC单机版,伪分布式只是学习用的。 2.面试题 2.1. Hadoop的核心配置是什么? Hadoop的核心配置通过两个 xml文件来完成:1,hadoop-default.xml;2,hadoop-site.xml。 这些文件都使用 xml格式,因此每个 xml中都有一些属性,包括名称和值,但是当下这些文 件都已不复存在。 2.2.那当下又该如何配置? Hadoop现在拥有 3个配置文件:1,core-site.xml;2,hdfs-site.xml;3,mapred-site.xml。这 些文件都保存在 conf/子目录下。 2.3.“jps”命令的用处? 这个命令可以检查 Namenode、Datanode、Task Tracker、

版权所有: 欧亿·体育(中国)有限公司©2025 客服电话: 0411-88895936 18842816135

欧亿·体育(中国)有限公司