《大数据开发技术》试卷库_第1页
《大数据开发技术》试卷库_第2页
《大数据开发技术》试卷库_第3页
《大数据开发技术》试卷库_第4页
《大数据开发技术》试卷库_第5页
已阅读5页,还剩25页未读, 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

PAGE1PAGE《大数据开发技术》课程配套考试题__A卷一、单选题(20题,每题1分,共20分)默认的MapReduce输入格式是()。

A.TextInputFormat

B.KeyValueTextInputFormat

C.NLineInputFormat

D.SequenceFileInputFormat下列哪个程序通常与NameNode在一个节点启动()。SecondaryNameNode

B.DataNode

C.TaskTracker

D.SequenceFileInputFormatNamenode在启动时自动进入安全模式,在安全模式阶段,说法错误的是()。A.安全模式目的是在系统启动时检查各个DataNode上数据块的有效性

B.根据策略对数据块进行必要的复制或删除

C.当数据块最小百分比数满足的最小副本数条件时,会自动退出安全模式

D.文件系统允许有修改下列关于HDFS的描述正确的是()。A.如果NameNode宕机,SecondaryNameNode会接替它使集群继续工作

B.HDFS集群支持数据的随机读写

C.NameNode磁盘元数据不保存Block的位置信息

D.DataNode通过长连接与NameNode保持通信YARN中资源抽象用什么表示()。内存

B.CPU

C.Container

D.磁盘空间Loader作业运行前后,需要保证哪些节点与外部数据源通讯?()。Loader进程所在的节点

B.运行MapReduce作业的节点

C.前面两个都需要

D.前面两个都不需要关于Hive与Hadoop其他组件的关系,描述错误的是?()。HIVE最终将数据存储在HDFS中

B.HiveSQL其本质是执行的MapReduce任务

C.Hive是Hadoop平台的数据仓库工具

D.Hive对HBase有强依赖Hadoop的MapReduce组件擅长处理哪些场景的计算任务?()。迭代计算

B.离线计算

C.实时交互计算

D.流式计算哪儿模块负责HDFS数据存储?()。NameNode

B.DateNode

C.ZooKeeper

D.JobTrackerHadoop平台中,要查看YARN服务中一个application的信息,通常需要使用什么命令?()。container

B.applicationattempt

C.jar

D.application启用日志聚集功能,需要配置哪个参数()。A.yarn.nodemanager.local-dirs

B.yarn.nodemanager.log-dirs

C.yarn.acl.enable

D.yarn.log-aggregation-enableYARN中的调度器匹配资源申请的顺序,哪一个正确()。A.任意机器>同机架>本地资源

B.任意机器>本地资源>同机架

C.本地资源>同机架>任意机架

D.同机架>任意机器>本地资源与其他几项不同的是()。A.Mesos

B.Mongodb

C.Corona

D.YARNhadoop2.x采用什么技术构建源代码()。A.ant

B.ivy

C.maven

D.makefile以下哪种不是hadoop对于小文件的处理方式()。A.SequenceFile

B.CombinedInputFormat

D.MapFile

C.ByteBuffer关系型数据库与HDFS之间相互数据迁移的工具是()。A.distcp

B.fsck

C.fastcopy

D.sqoophadoop处在云计算三层模型中哪一层()。PaaS

B.SaaS

C.IasS

D.介于IaaS和PaaS之间DistributedFileSystem调用create方法后的返回类型是()。FSDataOutputStream

B.DataOutputStream

C.DFSOutputStream

D.FSDataInputStreamSecondaryNamenode的作用是()。监控Namenode

B.管理Datanode

C.合并fsimage和editlogs

D.支持NamenodeHA为销售报表展示开发一个MapReduce作业,Mapper输入数据的Key是年份(IntWritable),Value表示商品标识(Text)。下列哪一项决定该Mapper的数据类型()。A.JobConf.setMapInputKeyClass与JobConf.setMapInputValuesClass

B.HADOOP_MAP_DATATYPES环境变量

C.随作业一起提交的mapper-specification.xml文件

D.InputFormat格式类二、多选题(10题,每题2分,共20分)下列关于hadoop集群启动中的所有进程及其作用,正确的有?()A.Namenode管理集群,记录namenode文件信息B.Secondname可以做备份,对一定范围内的数据做快照C.Datanode存储数据D.Jobtarcker管理任务,分配任务YARN作为Hadoop的资源管理器,它的引入为集群带来了哪些好处?()A.主备节点协调机制B.资源利用率高C.运维成本降低D.数据共享方便关于“zookeeper”在Hadoop集群中的作用,下列描述正确的有?()管理跨节点配置

B.实现可靠的消息传递

C.实现冗余服务

D.异步流程执行下面哪些是“MapReduce的”计划的主要配置参数?()A.在分布式文件系统作业的输入位置

B.输入格式

C.包含“map”功能类

D.包含“reduce”功能类下面对HBase的描述哪些是正确的?()A.不是开源的B.是面向列的C.是分布式的D.是一种NoSQL数据库MapReduce与HBase的关系,哪些描述是正确的?()A.两者不可或缺,MapReduce是HBase可以正常运行的保证B.两者不是强关联关系,没有MapReduce,HBase可以正常运行C.MapReduce可以直接访问HBaseD.它们之间没有任何关系下面哪些选项正确描述了HBase的特性?()A.高可靠性B.高性能C.面向列D.可伸缩以下哪些是HDFS的守护进程?()secondarynamenode

B.datanode

C.mrappmaster/yarnchild

D.namenode以下描述错误的是?()A.输入分片InputSplit其实是对数据的引用B.MultipleInputs可以设置多个数据源以及它们对应的输入格式C.可以通过重载isSplitable()方法来避免文件分片D.ReduceTask需要等到所有的map输出都复制完才进行Merge以下描述正确的是?()A.SequenceFile可以用来作为小文件的合并存储容器B.TextInputFormat的key是LongWritable类型的C.CombineFileInputFormat是抽象类D.TextInputFormat的key是指该记录在文件中的行号三、判断题(10题,每题2分,共20分)1.Hadoop是Java开发的,所以MapReduce只支持Java语言编写。()2.NameNode负责管理metadata,client端每次读写请求,它都会从磁盘中读取或则会写入metadata信息并反馈client端。()3.Yarn只能支持MapReduce框架。()4.NameNode本地磁盘保存了Block的位置信息。()5.Hadoop默认调度器策略为FIFO。()6.HDFSClient写入文件时,Client会随机选取本机架的DataNode存储。()7.HDFS采用多副本机制,数据的读写操作都遵从就近原则。()8.HDFS适用于高吞吐量的实时数据读取()9.因为HDFS有多个副本,所以NameNode是不存在单点问题的。()10.Mapreduce的inputsplit就是一个block。()四、简答题(4题,每题5分,共20分)一个datanode宕机,怎么一个流程恢复?答:

2、hadoop的namenode宕机,怎么解决?

答:3、简述hadoop安装过程?

答:4、请列出hadoop正常工作时要启动那些进程,并写出各自的作用

答:五、应用题(2题,每题10分,共20分)hadoop节点动态下线怎么操作;答:2、列举几个hadoop生态圈的组件并做简要描述;答:

《大数据开发技术》课程配套考试题_A卷答案一、单选题(20题,每题1分,共20分)默认的MapReduce输入格式是(A)。

A.TextInputFormat

B.KeyValueTextInputFormat

C.NLineInputFormat

D.SequenceFileInputFormat下列哪个程序通常与NameNode在一个节点启动(D)。SecondaryNameNode

B.DataNode

C.TaskTracker

D.SequenceFileInputFormatNamenode在启动时自动进入安全模式,在安全模式阶段,说法错误的是(D)。A.安全模式目的是在系统启动时检查各个DataNode上数据块的有效性

B.根据策略对数据块进行必要的复制或删除

C.当数据块最小百分比数满足的最小副本数条件时,会自动退出安全模式

D.文件系统允许有修改下列关于HDFS的描述正确的是(C)。A.如果NameNode宕机,SecondaryNameNode会接替它使集群继续工作

B.HDFS集群支持数据的随机读写

C.NameNode磁盘元数据不保存Block的位置信息

D.DataNode通过长连接与NameNode保持通信YARN中资源抽象用什么表示(C)。内存

B.CPU

C.Container

D.磁盘空间Loader作业运行前后,需要保证哪些节点与外部数据源通讯?(C)。Loader进程所在的节点

B.运行MapReduce作业的节点

C.前面两个都需要

D.前面两个都不需要关于Hive与Hadoop其他组件的关系,描述错误的是?(D)。HIVE最终将数据存储在HDFS中

B.HiveSQL其本质是执行的MapReduce任务

C.Hive是Hadoop平台的数据仓库工具

D.Hive对HBase有强依赖Hadoop的MapReduce组件擅长处理哪些场景的计算任务?(B)。迭代计算

B.离线计算

C.实时交互计算

D.流式计算哪儿模块负责HDFS数据存储?(B)。NameNode

B.DateNode

C.ZooKeeper

D.JobTrackerHadoop平台中,要查看YARN服务中一个application的信息,通常需要使用什么命令?(D)。container

B.applicationattempt

C.jar

D.application启用日志聚集功能,需要配置哪个参数(D)。A.yarn.nodemanager.local-dirs

B.yarn.nodemanager.log-dirs

C.yarn.acl.enable

D.yarn.log-aggregation-enableYARN中的调度器匹配资源申请的顺序,哪一个正确(C)。A.任意机器>同机架>本地资源

B.任意机器>本地资源>同机架

C.本地资源>同机架>任意机架

D.同机架>任意机器>本地资源与其他几项不同的是(B)。A.Mesos

B.Mongodb

C.Corona

D.YARNhadoop2.x采用什么技术构建源代码(C)。A.ant

B.ivy

C.maven

D.makefile以下哪种不是hadoop对于小文件的处理方式(C)。A.SequenceFile

B.CombinedInputFormat

D.MapFile

C.ByteBuffer关系型数据库与HDFS之间相互数据迁移的工具是(D)。A.distcp

B.fsck

C.fastcopy

D.sqoophadoop处在云计算三层模型中哪一层(A)。PaaS

B.SaaS

C.IasS

D.介于IaaS和PaaS之间DistributedFileSystem调用create方法后的返回类型是(A)。FSDataOutputStream

B.DataOutputStream

C.DFSOutputStream

D.FSDataInputStreamSecondaryNamenode的作用是(C)。监控Namenode

B.管理Datanode

C.合并fsimage和editlogs

D.支持NamenodeHA为销售报表展示开发一个MapReduce作业,Mapper输入数据的Key是年份(IntWritable),Value表示商品标识(Text)。下列哪一项决定该Mapper的数据类型(D)。A.JobConf.setMapInputKeyClass与JobConf.setMapInputValuesClass

B.HADOOP_MAP_DATATYPES环境变量

C.随作业一起提交的mapper-specification.xml文件

D.InputFormat格式类二、多选题(10题,每题2分,共20分)下列关于hadoop集群启动中的所有进程及其作用,正确的有?(ABCD)A.Namenode管理集群,记录namenode文件信息B.Secondname可以做备份,对一定范围内的数据做快照C.Datanode存储数据D.Jobtarcker管理任务,分配任务YARN作为Hadoop的资源管理器,它的引入为集群带来了哪些好处?(BCD)A.主备节点协调机制B.资源利用率高C.运维成本降低D.数据共享方便关于“zookeeper”在Hadoop集群中的作用,下列描述正确的有?(ABC)管理跨节点配置

B.实现可靠的消息传递

C.实现冗余服务

D.异步流程执行下面哪些是“MapReduce的”计划的主要配置参数?(ABCD)A.在分布式文件系统作业的输入位置

B.输入格式

C.包含“map”功能类

D.包含“reduce”功能类下面对HBase的描述哪些是正确的?(BCD)A.不是开源的B.是面向列的C.是分布式的D.是一种NoSQL数据库MapReduce与HBase的关系,哪些描述是正确的?(BC)A.两者不可或缺,MapReduce是HBase可以正常运行的保证B.两者不是强关联关系,没有MapReduce,HBase可以正常运行C.MapReduce可以直接访问HBaseD.它们之间没有任何关系下面哪些选项正确描述了HBase的特性?(ABCD)A.高可靠性B.高性能C.面向列D.可伸缩以下哪些是HDFS的守护进程?(ABD)secondarynamenode

B.datanode

C.mrappmaster/yarnchild

D.namenode以下描述错误的是?(ABC)A.输入分片InputSplit其实是对数据的引用B.MultipleInputs可以设置多个数据源以及它们对应的输入格式C.可以通过重载isSplitable()方法来避免文件分片D.ReduceTask需要等到所有的map输出都复制完才进行Merge以下描述正确的是?(ABC)A.SequenceFile可以用来作为小文件的合并存储容器B.TextInputFormat的key是LongWritable类型的C.CombineFileInputFormat是抽象类D.TextInputFormat的key是指该记录在文件中的行号三、判断题(10题,每题2分,共20分)1.Hadoop是Java开发的,所以MapReduce只支持Java语言编写。(×)2.NameNode负责管理metadata,client端每次读写请求,它都会从磁盘中读取或则会写入metadata信息并反馈client端。(×)3.Yarn只能支持MapReduce框架。(×)4.NameNode本地磁盘保存了Block的位置信息。(√)5.Hadoop默认调度器策略为FIFO。(√)6.HDFSClient写入文件时,Client会随机选取本机架的DataNode存储。(×)7.HDFS采用多副本机制,数据的读写操作都遵从就近原则。(×)8.HDFS适用于高吞吐量的实时数据读取(×)9.因为HDFS有多个副本,所以NameNode是不存在单点问题的。(×)10.Mapreduce的inputsplit就是一个block。(×)四、简答题(4题,每题5分,共20分)1、一个datanode宕机,怎么一个流程恢复?

答:Datanode宕机了后,如果是短暂的宕机,可以实现写好脚本监控,将它启动起来。如果是长时间宕机了,那么datanode上的数据应该已经被备份到其他机器了,那这台datanode就是一台新的datanode了,删除他的所有数据文件和状态文件,重新启动

2、hadoop的namenode宕机,怎么解决?

答:先分析宕机后的损失,宕机后直接导致client无法访问,内存中的元数据丢失,但是硬盘中的元数据应该还存在,如果只是节点挂了,重启即可,如果是机器挂了,重启机器后看节点是否能重启,不能重启就要找到原因修复了。但是最终的解决方案应该是在设计集群的初期就考虑到这个问题,做namenode的HA3、简述hadoop安装过程?

答:改IP,修改Host文件;装JDK配置环境变量;装Hadoop配置环境变量;修改hadoop的配置文件如core-site、marp-site、yarn-site、dfs-site等;namenode进行格式化;start-all;4、请列出hadoop正常工作时要启动那些进程,并写出各自的作用

答:namenode:管理集群并记录datanode的元数据,相应客户端的请求。secondernamenode:对namenode一定范围内的数据做一份快照性备份。datanode:存储数据。jobTracker:管理客户端提交的任务,并将任务分配给TaskTracker。五、应用题(2题,每题10分,共20分)hadoop节点动态下线怎么操作;答:节点下线操作:(1)、修改/conf/hdfs-site.xml文件(2)、确定需要下线的机器,dfs.osts.exclude文件中配置好需要下架的机器,这个是阻止下架的机器去连接NameNode(3)、配置完成之后进行配置的刷新操作./bin/hadoopdfsadmin-refreshNodes,这个操作的作用是在后台进行block块的移动(4)、当执行三的命令完成之后,需要下架的机器就可以关闭了,可以查看现在集群上连接的节点,正在执行Decommission,会显示:DecommissionStatus:Decommissioninprogress执行完毕后,会显示:DecommissionStatus:Decommissioned、机器下线完毕,将他们从excludes文件中移除2、列举几个hadoop生态圈的组件并做简要描述;答:Zookeeper:是一个开源的分布式应用程序协调服务,基于zookeeper可以实现同步服务,配置维护,命名服务。Flume:一个高可用的,高可靠的,分布式的海量日志采集、聚合和传输的系统。Hbase:是一个分布式的、面向列的开源数据库,利用HadoopHDFS作为其存储系统.Hive:基于Hadoop的一个数据仓库工具,可以将结构化的数据档映射为一张数据库表,并提供简单的sql查询功能,可以将sql语句转换为MapReduce任务进行运行。Sqoop:将一个关系型数据库中的数据导进到Hadoop的HDFS中,也可以将HDFS的数据导进到关系型数据库中

《大数据开发技术》课程配套考试题_B卷一、单选题(20题,每题1分,共20分)Namenode在启动时自动进入安全模式,在安全模式阶段,说法错误的是()。A.安全模式目的是在系统启动时检查各个DataNode上数据块的有效性

B.根据策略对数据块进行必要的复制或删除

C.当数据块最小百分比数满足的最小副本数条件时,会自动退出安全模式

D.文件系统允许有修改下列关于HDFS的描述正确的是()。A.如果NameNode宕机,SecondaryNameNode会接替它使集群继续工作

B.HDFS集群支持数据的随机读写

C.NameNode磁盘元数据不保存Block的位置信息

D.DataNode通过长连接与NameNode保持通信默认的MapReduce输入格式是()。

A.TextInputFormat

B.KeyValueTextInputFormat

C.NLineInputFormat

D.SequenceFileInputFormat下列哪个程序通常与NameNode在一个节点启动()。SecondaryNameNode

B.DataNode

C.TaskTracker

D.SequenceFileInputFormatYARN中资源抽象用什么表示()。内存

B.CPU

C.Container

D.磁盘空间Hadoop的MapReduce组件擅长处理哪些场景的计算任务?()。迭代计算

B.离线计算

C.实时交互计算

D.流式计算Loader作业运行前后,需要保证哪些节点与外部数据源通讯?()。Loader进程所在的节点

B.运行MapReduce作业的节点

C.前面两个都需要

D.前面两个都不需要关于Hive与Hadoop其他组件的关系,描述错误的是?()。HIVE最终将数据存储在HDFS中

B.HiveSQL其本质是执行的MapReduce任务

C.Hive是Hadoop平台的数据仓库工具

D.Hive对HBase有强依赖哪儿模块负责HDFS数据存储?()。NameNode

B.DateNode

C.ZooKeeper

D.JobTrackerYARN中的调度器匹配资源申请的顺序,哪一个正确()。A.任意机器>同机架>本地资源

B.任意机器>本地资源>同机架

C.本地资源>同机架>任意机架

D.同机架>任意机器>本地资源与其他几项不同的是()。A.Mesos

B.Mongodb

C.Corona

D.YARNHadoop平台中,要查看YARN服务中一个application的信息,通常需要使用什么命令?()。container

B.applicationattempt

C.jar

D.application启用日志聚集功能,需要配置哪个参数()。A.yarn.nodemanager.local-dirs

B.yarn.nodemanager.log-dirs

C.yarn.acl.enable

D.yarn.log-aggregation-enablehadoop2.x采用什么技术构建源代码()。A.ant

B.ivy

C.maven

D.makefile以下哪种不是hadoop对于小文件的处理方式()。A.SequenceFile

B.CombinedInputFormat

D.MapFile

C.ByteBufferDistributedFileSystem调用create方法后的返回类型是()。FSDataOutputStream

B.DataOutputStream

C.DFSOutputStream

D.FSDataInputStreamSecondaryNamenode的作用是()。监控Namenode

B.管理Datanode

C.合并fsimage和editlogs

D.支持NamenodeHA为销售报表展示开发一个MapReduce作业,Mapper输入数据的Key是年份(IntWritable),Value表示商品标识(Text)。下列哪一项决定该Mapper的数据类型()。A.JobConf.setMapInputKeyClass与JobConf.setMapInputValuesClass

B.HADOOP_MAP_DATATYPES环境变量

C.随作业一起提交的mapper-specification.xml文件

D.InputFormat格式类关系型数据库与HDFS之间相互数据迁移的工具是()。A.distcp

B.fsck

C.fastcopy

D.sqoophadoop处在云计算三层模型中哪一层()。PaaS

B.SaaS

C.IasS

D.介于IaaS和PaaS之间二、多选题(10题,每题2分,共20分)关于“zookeeper”在Hadoop集群中的作用,下列描述正确的有?()管理跨节点配置

B.实现可靠的消息传递

C.实现冗余服务

D.异步流程执行下面哪些是“MapReduce的”计划的主要配置参数?()A.在分布式文件系统作业的输入位置

B.输入格式

C.包含“map”功能类

D.包含“reduce”功能类下列关于hadoop集群启动中的所有进程及其作用,正确的有?()A.Namenode管理集群,记录namenode文件信息B.Secondname可以做备份,对一定范围内的数据做快照C.Datanode存储数据D.Jobtarcker管理任务,分配任务YARN作为Hadoop的资源管理器,它的引入为集群带来了哪些好处?()A.主备节点协调机制B.资源利用率高C.运维成本降低D.数据共享方便下面对HBase的描述哪些是正确的?()A.不是开源的B.是面向列的C.是分布式的D.是一种NoSQL数据库以下哪些是HDFS的守护进程?()secondarynamenode

B.datanode

C.mrappmaster/yarnchild

D.namenode以下描述错误的是?()A.输入分片InputSplit其实是对数据的引用B.MultipleInputs可以设置多个数据源以及它们对应的输入格式C.可以通过重载isSplitable()方法来避免文件分片D.ReduceTask需要等到所有的map输出都复制完才进行MergeMapReduce与HBase的关系,哪些描述是正确的?()A.两者不可或缺,MapReduce是HBase可以正常运行的保证B.两者不是强关联关系,没有MapReduce,HBase可以正常运行C.MapReduce可以直接访问HBaseD.它们之间没有任何关系以下描述正确的是?()A.SequenceFile可以用来作为小文件的合并存储容器B.TextInputFormat的key是LongWritable类型的C.CombineFileInputFormat是抽象类D.TextInputFormat的key是指该记录在文件中的行号下面哪些选项正确描述了HBase的特性?()A.高可靠性B.高性能C.面向列D.可伸缩三、判断题(10题,每题2分,共20分)1.NameNode本地磁盘保存了Block的位置信息。()2.Hadoop默认调度器策略为FIFO。()3.HDFSClient写入文件时,Client会随机选取本机架的DataNode存储。()4.HDFS采用多副本机制,数据的读写操作都遵从就近原则。()5.HDFS适用于高吞吐量的实时数据读取()6.因为HDFS有多个副本,所以NameNode是不存在单点问题的。()7.Mapreduce的inputsplit就是一个block。()8.Hadoop是Java开发的,所以MapReduce只支持Java语言编写。()9.NameNode负责管理metadata,client端每次读写请求,它都会从磁盘中读取或则会写入metadata信息并反馈client端。()10.Yarn只能支持MapReduce框架。()四、简答题(4题,每题5分,共20分)1、hadoop的namenode宕机,怎么解决?

答:2、一个datanode宕机,怎么一个流程恢复?

答:

3、请列出hadoop正常工作时要启动那些进程,并写出各自的作用

答:4、简述hadoop安装过程?

答:五、应用题(2题,每题10分,共20分)1、列举几个hadoop生态圈的组件并做简要描述;答:2、hadoop节点动态下线怎么操作;答:

《大数据开发技术》课程配套考试题_B卷答案一、单选题(20题,每题1分,共20分)Namenode在启动时自动进入安全模式,在安全模式阶段,说法错误的是(D)。A.安全模式目的是在系统启动时检查各个DataNode上数据块的有效性

B.根据策略对数据块进行必要的复制或删除

C.当数据块最小百分比数满足的最小副本数条件时,会自动退出安全模式

D.文件系统允许有修改下列关于HDFS的描述正确的是(C)。A.如果NameNode宕机,SecondaryNameNode会接替它使集群继续工作

B.HDFS集群支持数据的随机读写

C.NameNode磁盘元数据不保存Block的位置信息

D.DataNode通过长连接与NameNode保持通信默认的MapReduce输入格式是(A)。

A.TextInputFormat

B.KeyValueTextInputFormat

C.NLineInputFormat

D.SequenceFileInputFormat下列哪个程序通常与NameNode在一个节点启动(D)。SecondaryNameNode

B.DataNode

C.TaskTracker

D.SequenceFileInputFormatYARN中资源抽象用什么表示(C)。内存

B.CPU

C.Container

D.磁盘空间Hadoop的MapReduce组件擅长处理哪些场景的计算任务?(B)。迭代计算

B.离线计算

C.实时交互计算

D.流式计算Loader作业运行前后,需要保证哪些节点与外部数据源通讯?(C)。Loader进程所在的节点

B.运行MapReduce作业的节点

C.前面两个都需要

D.前面两个都不需要关于Hive与Hadoop其他组件的关系,描述错误的是?(D)。HIVE最终将数据存储在HDFS中

B.HiveSQL其本质是执行的MapReduce任务

C.Hive是Hadoop平台的数据仓库工具

D.Hive对HBase有强依赖哪儿模块负责HDFS数据存储?(B)。NameNode

B.DateNode

C.ZooKeeper

D.JobTrackerYARN中的调度器匹配资源申请的顺序,哪一个正确(C)。A.任意机器>同机架>本地资源

B.任意机器>本地资源>同机架

C.本地资源>同机架>任意机架

D.同机架>任意机器>本地资源与其他几项不同的是(B)。A.Mesos

B.Mongodb

C.Corona

D.YARNHadoop平台中,要查看YARN服务中一个application的信息,通常需要使用什么命令?(D)。container

B.applicationattempt

C.jar

D.application启用日志聚集功能,需要配置哪个参数(D)。A.yarn.nodemanager.local-dirs

B.yarn.nodemanager.log-dirs

C.yarn.acl.enable

D.yarn.log-aggregation-enablehadoop2.x采用什么技术构建源代码(C)。A.ant

B.ivy

C.maven

D.makefile以下哪种不是hadoop对于小文件的处理方式(C)。A.SequenceFile

B.CombinedInputFormat

D.MapFile

C.ByteBufferDistributedFileSystem调用create方法后的返回类型是(A)。FSDataOutputStream

B.DataOutputStream

C.DFSOutputStream

D.FSDataInputStreamSecondaryNamenode的作用是(C)。监控Namenode

B.管理Datanode

C.合并fsimage和editlogs

D.支持NamenodeHA为销售报表展示开发一个MapReduce作业,Mapper输入数据的Key是年份(IntWritable),Value表示商品标识(Text)。下列哪一项决定该Mapper的数据类型(D)。A.JobConf.setMapInputKeyClass与JobConf.setMapInputValuesClass

B.HADOOP_MAP_DATATYPES环境变量

C.随作业一起提交的mapper-specification.xml文件

D.InputFormat格式类关系型数据库与HDFS之间相互数据迁移的工具是(D)。A.distcp

B.fsck

C.fastcopy

D.sqoophadoop处在云计算三层模型中哪一层(A)。PaaS

B.SaaS

C.IasS

D.介于IaaS和PaaS之间二、多选题(10题,每题2分,共20分)关于“zookeeper”在Hadoop集群中的作用,下列描述正确的有?(ABC)管理跨节点配置

B.实现可靠的消息传递

C.实现冗余服务

D.异步流程执行下面哪些是“MapReduce的”计划的主要配置参数?(ABCD)A.在分布式文件系统作业的输入位置

B.输入格式

C.包含“map”功能类

D.包含“reduce”功能类下列关于hadoop集群启动中的所有进程及其作用,正确的有?(ABCD)A.Namenode管理集群,记录namenode文件信息B.Secondname可以做备份,对一定范围内的数据做快照C.Datanode存储数据D.Jobtarcker管理任务,分配任务YARN作为Hadoop的资源管理器,它的引入为集群带来了哪些好处?(BCD)A.主备节点协调机制B.资源利用率高C.运维成本降低D.数据共享方便下面对HBase的描述哪些是正确的?(BCD)A.不是开源的B.是面向列的C.是分布式的D.是一种NoSQL数据库以下哪些是HDFS的守护进程?(ABD)secondarynamenode

B.datanode

C.mrappmaster/yarnchild

D.namenode以下描述错误的是?(ABC)A.输入分片InputSplit其实是对数据的引用B.MultipleInputs可以设置多个数据源以及它们对应的输入格式C.可以通过重载isSplitable()方法来避免文件分片D.ReduceTask需要等到所有的map输出都复制完才进行MergeMapReduce与HBase的关系,哪些描述是正确的?(BC)A.两者不可或缺,MapReduce是HBase可以正常运行的保证B.两者不是强关联关系,没有MapReduce,HBase可以正常运行C.MapReduce可以直接访问HBaseD.它们之间没有任何关系以下描述正确的是?(ABC)A.SequenceFile可以用来作为小文件的合并存储容器B.TextInputFormat的key是LongWritable类型的C.CombineFileInputFormat是抽象类D.TextInputFormat的key是指该记录在文件中的行号下面哪些选项正确描述了HBase的特性?(ABCD)A.高可靠性B.高性能C.面向列D.可伸缩三、判断题(10题,每题2分,共20分)1.NameNode本地磁盘保存了Block的位置信息。(√)2.Hadoop默认调度器策略为FIFO。(√)3.HDFSClient写入文件时,Client会

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论