华为大数据 HCIA-Big Data H13-711模拟练习题库(含答案)_第1页
华为大数据 HCIA-Big Data H13-711模拟练习题库(含答案)_第2页
华为大数据 HCIA-Big Data H13-711模拟练习题库(含答案)_第3页
华为大数据 HCIA-Big Data H13-711模拟练习题库(含答案)_第4页
华为大数据 HCIA-Big Data H13-711模拟练习题库(含答案)_第5页
已阅读5页,还剩59页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

华为大数据1"1(3队向9口济2m3-711模拟练习题库(含答案)

一、单选题

l.FusionlnsightHD中使用HBase进行数据读写服务时,需要连接HManager。

A、正确

B、错误

答案:B

2.下列关于Flinkbamer描述错误的是()

A、barrier•周期性的插入到数据流中,并作为数据流的一部分随之流动

B>barrier是Flink快照的核心

C、一个barrier将本周期快照的数据与下一周期快照的数据分隔开来

D、在插入barrier的时候,会暂时阻断数据流

答案:D

3.Flink中的()接口用于流数据处理,()接口用于批处理

A、StreamAPI,BatchAPI

B、DataStreamAPI,Da:aBatchAPI

C、DataBatchAPI,DataStreamAPI

D、BatchAPI,StreamAPI

答案:B

4.YARN中设置队列QueueA最大使用资源量,需要配置哪个参数?

A、yarn,scheduler.capacity.root,QueueA.user-limit-factor

B、yarn,scheduler.capacity.rootsQueueA.minimum-user-limit-fpercent

C、yarn,scheduler.capacity.root,QueueA.state

D、yarn,scheduler.capacity.root,QueueA.maximum-capacity

答案:D

5.FusionlnsightHD节点不支持哪种主机操作系统?

A、Susel1,1

B、Redhat6.5

C、Centos6.4

D>Ubuntu11.04

答案:D

6.FusionlnsightHD集群安装成功后,不允许修改I艮务,角色和实例的配置

A、正确

B、错误

答案:B

7.Kafka集群中,Kafka服务端的角色是?

A、Producer

BxConsumer

C、Zookeeper

D、Broker

答案:D

8.FusionlnsightHD的Loader中,一个连接器只可以分配给一个作业使用

A、对

B、错

答案:B

9.FusionlnsightHD集群三层组网时,管理节点,控制节点,数据节点建议安装在

不同的网段内,可以提高可靠性。

A、正确

B、错误

答案:B

10.FusionlnsightHD中Loader实例必须与哪个实例部署在一起?

A、DataNode

B、RegionServer

C、ResourceManager

D、Nodemanager

答案:D

11.如果FusionlnsightHD集群节点数不足以使数据节点单独部署的情况下,可

以采用管理节点&控制节点&数据节点合一的部署方案,但性能会受限制。

A、正确

B、错误

答案:A

12.Fusinnlnsight.Managftr对服务的管理操作,下面说法错误的是?

A、可对服务进行重启操作

B、可以添加和卸载服务

C、可设置不常用的服务隐藏或显示

D、可查看服务的当前状态

答案:c

13.某用户需要搭建一个350节点的FusionlnsightHD集群,哪种规划方案最佳?

A、管理节点,解忤点,数据节点合T曙,二层组网

B、管理节点,控制节点合一部署,数据节点独立部署,二层组网

C、管理节点,才奔IJ节点,数据节点都独立部署,三层组网

I)、管理节点,数据节点合一部署,控制节点独立部署,二层组网

答案:C

14.YARN服务中,如果要给队列QuqueA设置容量为30%,应该配置哪个参数?

A、yarn.scheduler.capacity.root.QueueA.user-limit-factor

B、yarn.scheduler.capacity.root.QueueA.minimum-user-limit-percent

C、yarn.scheduler.capacity.root.QueueA.capacity

D、yarn.scheduler.capacity.root.QueueA.state

答案:C

15.FusioninsightHD的Manager界面对Loader的操作不包括以下哪个?

A、启动Loader实例

B、查看Loader服务状态

C、配置Loader参数

D、查看Loader运行日志

答案:D

16.FusionlnsightHD的HBase中的一张表情包含以下几个Region]10,20],[20,

30],[30,+=],分别编号123,那么11,20,222,分别属于哪个Region?

A、113

B、123

C、122

D、112

答案:C

17.Hadoop平台中HBase的Region是由哪个服务进程来管理?

A、HMaster

B、Datanode

C>RegionServer

D、Zookeeper

答案:C

18.FusionlnsightHD部署Solr时,如果选择索引放在本地磁盘,建议给每个Sol

「Server实例

A、对

B、错

答案:A

19.Solr创建Collection时,推荐选用路由算法为positldRouter,那么该Colle

ction可以扩展shard.

A、正确

B、错误

答案:B

20.FusionInsightManager对外支持REST接口、SNM唳口、SYSLO(腰口。

A、正确

B、错误

答案:A

21.Loader仅支持关系型数据库与HBase之间的数据导入导出。

A、对

B、错

答案:B

22.加载数据到Hive表,哪种方式不正确?

A、直接将本地路径的文件load到Hive表中

B、将HDFS上的额文件load到Hive表中

C、Hive支持insertinto单条记录的方法,所以可以直接在命令行插入单条记录

D、江其他表的结果集insertinto到Hive表中

答案:C

23.关于Kerberos的TGT以下说法错误的是?

A、TGT全程为票据授权票据,主要由KDC服务器生成

B、TGT一次生成之后,可以无限期使用

C、TGT在客户端的存在方式可以是在内存中存储,也可以在本地以文件的形式存

D、TGT中主要的信息有当前该票据的有效时长和授予该TGT的服务端IP以及分

发给的客户端的名称

答案:B

24.152.Kafka是一个分布式的消息发布订阅系统,它只是进行消息的转发,不会

保存消息。

A、对

B>错

统B

25.Kerberos协议中TGT主要用于应用侧与需要访问的服务之间的安全会话。

A、正确

B、错误

虢:B

26.Flume的peilies配置文件可以配置多个channel来传输数

据。

A、对

B>错

答案:A

27.RDD可以从Hadoop兼容的文件系统生成生成之后可见S过调用RDD的算子

对RDD的数据进彳谙R分更新

A、正确

B、错误

答案:B

28.下列哪条HDFS命令可用于检测数据块的锂性?

A、hdfsfsck/

B、hdfsfsck-delete

C>hdfsdfsadmin-report

D、hdfsbalancer-threshold!

答案:A

29.FusionlnsightManager不能够管理哪个对象?

A、Spark

B、主机OS

C、YARN

D、HDFS

答案:B

30.FusionlnsighlHD系统中,在创建Kafka的Topic时必须设置Parlilion个数

和副本个数,设置副本可以增强Katka服务的容灾能力。

A^正确

B、簸

答案:A

31.当Zookeeper集群的节点数为5节点时,请问集群的容灾能力和多少节点是等

价的?

A、3

B、4

C、6

D、以上都不是

答案:C

32.查看Kafka的某Topic的partition详细信息时,使用如下哪个命令?

A、bin/kafka-topic.sh-create

B、bin/kafka-topic.sh--list

C、bin/kafka-topic.sh-describe

D、bin/kafka-topic.sh-delete

答案:C

33.FusionlnsightHD系统中HBase支持动态扩展列。

A、正确

B、错误

答案:A

34.一下关于Solr角色描述正确的是?

A、SolrServerAdmin属于管理角色,需要部署在管理节点上

B、SolrServer负责提供创建索引和全文检查等服务,是Solr集群中的数据计算

和处理单元

C、HBaselndexer是Solr的必要角色,提供将HBase中数据导入至Solr服务

答案:B

35.关于FusionlnsightHD安装流程正确的是?

A、安装Manager->执行preinstall->LLD工具进行配置-〉安装集群->安装后检

查->安装后配置

B、LLD工具进行配置->执行preinstall->安装Manager->安装集群->安装后检

查-5安装后配置

C、安装Managcr->LLD工具进行配置->执行preinstall置-)安装集群->安装后

检查->安装后配置

D、LLD工具进行配置->执行]届时@11-»安装集群->安装Manager,安装后检

查->安装后配置

答案:B

36.YARN调度器分配资源的顺序,下面哪一个描述是正确的?

A、任意机器->同机架本地资源

B、任意机器->本地资源同机架

C、本地资源->同机架任意机器

D、同机架任意机器令本地资源

答案:C

37.使用Loader进行数据导入和导出时,必须经过Reduce阶段进行数据处理

A、对

B、错

答案:B

38.Spark和Hadoop都不适用于迭代计算的场景。

A、对

B、错

答案:B

39.通过FusionlnsightManager不能完成以下哪个操作?

A、安装部署

B、性能监控

C、权限管理

D、虚拟机分配

答案:D

40.HBase的最小处理单元是Reg沁n,UserRegion和RegionServer之间的路由信

息是保存在哪里的?

A、Zookeeper

B、HDFS

CNMaster

D、meta表

答案:D

41.HDFS的Client写入文件时,数据的第一副本写入位置由NameNode确定,其他

副本的写入位置由DataNode确定。

A、对

B、错

答案:A

42.FusionlnsightHD的Loader在创建作业时,连接器有什么作用?

A、确定有哪些转换步骤

B、提供优化参数,提供数据导入导出性能

C、配置作业如何与外部数据源进行连接

1)、配置作业如何与内部数据源进行连接

答案,C

43.HBase元数据MetaRegion路由信息保存在哪里?

A、Root表

B、Zookeeper

C、HMaster

D、Meta表

答案:B

44.HBase中Region的物理存储单元是什么

A、Region

B、CdumnFamily

C、Column

D、Row

答案:B

45.安装FusionlnsightHD的Streaming组件时,Nimbus角色要求安装几个节点?

A、1

B、2

C、3

D、4

答案:B

46.关于FusionlnsightManager中的Controller和NodeAgent,说法正确的是?

A、Controller每隔3秒向NodeAgent发送心跳

B、NodeAgent接受Controller下发的命令,执行具体的动作

C、每个节点都必须部署Controller

D、NodeAgent是开源增强的

答案:B

47.关于Kerberos部署,描述正确的是?

A、Kerberos仅有一个角色

B、Kerberos服务在同一个节点上有两个实例

C、Kerberos服务采用主备模式部署

D、Kerberos服务必须和LDAP服务部署在同一个节点

答案:B

48.Spark组建中哪个选项不属于transformation操作?

A>join

B、distinct

C、reduceBykey

D、reduce

答案:D

49,FusionInsightHD集群中,根据磁盘规划建议,/srv/BigData分区应该部署在

什么磁盘上?

A、OS盘

B、元数据盘

C、数据盘

D、管理扁

答案:A

50.关于Kafka磁盘容量不足的告警,对于可能的原因以下分析不正确的是?

A、用于存储Kafka数据的磁盘配置(如磁盘数目、大小等),无法满足当前业务数

据流量,导致磁盘使用率达到上限

B、数据保存时间配置过长,数据累积达到磁盘使用率上限

C、业务规划不合理,导致数据分配不均匀,使部分磁盘达到使用率上限

D、Broker节点故障导致

答案:D

51.Flink中的checkpoint机制不断绘制流应用的快照,流应用的状态快照只能

保存在HDFS文件系统中。

A、对

B、错

答案:B

52.大数据需要传统行业思维的转变,要把数据收集,分析中作为业务流程的重要

组成部分,数据驱动业务流程优化,实现智能化和自动化,并依t璘据资产实现跨

界拓展。

A、正确

B、错误

答案:A

53.FusionlnsightHD系统审计日志不可用记录下面哪些操作?

A、手动清除警告

B、启停服务实例

C、删除服务实例

【)、查询历史监控

答案:D

54.FusionlnsighlHD的Loader中,一个连接器(connector)只可以分配一个作业

使用。

A、正确

B、错误

答案:B

55.FusionlnsightMaiiager对服务的配置功能说法不正确的是?

A、服务级别的配置可对所有实例生效

B、实例级^的配置只针对本实例生效

C、实例级^的配置对其他实例也生效

D、配置保存好需要重醐务才能生效

答案:C

56.HDFS搬仲,NameNode负责管理元数据,Qent端每次请求都需要从NarreNo

de的元数据盘中读取元数据信息以此获取所读文件在DataNode的位置

A、正确

B、错误

答案:B

57.Hadoop平台中,要查看YARN服务中的一个application信息,通常需要使用

什么命令?

A、container

B、applicationatternpt

C、iar

D、application

答案:D

58.FusionlnsightHD三层组网适合多少节点的集群规模?

A、30节点

B、100节点

C、100-200节点

D、200节点以上

答案:D

59.Flink是一个批处理和流处理结合的统一计算框架,其核心是一个数据分发

以及并行化计算的流数据处理引擎。

A、对

B、错

答案:A

60.UDI'S的NameNode节点主备状态管理及元数据文件合并分别由哪两个角色负

责?

A、ZKFC和备NameNode

B、主NameNode和备NameNode

C、ZKFC和主NameNode

D、主NameNode和JoumalNode

答案:A

61.FusionlnsightHD系统中,LDAP数据同步方式是哪个?

A、单相同步

B、双向同步

C、隔离不同步

D、数据交叉同步

答案:A

62.FusionlnsightHD系统中HDFS默认BlockSize是多少?

A、32M

B、64M

C、128M

D、256M

答案:C

63.Hadoop中哪个模块负责HDFS的数据存储?

A、NaneNode

B、DataNode

C、ZooKeeper

D、JobTraoker

答案:B

64.华为在金融、公安、铁路、政务等多行业拥有丰富的大数据解决方案经验

A、对

B、错

答案:A

65.某银行规划的FusionlnsightHD集群有90个节点,如果控制节点规划了3个,

那集群数据节点推荐规划

A、87

B、85

C、90

D、86

答案:A

66.客户IT系统中FusionlnsightHD集群有150个节点,每个节点12块磁盘(不

包括0S盘),每块磁盘大小IT,只安装HDFS,按照默认配置最大可存储多少数据?

A、1764TB

B、1800TB

C、600TB

D、588TB

答案:D

67.HBase的某张表的RowKey划分SplitKey为9,E,a,z,请问该表有几个Region?

A、3

B、4

C、5

D、6

答案:C

68.某银行规划的FusionlnsightHD集群有90个节点,如果控制节点规划了3个,

那集群中数据节点推荐规划87

A、正确

B、错误

答案:A

69.Hadoop平台中启用YARN组件的日志聚集功能,需要配置哪个参数?

A、yarn.nodemanager.local-dir

B、yarn.nodemanager.log-dirs

C、yarn.acl.enable

D、yarn.log-aggregation-enable

答案:D

7O.Spark是基于内存的计算引擎,所有Spark程序运行过程中,的数据只能存储

在内存中

A、对

B、错

答案:B

71.华为FusionlnsightHD系统中,对存储副本为3个的数据块,当有一个节点上

该数据块丢失时,需要手动复制一个副本到该节点。

A、正确

B、错误

答案:B

72.FusionlnsightHD产品中,关于Kafka的说法不正确的是?

A、Kafka强依赖于Zookeeper

B、Kafka部署的实例个数不得小于2

C、Kafka的服务端可以产生消息

D,Consumer作为Ka:ka的客户端角色进行消息的消费

答案:C

73.FusionInsightHD集群组网设计中,有一种机架可以按照业务需求线性扩展,

这种机架被称为

A、基本框

B、扩展框

c、me

D、数据框

答案:B

74.Hadoop系统中关于客户端向HDFS文件系统上传文件说法正确的是?

A、客户端的文件数据经过NameNode传递给DataNode

B、客户端将文件划分为多个Block,根据DataNode的地址信息,按顺序写入每一

个DataNode中

C、客户端根据DataNode的地址信息,按顺序将整个文件写入每一个DataNode

中,然后由DataNode将文件划分为多个Block

D、客户端只上传数据到一个DataNode,然后由NameNode负责Block复制

答案:B

75.Zookeeper所有节点都可以处理请求

A、对

B、错

答案:A

76.采用Flume传输数据过程中,为了防止因Flume进程重启而丢失数据,推荐使

用以下哪种channol类型。

A、MemoryChannd

B、FileChannel

C、JDBCChamel

D、HDFSChainel

答案:B

77.FusionlnsightHD系统中HDFS的Block默认保存几份?

A、3份

B、2份

C、1份

D、不确定

答案:A

78.Flume支持监控并传输目录下新增的文件,可实现数据传输,以上描述的是哪

一类source?

A、spoolingdirectorysource

B、httpsource

C、execsource

D、syslogsource

答案:A

79.FusionlnsightHD中使用HBase进行数据读取服务时需要连接HMaster

A、对

B、错

答案」B

80.关于FusionlnsightManager关键特性或操作说法正确的是?

A、能够针对整个集群或者某个服务进彳亍健康检查,不能针对某个节点进彳亍健康检

B、Manager引入角色的概念,采用RBAC的方式对系统进行权限管理

C、整个系统使用kerberos管理用户,使用LDAP进行用户认证,通过CAS实现单

点登录

D、对于健康检查结果,不能够导出检查报告,只能够在线查看

答案:B

81.下面关于ZKFC的说法错误的是?

A、ZKFC(ZKFailoverController)作为一个Zookeeper集群的客户端,用来监控N

ameNode的状态信息

B、ZKFC进程需要在NameNode的节点和Zookeeper的Leader节点中部署

C、StandbyNameNode通过Zookeeper感知ActiveNameNode的状态,一旦Active

NameNode宕机,StandbyNameNode就会执行升主操作

D、HDFSNameNode的ZKFC连接到Zookeeper,把主机名等信息保存到Zookeeper

答案:B

82.FusionlnsightHD管理节点提供双机HA机制,主节点故障之后,主备节点需要

手动实现Failover。

A^正确

B、错误

答案:B

83.FusionInsightHD的$门0201打且是基于开源八口@205101'01开发的,Storm是一

个分布式的离线计算框架。

A、对

B、错

答案:B

84.关于HBase的Region分裂流程Split的描述不正确的是?

A、Split过程中并没有真正的将文件分开,仅仅是创建了引用文件

B、Split为了减少Region中数据大小,从而将一个Region分裂成两个Region

C、Split过程中该表会暂停服务

D、Split过程中分裂的Region会暂停服务

答案:C

85.Spark应用运行时,如果某个Task运行失败则导致整个app运行失败。

A、对

BN错

答案:B

86.S。"可以对结构化、半结构化、非结构化数据建立索引,并提供全文检索能

力。

A、正确

B、错误

答案:A

87.Spark0nYarn模式下的driver只能运行在客户端。

A、对

B、错

答案:B

88.FusionInsightManager用户权限管理不支持哪个配置?

A、给用户配置角色

B、给角色配置权限

C、给用户组配置角色

D、给用户组配置权限

答案:D

89.Hadoop系统中YARN分配给Container的内存大小,可以通过参数yarn.app.

mapreduce.am.resource.mb来设置

A、对

B、错

答案:A

90.Keiberos系统设计上采用客户端服务器结构与DES加密技术,能够进行相互

认证,客户端和服务器端均可以对对方身份进彳亍认证。

A、正确

B、错误

答案:A

91.华为FusionlnsightHD系统中关于HDFS的DataNode的说法正确的是?

A、不会检查数据的有效性

B、周期性地将本节点的Block相关信息发送给NameNode

C、不同的DataNode存储的Block一定是不同的

D、一个DataNode上的Block可以是相同的

答案:C

92.Hadoop的HBase不适合哪些数据类型的应用场景?

A、大文件应用场景

B、海量数据应用场景

C、高吞吐率应用场景

D、半结构化数据应用场景

答案:A

93.Fusionlnsight系统中,Flume数据流节点内不需要经过哪个ponent?

A、source

B、channel

C、sink

D、topic

答案:D

94.SparkOnYARN模式下,没有部署NodeManager的节点不能启动executor执行T

ask

A、对

B、错

答案:A

95.关于HBase中HFile的描述不正确的是?

A、一个HFile属于一个Region

B、一个HFile包含多个列族的数据

C、一个HFile包含多列数据

D、一个HFile包含多行数据

答案:B

96.HBase中数据存储的文件格式是什么?

A、Flie

B、SequenceFile

C^Log

D、TXTflie

答案:A

97.Hadoop的NameNode用于存储文件系统的元数据。

A、正确

B、错误

答案:A

98.FusionlnsightManager界面上,当收到Kafka磁盘容量不足告警,且该告警的

原因已经排除硬盘硬件故障时,系统管理员需要考虑扩容解决此问题

A、对

B、错

答案:A

99.Spark是以下哪种编程语言实现的?

A、C

B、C++

C、JAVA

D、Scala

答案:D

100.哪个不是Flume的channel类型

A、MemoryChannel

B、FileChannel

C、JDBCChaTnel

D、HDFSChamel

答案:D

101.FusionlnsightHD系统中,Kerberos仅用于组件间服务安全认证。

A、正确

B、错误

答案:B

102.部署FusionlnsightHD时,同一集群内的FlumeServer节点建议至少部署几

个?

A、1

B、2

C、3

D、4

答案:B

103.Hadoop系统中,如果HDFS文件系统的备份因子是3,那么MapReduce每次运

行Task都要从3个有副本的机器上传输需要处理的文件段。

A、对

B、错

答案:B

104.FusionlnsightManager支持大规模集群安装部署、监控、告警、用户管理、

权限管理、审计、服务管理、健康检查、问题定位、升级和补丁。

A、正确

B、错误

答案:A

105.FusionInsightHD部署过程中,执行precheck检查每一个节点时必须调用c

heckNode.Configd配置文件

A、正确

B、错误

答案:A

106.在FusionhisightHD中,以下哪一项不属于Hive的流控特性

A、支持对已建立的总连接数做阈值控制

B、支持对每个用户已经建立的连接数做阈值控制

C、支持对某个特定用户已建立的连接数做阈值控SU

D、支持对单位时间内所建立的连接数做阈值控制

答案:C

107.以下哪个不属于Hadoop中MapReduce组件的特点?

A、易

B、良好的拓展性

C、实时计算

D、高容错性

答案:C

108.FusionlnsightHD中,如果需要查看当前登录HBase的用户和权限组,可以在

HBaseshell中执行什么命令?

A、use-permission

B、whoami

C、who

D、get-user

答案:B

109.Flume的数据流可以根据headers的信息发送到不同的channel中。

A、正确

B、错误

答案:A

HO.Spark任务的一个Executor同时可以运行多个task

A、对

B、错

答案:A

111.YARN上有两个同级队列Q1与Q2,容量都是50%,Q1上已经有10个任务共占

用了40的容量,Q2上有两个任务共占用了30的容量,那么由于Q1的任务数多,

调度器会优先将资源分配给Q1。

A、对

R错

答案:B

112.在规划FusionlnsightHD集群时候,如果客户用于功能测试,对性能没有要

求,节约成本的情况下,可以采用管理节点,控制节点,数据节点合TP署,最少需

要多少节点?

A、2

3

C、4

D、5

答案:B

113.在Zookccpci,的服务模型中,Leader节点以主备模式存在,其他节点都属于F

ollower节点。

A、对

B、错

答案:B

114.HBase中一个Region进行Split操作时,将一个HFile文件真正分开到两个

Region的过程发生在以下什么阶段?

A、触it过程中

B>Flu由过程中

C、pacti(城S程中

D、HFile分开过程中

答案:C

115.关于Hive与Hadoop其他组件的关系,以下描述错误的是?

A、Hive最终将数据存储在HDFS中

B、HiveSQL其本质是执行MapReduce任务

C、Hive是Hadoop平台的数据仓库工具

D、Hive对HBase有强依赖

答案:D

116.HBase的物理存储单元是什么?

A、Region

ColumnFamily

C、Column

D、ROW

答案:B

117.关于Hive在FusionlnsightHD中的架构描述错误的是?

A、只要有一个HiveServer不可用,整个Hive集群便不可用

B、Hiveserver负责接受客户端请求、解析、执行HQL命令并返回查询结果

C、MetaStore用于提供数据服务,依赖于DBServer

D、在同一个时间点Hiveserve只有一个处于Active状态,另—^则处于Standb

y状态

答案:A

118.FusionlnsightHD中Loader作业提交到YARN后,作业不能手动停止。

A、对

B、错

答案,B

119.Flink支持Local模式和Cluster模式部署,其他模式部署暂不支持。

A、对

B、错

答案:B

120.FusionlnsightHDManager界面Hive日志收集,哪个选项不正确?185.

A、可指定实例进行日志收集,比如指定单独收集MetaStore的日志

B、可指定时间段进行日志收集,比如只收集20161T0的日志

C、可指定节点IP进行日志收集,例如仅下载某个IP的日志

D、可指定特定用户进行日志收集,例如仅下载userA用户产生的日志

答案:D

121.Kerberos只能对集群内的服务提供安全认证。

A、正确

B、错误

答案:B

122SparkSQL表中,经常会存在很多小文件供小远小于HDFS块大小),在这种情

况下,Spark会启动更多的Task来夕回这些小文件,当SQL逻辑中存在Shuffle

操作时,会大大增加hash分桶数,从而严重影响性能。

A、对

B、错

答案:B

123.下列关于HBase的BloomFilter特性理解不正确的是?

A、用来过滤数据

B、用来优化随机读取的性能

C、会增加存储的消耗

D、可以准确判断某条数据不存在

答案:A

124.使用配置规划工具对FusionlnsightHDV1(X)R002C50集群进行规划时,可以

用V100R002c60版本的配置规划工具来规划。

A、正确

B、错误

答案:B

125.FusionlnsightHD安装不支持非root用户的安装方式。

A、正确

B、错误

答案:B

126.FusionlnsightHadoop集群中,在某个节点上通过df・hT查询,看到的分区包

含以下几个。/var/log/srv/BigData/srv/BigData/hadoop/data5/srv/BigData

/solr/solrserver3/srv/BigData/dbdataom这些分区所对应磁盘最佳Raid级别

的规划组合是?

A、RaidORaidlRaidONon-Raidl

B、RaidlRaidlNon-RaidNon-RaidRaid1

C、RaidORaidORaidORaidORaidO

D、Non-RaidNon-RaidNon-RaidNon-RaidRaid1

答案:B

127.下面关于Zookeeper的特性描述错误的是?

A、客户端所发送的更新会按照他们被发送的顺序进行应用

B、一条消息要被超过半数的Server接收,他将可以成功写入磁盘

C、消息更新只能成功或失败,没有中间状态

D、Zookeeper节点数必须为奇数个

答案:D

128.关于FusionlnsightManager说法错误的是?

A、NTPSener/CIient负责集群内各节点的时钟同步

B、iSilFusionlnsightManager可UIMHDFS进彳亍启

C、FusionlnsightManager所有维护操作只能通过WebUI来完成,没有提供Shel

I维护命令

D、通过FusionlnsightManager可以先导式安装集群,缩短集群部署时间

答案:C

129.在FusionlnsightlU)系统,Loader作业运行过程中,如果产生脏数据,Loader

作业执行结果的状态一定是失败。

A、对

B、错

答案:B

130.FusionlnsightHD系统部署时,如果Solr索引默认存放在HDFS上时,以下理

解正确的有?

A、不需要考虑各SolrServer实例上创建了多少Shared

B、为保证数据可靠性,创建索引时必须创建Replica

C、通过HDFS读取索引时占用磁盘10,因此不建议Solr实例与DataNode部署在

同一节点上

D、当Solr服务参考INDEX_ON_HDFS值为HDFS时,创建Collection的索引默认

存储在HDFS上。

答案:D

131.Spark任务的每个stage可划分为job,划分的标记是shuffle

AN正确

B、错误

答案:B

132.FusionlnsightHD系统中,可以通过多个Flume链接从其部署的节点上采集

数据。

A、正确

B、错误

答案:A

133.以下哪类数据不属于半结构化数据?

A、HTML

B、XML

C、二M表

D、JSON

修C

134.FusionlnsightHD使用HBase客户端批量写入10条数据,某个RegionServe

r节点上包含该表的2个Region,分别A和B,10条数据中有两条属于A,4条属于

B,请问写入这10条数据需要向该RegionSen/er发送几次RPCi青求?

A、1

B、2

C、3

D、4

答案:A

135.FusionlnsightHDLoader作业前后,需要哪些节点与外部数据源通讯?

A、loader服务主节点

B、运行Yarn服务作业的节点

C^前面两个都需要

D、前面两个都不需要

答案:C

136.HDFS支持大文件存储,同时支持多个用户对同一文件的写操作,以及在文件

任意位置进行修改。

AN正确

B、错误

答案:B

137.Flume传输数据的过程中,Sink取走数据并写入目的地后,会将events从ch

annel中删除。

A、对

B、错

答案:A

138.FusionlnsightHD的Streaming对于Zookeeper弱依赖,即使Zookeeper故

障Streaming可以正常提供服务。

A、对

B、错

答案:A

139.Hadoop中MapReduce组件擅长处理哪种场景的计算任务?

A、迭代计算

B、离线计算

C、实时交互计算

D、流式计算

答案:B

140.Hadoop中,如果将yam.scheduler.capacity.toot.QueueA.minimum-user-1

imit-percent设置为50,下面说法错误的是?

A、一个用户提交任务,可以使用QueueA的100%的资源

B、QueueA中的每个用户最多只能获得50%的

C、如果QueueA中已经有2个用户的任务运行,这时第3个用户提交的任务需要

等待释放资源

D、QueueA中必须保障每个用户至少得到50%的资源

答案:B

141.Loader的作业执行失败,则此作业运行过程中导入的数据不会被自动删除,

必须手动删除。

A、对

B、错

答案:B

142.FusionlnsightHD安装过程中,执行preinstall不能完成哪项功能?

A、修改0S配置,确保0S满足FusionlnsightHD的安装要求

B>安装manager

C、格式化分区

D、安装OS缺失的RPM

答案:B

143.FusionlnsightHD的HBase中会保存一张用户信息表meg-table,Rowkey为

用户ID,其中一列为用户昵称,现在按先后顺序往这列写入三个KeyValue:001i,

001:Mary,001ily,请问scan'meg-tab©,{ERSIONS=>2}会返回哪几条数据?

A、001i

B、001ily

C、001i,001:Mary,001ily

D、001:Mary,001ily

答案:I)

144.SparkStreaming相比Storm具备更高的实时性。

A、对

B、错

答案:B

145.FusionlnsightHD扩容时,添加到集群中的新节点,主机OS的root用户密码

与集群原所有节点rent用户密码可以不用保持一致°

A、正确

B、错误

答案:B

146.FusionlnsightHD系统中执行HBase写数据时侯,数据被写入内存Memstore、

日志HLog和HDP中,请问哪一步写入成功后才会最终返回客户端写数据成功?

A、Memstore

B、HLog

C、HDFS

D、Menmory

答案:B

147.FusionlnsightHD系统中,以下选项哪一个不是HBase写数据流程涉及的角

色或服务?

A、Zookeeper

B、HDFS

C>HMaster

D、RegionServer

答案:C

148.Fusioninsight集群组网设计中,二层组网指集群内二层交换,集群节点在

一个子网里,适用节点数小于200的集群场景。

A、正确

B、错误

答案:A

149.如果YARN集群中只有Default、QueueA和QueueB子队列,那么允许将他们

的容量分别设置为60%、25%、22%。

A、对

B>错

答案:B

150.FusionlnsightHD系统中,哪个不属于集群节点的磁盘分区

A、OS分区

B、数据分区

C、元数据分区

D、管理分区

答案:D

151.在Flink技术架构中,。是流处理和批处理的计算引擎

A、Standalone

B^Runtime

C>DataStream

D、FlinkCore

答案:B

152.FusionlnsightHD用户管理系统仅支持管理人机账号。

A、正确

B、错误

答案,B

153.SoIrCloud模式是集群模式,在此模式下Solr服务器强依赖于以下哪个服

务?

A、HBase

B、HDFS

C>Zookeeper

D、Yam

辎C

154.关于Hive建表的基本操作,描述正确的是?

A、创建外部表的时需要指定external关键字

B、一旦表创建好,不可再修改表名

C、一旦表创建好,不可再修改列名

D、一旦表创建好,不可再增加新列

答案:A

155.HDFS机制中NameNode负责管理元数据,Client端每次读请求都需要从Name

Node的元数据磁盘中读取元数据信息,以此获取所读文件在DataNode中的位置。

A、对

B、错

答案:A

156.关于FusionlnsightHDStreaming的Supervisor描述正确的是?

A、Supervisor负责资源的分配和任务的调度

B、Supervisor负责接受Nimbus分配的任务,启动停止属于自己管理的Worker

进程

C、Supervisor是运行具体处理逻辑的进程

D、Supervisor是在Topology中接收数据然后执行处理的组件

答案:B

157.关于Hive中普通表和外部表的描述不正确的是?

A、默认创通表

B、外部表实质是将已经存在HDFS上的文件路径跟表关联起来

C、删除普通表时,元数据和数据同时被删除

D、删骷卜部表时,只删除外部表数据而不删除元数据

答案:D

158.FusionlnsightlD系统中如果修改了服务配置项,不进行服务重启,谢艮务

的配置状态是什么状态?

A、SYNCHRONIZED

B、EXPIRED

C、CONFIGURING

D、UNKNOWN

答案:B

159.Spark应用在运行时,Stage划分的依据是什么?

A>task

B、taskSet

C、action

D、shuffle

答案,D

160.FusionlnsightHD系统中,集群中一个Loader节点异常,其他服务没有异常

的情况下,不会影响Loader服务功能的正常使用

A、对

B、错

答案:A

161.HBase的主Master是如何选举的?

A、随机选取

B、由RegionServer进彳决

C^通过Zookeeper进行裁决

D、HM^ter为双主模式,不需要说谶决

答案:C

162.FusionlnsightHD系统中,下列哪个方法不能查看到Loader作业执行的结

果?

A、通过Yarn任务管理查看

B、通过LoaderUI界面查看

C、通过Manager的告警查看

D、通过NodeManager查看

答案:D

163.FusionlnsightHDHBase默认使用什么作为其底层文件存储系统?

A、HDFS

B、Hadoop

C、Memory

D、MapReduce

答案:A

164.哪个模块是负责FusionlnsightManager用户数据存储的?

A、CAS

B、AOS

C、Kerberos

D、LDAP

答案:D

165.FusionlnsightUD平台中,HBase暂不支持二级索引

A、对

B、错

答案:B

166.FusionlnsightUD系统中一个集群可以管理多个服务,每个服务可以管理多

个角色,每个角色只能管理一个实例?

A、正确

B、错误

答案:B

167.FusionlnsightHD中Loader从SFTP服务器导入文件,如果不需要做编码转

换和数据转换且速度最快,选择下面哪个文件类型?

A、text-flie

B、sequence-file

C^binary-file

D、graph-file

答案:C

168.FusionlnsightManager集群规划中,管理节点&控制节点&数据节点合一部

署方案适合什么样的场景?

A、30节点以下

B、100节点以上

C、100-200节点

D、200节点以上

答案:A

169.FusionInsight集群规划部署时,建议管理节点最好部署()个,控制节点最

少需要部署()个,数据节点最少需要部署()个。

A、1,2,2

B、1,3,2

C、2,3,1

D、2,3,3

答案:[)

170.FusionlnsightHD集群中的节点只安装了一块网卡,也可以采用双平面隔离

组网方案。

A、正确

B、错误

答案:B

171.Flink与SparkStreaming类似,属于时间驱动型实时流系统

A、对

B、错

答案:B

172.关于FusionlnsightHD中Loader作业描述正确的是?

A、Loader将作业提交到Yam执行后,如果此时Loader服务异常,则此作业执行

失败。

B、Loader将作业提交到Yarn执行后,如果某个Mapper任务执行失败,能够自动

进行重试

C、Loader将作业执行失败后将会产生垃圾数据,需要用户手动清除

D、Loader将一个作业提交至Yam执行后,该作业执行完成前,不能再提交其他

作业

答案:B

多选题

1.FusionlnsightHD系统中,如果发现Solr服务不可用,可以从哪些方面分析定

位问题?(多选)

A、查看其依赖的Zookeeper服务是否正常

B、查看HDFS服务是否正常

C、登陆SolrserverAdmin所在节点,确认该节点与另外一个SolrserverAdmin

实例节点网络是否连通

D、登陆FusionlnsightManager界面,下载Solr服务不可用期间的相关日志,进

行进一步定位

答案:ABCD

2.FusionlnsighlHDLLD配置规划工具可以生成哪些配置文件?(多选)

A、监控告警阈值配置文件

B、集群的安装模板文件

C、HDFS和YARN的配置文件

D、执行Precheck所需要的配置文件CheckNodes.Config

答案:BD

3.FusionlnsightHD系统中,集群节点规划时需要考虑到哪些磁盘规划?

A、主机OS磁盘规划

B、控制节点元数据盘规划

C、管理节点元数据盘规划

D、数据节点数据磁盘规划

答案:ABCD

4.Hadoop系统中,YARN支持哪些资源类型的管理?(多选)

A、内存

B、CPU

C、网络

D、磁盘空间

答案:AB

5.FusionlnsightManager可以对哪些项目进彳亍健康检查?(多选)

A、主机

B、服务

U角色

D、实例

答案:AB

6.以下哪些是Spark服务的常驻进程?(多选)

A、JobHistory

B、JDBCServer

C、SparkResource

D、Nodemanager

答案:AB

7.Flumc进程级联时,以下哪些Sink类型用于接受上一跳Flume发过来的数据?

A、avrosink

B、thriftsink

C、HDFSsink

D、Nullsink

答案:BC

8.关于大数据的主要特征的理解和描述正确的有哪些?

A、数据来源多,格式多

B、数据增长速度快,妪£速度快

C、数据量大,计算量大

I)、数据价值密度低,价值高

答案:ABCD

9.Hadoop的HDFS是一种分布式文件系统,适合以下哪种应用场景的数据存储和

管理?

A、大量小文件存储

B、iW]容错、局吞吐量

C、低延迟读取

I)、流式数据访问

答案:BD

lO.FusionlnsightHD集群升级,一下描述正确的有?(多选)

A、升级过程中不可以手工操作主备OMS倒换

B、集群内所有主机的root账户密码保持一致

C、保持网络畅通,避免因网络问题导致升级异常

D、观察期不能做扩容

答案:ABCD

11.以下关于Hadoop的HDFS描述正确的有?(多选)

A、HDFS由NameNode,DataNode,Client组成

B>HDFS备NameNode上的额元数据是由主NameNode同步过去的

C、HDFS采用就近的机架节点进行数据的第一副本存储

D、HDFS适合一次写入,多次读取的读写任务

答案:ACD

12.FusionlnsightHD产品中,关于Kafka组件说法正确的有?(多选)

A、删除Topic时,必须确保Kafka的服务配置delete,topic,enable配置为tru

e

B、Kafka安装及运行日志保存路径为/srv/Bigdata/Kafka

C、Zookeeper服务不可用会导致Kafka服务不可用

D、必须使用admin用户或者Kafkamin组用户进行创建Topic

答案:ACD

13.1?usionlnsightManager与外部平台对接时,支持哪些接口?(多选)

A、SNMP

B、VPN

C、BGP

D、Syslog

答案:AD

14.关于FusionlnsightManager功能说法错误的有哪些?(多选)

A、通过FusionlnsightManager的Audit审计界面可以查询每个重要操作

B、通^FusionlnsightManager不能下载单个组件的客户端

C^集群部署完成以后,通过FusionlnsightManager不能进行集群扩容,只能通过

卸载集群重新搭建来扩容集群

D、通过FusionlnsightManager的Alarms告警界面可以查询每个告警的具体信

答案:BC

15.Hadoop通过ResourceManager对集群资源进行管理,它的主要功能有?(多选)

A、集群资源调度

B、应用程序管理

C、集群资源管理

D、日志管理

答案:ABC

16.基于Hadoop开源大数据平台主要提供了针对数据分布式计算和存储能力,如

下属于分布式存储组件的有?

(多选)

A、MR

BNSpark

C、HDFS

D、HBase

答案:8

17.下列哪些OS版本被推荐可以用来搭建FusionlnsightVlR2C60集群?(多选)

A、SUSE11SP1/SP2/SP3forAMD64&inter64

CentOS6.6

C、Redhat-6.4-x8664

D、Redhat-6.5-x86_64

E、Redhat-6.7-x86_64

F、Ubuntu6.3

答案:ABCDE

18.FusionlnsightHD产品中,关于Kafka组件部署规划说法正确的是?(多选)

A、Kafka的Producer发送消息时可以指定该消息被哪个Consumer消费

B、在创建Topic时,副本数不得大于当前存活的Broker实例个数,否则创建Top

ic时会失败

C、Kafka安装完成后就不能再配置数据存放目录了

D、Kafka会将元数据信息存放到Zookeeper上

答案:印

19.FusionlnsightHD集群规划建设时,集群有150个节点,并且采用双平面组网

部署,对于该集群网络要求的描述,下列描述正确的是?

A、业务平面所有节点都使用10GE网络

B、管理平面中控制节点使用10GE网络

C、管理平面数据节点使用10GE网络

D、业务平面中控制节点使用10GE网络

E、管理平面中管理节点使用10GE网络

答案:ACE

20.FusionlnsightHD集群中包含多种服务,每种服务又由若干角色组成,下面哪

些是服务的角色?(多选)

A、HDFS

B、NameNode

C、DataNode

D、HBase

答案:BC

21.尸11$10记11$18卜1:出)卜人M80「界面显示11爪2服务状态为1启€1时,可能原因有哪

些?

A、DBScrvicc服务不可用

B、HDFS服务不可用

C、Metadata实例不可用

D、HBase服务不可用

答案:ABC

22.FusionInsightHDLoader可以将HDFS数据导出到以下哪些目标端?

A、SFTP服务器

B、FTP服务器

C、Oracle数据库

D、DB2数据库

答案:ABCD

23.执行HBase数据读取业务时,需要读取哪几部分数据?

A、HFile

B、HLog

C、MemStore

D、HMaster

答案:AC

24.HDFS系统中对备用NameNode的作用的描述正确的有?

A、主NameNode的热备

B、备NameNode对内存没有要求

C、帮助主NameNode合并编辑日志,减少主NameNode的启动时间

D、备NameNode应与主NameNode部署到一个节点

答案:AC

25.在Fusionlnsight集群规划时,以下哪些集群命名是系统允许的?

A、Fusionlnsight-123

B、Fusionlnsight_123

C、Fusionlnsight123

D^123Fusionlnsight

答案:BO

26.FusionlnsightHD在安装集群成功后,有哪些项需要检查?

A、Service组件健康检查

B、系统是否有告警

C、服务的配置状态是否为已同步

D、主机健康装填

答案:ABCD

27.大数据商业咨询服务方案在规划环节主要考虑以下哪些设计?

A、大数据商业模式设计

B、商业场景全景规划

C、典型场景需求设计

D、场景分解和业务设计

答案:ABCD

28.FusionlnsighlHD系统中Hive支持的存储格式包括?

A、HFile

B、TextFile

C、SequenceFile

D、RCFile

答案:BCD

29.FusionlnsightHD系统中,关于Solt.索引的存储部署策略,以下说正确的有?

(多选)

A、利用HDFS数据存储可靠性和易于扩容的特点优先选择索引存储于HDFS

B、不论Solt索引存储在HDFS上还是存储在本地磁盘,在同一节点上部署5个S

olt实例,根据IP和不同的端口号来区分不同的Solt实例

C、当对实时索引录入速度要求较高时,可选择索引存放于本地磁盘

D、当索引数据存放在HDFS上时,SohServer实例与DataNode实例部署在同一

节点上。

答案:ACD

30.FusionlnsightHD支持哪些日志下载方式?

A、下载已安装组件的所有组件的日志

B、下载单个组件某个模块的日志

C、下载指定主机的日志

D、下载指定时间段的日志

答案:ABCD

31.FusionlnsightHD的HBase服务包含哪些进程?

A、HMaster

B、Slave

C、HRegionServer

D、DataNode

答案:AC

32.149.FusionlnsightHD系统中使用Streaming客户端Shell命令查看拓扑或

提交拓扑失败,以下哪些定位手段是正确的?

A、查看客户端异常堆栈,判断是否客户端使用问题

B、查看主Nimbus的运行日志,判断是否Nimbus服务端异常

C、查看Supervisor运行日志,判断是否Supervisor异常

D、查看Worker运行日志

答案:AB

33.Loader提供了哪些方式或接口实现作业管理?

A、WEBUI

B、Linux命令行

C、REST接口

D、JavaAPI

答案:ABCD

34.与174对比.Flume进程级联时,以下哪些sink类型用于接收上一跳Flume发

送过来的消息?

A、Avrosink

B、Thriftsink

C^Hivesink

D、Nullsink

答案:AB

35.Hadoop的HBase主要特点有哪些?

A、高可靠性

B、高性能

C、面向列

D、可伸缩

答案:.ABCD

36.与178对比.FusionlnsightManager界面显示Hive服务状态为Bad时,可能

原因有哪些?

A、DBService不可用

B、HDFS服务不可用

C、MetaStore实例不可用

D、HBase服务不可用

答案:BC

37.在Solrcoud模式下,以下关于SoTr相关概念描述正确的有?(多选)

A、Collection是在Solrcoud集群中逻辑意义上的完整的索引,可以被划分为一

个或者多个Shard,这些Shard使用相同的ConfigSeto

B、ConfigSet是SolrCore提供服务必须的一组配置文件,包括solrconfig.xml

和schema.xml等

C、Shard是Collection的逻辑分片,每个Shard都包含一个或者多个replicas,

通过选举确定哪个replica是leader,只有Leaderreolica才能进行处理索引和

查询请求。

D、Replica只有处于active状态时才会接受索引和查询请求

答案:ABD

38.HBase的数据文件H

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论