版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
《hadoop基础练习》核心备考题库(含典型题、重点题)单选题1.注册ZNode的命令是()A、bin/hdfszkfc-formatZKB、sbin/hdfszkfc-formatZKC、bin/hdfszkfc-fromatZKD、sbin/hdfszkfc-fromatZK参考答案:A2.执行数据块复制的任务时,是什么和什么在进行通信()A、clientandnamenodeB、clientanddatanodeC、namenodeanddatanodeD、datanodeanddatanode参考答案:D3.在执行一个job时,如果这个job的输出路径已经存在,那么程序会()。A、覆盖这个输出路径B、抛出警告,但是能够继续执行C、抛出一个异常,然后退出D、创建一个新的输出路径参考答案:C4.在整个maprduce运行阶段,数据是以()形式存在的A、key/valueB、LongWritableC、TextD、WordCount参考答案:A5.在一个Hadoop集群中有多少个JobTrackerdaemon?A、一个B、两个C、每个slave节点一个D、每个slave节点两个参考答案:A6.在循环中不会出现的关键字是哪一个A、forB、whileC、dowhileD、in参考答案:C7.在项目实施人员中,适时与客户沟通,确立项目目标,建立组织机构,编制计划,负责项目全面管理的角色是()。A、实施工程师B、项目经理C、产品经理D、财务人员参考答案:B8.在下列压缩格式中,哪一个压缩格式压缩速度最慢。A、gzipB、bzip2C、snappyD、lzo参考答案:B9.在实验集群的master节点使用jps命令查看进程时,终端出现以下哪项能说明Hadoop主节点启动成功?A、Namenode,Datanode,TaskTrackerB、Namenode,Datanode,secondaryNameNodeC、Namenode,JobTracker,secondaryNameNodeD、Namenode,Datanode,HMaster参考答案:C10.在启动hadoop集群以后,查看jps进程有几个?A、3个B、4个C、5个D、6个参考答案:D11.在进行Hive组件配置时,JAR包冲突导致异常,出现以下错误信息()A、FailedtosetsetXIncludeAware(true)forparserB、mkdir:`input’:NosuchfileordirectoryC、E45:‘readonly’optionisset(add!tooverride)D、ERRORtool.ImportTool:ImportedFailed:Character8216isanout-of-rangedelimiter参考答案:A12.在海量数据中,Dynamo的存储是按照什么策略来进行的?A、消息代理B、传统的存储放置策略C、一致性哈希算法D、异步复制参考答案:C13.在高阶数据处理中,往往无法把整个流程写在单个MapReduce作业中,下列关于链接MapReduce作业的说法,不正确的是()A、Job和JobControl类可以管理非线性作业之间的依赖B、ChainMapper和ChainReducer类可以用来简化数据预处理和后处理的构成C、使用ChainReducer时,每个mapper和reducer对象都有一个本地JobConf对象D、ChainReducer.addMapper()方法中,一般对键/值对发送设置成值传递,性能好且安全性高参考答案:D14.在分布式并行计算体系中,()采用一个指令流处理单个数据流。A、SISDB、SIMDC、MISDD、MIMD参考答案:A15.在导入开始之前,Sqoop检索出表中所有的列以及列的SQL数据类型,这些SQL类型被映射什么类型()A、CB、C++C、JavaD、Python参考答案:C16.在搭建中ZooKeeper运行环境时,首先需要安装什么运行环境?A、PythonB、CC、JavaD、Linux参考答案:C17.在ZooKeeper中有三种角色,下列选项中不属于ZooKeeper中的角色()A、ObserverB、LeaderC、ObeyerD、Follower参考答案:C18.在Storm的软件架构中,()运行在主节点上,是整个流计算集群的控制核心,总体负责topology的提交、运行状态监控、负载均衡及任务重新分配等。A、主控程序NimbusB、集群调度器ZookeeperC、工作节点控制程序SupervisorD、工作进程Worker参考答案:A19.在Storm的软件架构中,()由Hadoop平台提供,是整个集群状态同步协调的核心组件。A、主控程序NimbusB、集群调度器ZookeeperC、工作节点控制程序SupervisorD、工作进程Worker参考答案:B20.在Spark生态系统组件的应用场景中,下列哪项说法是错误的?A、Spark应用在复杂的批量数据处理B、SparkSQL是基于历史数据的交互式查询C、SparkStreaming是基于历史数据的数据挖掘D、GraphX是图结构数据的处理参考答案:C21.在Python中,指一个事务一旦提交,它对数据库中数据的改变就应该是永久性的。接下来的其他操作或故障不应该对其有任何影响说的是事务的哪个特性?A、持久性B、隔离性C、一致性D、原子性参考答案:A22.在Python中,在使用Flask框架的静态路由时,可以使用()方法,注册不同的路由?A、cursor()B、run()C、route()D、以上都不正确参考答案:C23.在Python中,阅读代码,选择结果:classPerson:"人的类"name=""age=0defeat(self):print(,"正在吃饭")classStudent()"学生类"defstudy(self):print(,"正在学习")per1=Person()="张三"per1.eatA、张三正在吃饭小明正在学习B、张三正在吃饭C、无语法错误,但不能输出结果D、代码非法,不能解释参考答案:D24.在Python中,用于将JSON字符串转换成Python对象的方法是A、json.dumps()B、json.loads()C、json.change()D、json.wirte()参考答案:B25.在Python中,以下选项中可访问字符串s从右侧向左第三个字符的是A、s[3]B、s[:-3]C、s[-3]D、s[0:-3]参考答案:C26.在Python中,以下JSON数据格式正确的是A、{["name":"json","age":10],["name":"html","age":15]}B、[{"name":"json";"age":10};{"name":"html";"age":15}]C、[{"name":"json","age":10},{"name":"html","age":15}]D、{["name":"json";"age":10];["name":"html";"age":15]}参考答案:C27.在Python中,一个事务的执行不能被其他事务干扰,并发执行的各个事务不互相干扰说的是事务的哪个特性?A、持久性B、隔离性C、一致性D、原子性参考答案:B28.在Python中,下面代码的输出结果是print(0.1+0.2==0.3)A、FALSEB、TRUEC、FALSED、TRUE参考答案:C29.在Python中,下面代码的输出结果是foriinrange(1,10,2):print(i,end=",")A、4B、,1.4C、7参考答案:C30.在Python中,下列是Flask的Request对象的data属性的作用的是()A、记录请求的数据,并转换为字符串B、记录请求中的表单数据C、记录请求中的查询参数D、记录请求中的cookie信息参考答案:A31.在Python中,下列不属于Tornado特点的是?A、完备的Web框架B、图片自动识别技术C、提供高效HTTPClientD、提供高效的内部HTTP服务器参考答案:B32.在Python中,下列表达式的值为True的是A、5+4<=2B、2<5||3>2C、2!=2D、3==2参考答案:B33.在Python中,网络框架Django是()A、支持快速建站的框架B、企业级开发框架C、高并发处理框架D、以上全都不是参考答案:B34.在Python中,事务必须是使数据库从一个一致性状态变到另一个一致性状态说的是事务的哪个特性?A、持久性B、隔离性C、一致性D、原子性参考答案:C35.在Python中,使用命令安装pymysql的指令是?A、pipgetpymysqlB、piplistpymysqlC、pipinstallpymysqlD、pipuninstallpymysql参考答案:C36.在Python中,面向对象中的特殊成员以及应用场景描述正确的是:A、__del__析构方法,对应着一个对象的删除之后执行的内容B、__del__析构方法,对应着一个对象的删除之前执行的内容C、__repr__:和repr()%r不相关,但在没有__str__方法时,__repr__可以完全取代__str__。D、__repr__:和repr()%r都是息息相关的,在没有__str__方法时,__repr__不可以完全取代__str__。参考答案:B37.在Python中,利用print()格式化输出,能够控制浮点数的小数点后两位输出的是A、{.2}B、{:.2f}C、{:.2]D、{.2f}参考答案:B38.在Python中,看代码,说结果:
classSinger:
name=""
area=""

def__init__(self,name,area):
=name
self.area=area

singer1=Singer("陈奕迅","香港")
print("歌手:%s\t地区:%s"%(,singer1.area))
singer2=Singer("张杰","中国")
print("歌手:%s\t地区:%s"%(,singer2.area))A、不能运行B、歌手:陈奕迅地区:香港歌手:张杰地区:中国C、歌手:张杰地区:中国歌手:陈奕迅地区:香港D、歌手:陈奕迅地区:香港歌手:张杰地区:中国参考答案:D39.在Python中,关于关键字yield说法错误的是A、yield是生成的意思B、yield的作用于return完全相同C、yield返回的是一个生成器,主要可以迭代。D、yield是一个表达式,是有返回值的参考答案:B40.在Python中,关于Python语言的特点,以下选项描述正确的是A、Python语言是解释型语言B、Python语言不支持面向对象C、Python语言是编译型语言D、Python语言是非跨平台语言参考答案:A41.在Python中,关于python变量的描述错误的是A、Python变量不需要类型声明B、Python变量可以先声明再赋值,也可以同时声明和赋值C、可以使用等号“=”来给变量赋值D、Python变量的声明和赋值必须是一起的,不能单独分开参考答案:B42.在Python中,关于in操作符,描述不正确的是A、in操作符用来在指定的序列中找到某一个值,如果找到返回True,否则返回FalseB、in操作符所应用的序列可以是列表、元组或者字典C、判断指定序列中找不到某一个值,则使用notin,它刚好和in相反D、如果在序列中查找不到这个值,会将这个值加入到当前序列中参考答案:D43.在Python中,关于import引用,以下选项中描述错误的是A、import保留字用于导入模块或者模块中的对象B、使用importturtle引入turtle库C、使用importturtleast引入turtle库,取别名为tD、可以使用fromturtleimportsetup引入turtle库参考答案:D44.在Python中,关于execute()说法正确的是A、只能用来执行删、改语句B、不能用来一次插入多条记录C、可以用来执行插入语句D、只能用来执行增、改语句参考答案:C45.在Python中,关于cursor.fetchmany(3)语句说法正确的是A、随机获取3行数据B、获取所有结果中的前3行数据C、获取所有结果中后三行数据D、获取剩余结果的前3行数据参考答案:D46.在Python中,python中类名的命名规则中不包括:A、要遵循标识符的命名规范B、尽量使用驼峰命名法C、不区分大小写D、命名时应做到“见名知意”参考答案:C47.在Python中,python面向对象中super的作用描述不正确的是:A、super在面向对象继承类中代指父类,书写方法super(类名,self).属性或者方法或super().属性或者方法B、super机制里可以保证子类仅被执行一次,执行的顺序遵循MRO,广度优先查询方法C、super方法在类的多继承时可以简化代码,避免代码冗余D、super方法可以增加类之间调用的灵活性,当父类名发生变化时不必修改参考答案:B48.在Python中,Python程序中关于异常说法错误的是A、异常会影响程序的正常执行B、异常是Python对象,表示一个错误C、不可以自己出发异常D、需要捕获处理它,否则程序会终止执行参考答案:C49.在Python中,pymysql中获取数据库连接的函数是哪个?A、connection()B、conn()C、connect()D、getConn()参考答案:C50.在Python中,pymysql连接数据库获取数据库连接时,密码错误的堆栈信息是?A、Unknowndatabase'test'B、Accessdeniedforuser'root'@'localhost'(usingpassword:YES)C、NoneType'objecthasnoattribute'encoding'D、Can'tconnecttoMySQLserveron'localhost'([WinError10061]参考答案:B51.在Python中,os.exit()函数的作用是A、结束当前进程B、结束所有进程C、退出程序D、创建新的进程参考答案:A52.在Python中,defgetRandomNum():returnint(random.uniform(0,1000)),阅读代码以下描述不正确的是:A、模块功能是想获取随机数B、缺少导入random模块的代码C、生成的随机数的范围是[0,1000]D、生成的随机数的范围是[0,1000)参考答案:C53.在Python中,()语句隐藏了一个包含了关闭的逻辑,类似try…catchA、whereB、withC、yieldD、contextlib参考答案:B54.在Python语言中语句块的标记是A、分号B、逗号C、缩进D、/参考答案:C55.在Python函数中,用于获取用户输入的是A、input()B、print()C、eval()D、get()参考答案:A56.在MapReduce中,下面哪个选项是并行进行的?A、Shuffle和MapB、Shuffle和SortC、Reduce和SortD、Map和sort参考答案:B57.在MapReduce中,下面哪个数据流的顺序是正确的()a.InputFormatb.Mapperc.Combinerd.Reducere.Partitionerf.OutputFormatA、abcdfeB、abcedfC、acdefbD、abcdef参考答案:B58.在MapReduce中,如果要编写自己的数据类型,需要实现哪个接口?()A、WritableB、NullWritableC、IntWritableD、Text参考答案:A59.在MapReduce中,哪个组件是用户不指定也不会有默认的?A、OutputFormatB、CombinerC、PartitionerD、InputFormat参考答案:B60.在MapReduce中,()阶段,把Mapper的输出数据归并整理后分发给Reducer处理。A、ShuffleB、MapC、ReduceD、Sort参考答案:A61.在MapReduce的Shuffle过程中,哪个操作是最后做的?A、溢写B、分区C、排序D、合并参考答案:D62.在Linux中,终止一个前台进程可能用到的命令和操作是?A、killB、ctrl+CC、shutdownD、halt参考答案:B63.在Linux中,在输入模式下,按下什么键退回到编辑模式?A、TABB、PrtScC、ESCD、F1参考答案:C64.在Linux中,用户可以对vim进行设置,如何对vim文件进行修改?A、vim/etc/vim.initB、vim/etc/sysconfig/vimrcC、vim/etc/profile.d/vimrcD、vim/etc/vimrc参考答案:D65.在Linux中,添加新用户账号的命令是()A、useraddB、usernewC、adduserD、newuser参考答案:A66.在Linux中,哪种编辑器可以主动识别字体颜色及辨别语法的正确性?A、viB、vimC、aiD、aim参考答案:B67.在Linux中,立即关闭计算机的命令是A、shutdown-pnowB、shutdown-hnowC、shutdown-rnowD、shutdown-cnow参考答案:B68.在Linux中,进程挂起,使用的命令是A、Ctrl+DB、Ctrl+AC、Ctrl+CD、Ctrl+Z参考答案:D69.在Linux中,彻底终止进程123456,输入的命令是A、kill123456B、kill-9123456C、kill-HUPpidD、kill-l参考答案:B70.在Linux中,UnixLike系统都会内建那种编辑器?A、viB、ciC、aiD、di参考答案:A71.在Linux中,FTP传输中使用哪两个端口()?A、23和24B、21和22C、20和21D、22和23参考答案:C72.在Linux中,DHCP工作的四个阶段中不包括()A、DHCPDiscoverB、DHCPRequestC、DHCPDetestD、DHCPACK参考答案:C73.在Linux中,Apache和Tomcat都是服务器,他们之间的相同点有()A、两者都是Apache组织开发的B、两者都有HTTP服务的功能C、两者都是免费的D、以上全是参考答案:D74.在Linux系统中,以下哪两个命令可以显示系统中运行的进程状态?A、ls和dfB、ps和topC、ps和dfD、df和top参考答案:B75.在Linux系统中,如果要列出一个目录下的所有文件包括隐藏文件,需要使用命令()A、ls-lB、lsC、ls-aD、ls-d参考答案:C76.在Job类中对输出键值对格式进行设置时,如果Mapper的输出格式与Reducer的输出格式一样,那么可以省略下列()设置。A、job.setOutputKeyClass()与job.setOutputValueClass()B、job.setMapOutputKeyClass()与job.setMapOutputValueClass()C、job.setReduceOutputKeyClass()与job.setReduceOutputValueClass()D、以上都不能省略参考答案:B77.在Java中,针对设计模式中的单例模式,为了实现“单例”,必须要做到A、给该类创建一个有参构造方法B、私有化构造函数C、将构造函数的访问级别改为protectedD、给该类分别创建无参和有参构造方法参考答案:B78.在Java中,在程序读入字符文字时,推荐使用以下哪个流A、FileReaderB、FileWriterC、FileInputStreamD、ObjectInputStream参考答案:A79.在Java中,以下哪个最准确描述synchronized关键字?A、允许两线程并行运行,而且互相通信;B、保证在某时刻只有一个线程可访问方法或对象;C、保证允许两个或更多处理同时开始和结束;D、保证两个或更2同时开始和结束参考答案:B80.在Java中,以下可以正确通过编译的是哪一项A、publicclassMyRunnableextendsRunnable{publicvoidrun(){}}B、publicclassMyRunnableextendsRunnable{voidrun(){}}C、publicclassMyRunnableimplementsRunnable{publicvoidrun(){}}D、publicclassMyRunnableimplementsRunnable{voidrun(){}}参考答案:C81.在Java中,以下对于线程生命周期状态转换的说法错误的是A、新建状态在调用start方法后会进入就绪状态B、运行状态下的线程可能会进入就绪状态C、阻塞状态下的线程不可能进入运行状态D、运行状态下的线程如果失去CPU执行权会进入死亡状态参考答案:D82.在Java中,以下对于XPath语法描述错误的是A、“/”表示绝对路径,必须从根节点开始B、“//”表示相对路径,可以从任意位置开始C、“.”表示通配符D、“@”表示选取属性参考答案:C83.在Java中,以下对于join方法描述正确的是A、join()方法是用于线程同步B、join()方法是用于线程休眠C、join()方法是用于线程插队D、join()方法是用于线程启动参考答案:C84.在Java中,线程通过()方法可以休眠一段时间,然后恢复运行。A、runB、setProrityC、yieldD、sleep参考答案:D85.在Java中,线程是Java的()机制A、检查B、解释执行C、并行D、并发参考答案:D86.在Java中,现有一条XPath匹配规则如下“//productName[contains(text(),’手机’)],对于这条匹配规则的说法正确的是A、可以查找所有内容等于‘手机’的productName标签B、可以查找所有内容以‘手机’开头的productName标签C、可以查找所有内容包含‘手机’的productName标签D、可以查找所有内容以‘手机’结尾的productName标签参考答案:C87.在Java中,下面哪个方法不可以在任何时候被任何线程调用?A、wait()B、sleep()C、yield()D、currentThread()参考答案:A88.在Java中,下面哪个不能直接导致一个线程停止执行?A、调用yield()方法B、在一个对象上调用wait()方法C、在一个对象上调用notify()方法D、在一个对象上调用Interrupt()方法参考答案:C89.在Java中,下面关于线程状态的说法正确的是A、线程被启动后,将处于运行状态,即run()方法正在执行中B、线程结束阻塞状态将进入就绪状态。C、当cpu空闲时,可以直接调用阻塞状态的线程来运行。D、运行状态的线程就不再可能直接进入就绪状态参考答案:B90.在Java中,下列说法中错误的一项是A、一个线程是一个Thread类的实例B、新建的线程调用start()方法会进入就绪状态C、线程执行的任务代码可以来自Runnable实例D、新建的线程调用start()方法就能立即进入运行状态参考答案:D91.在Java中,下列属于线程类构造方法的有A、publicThread();B、publicThread(Runnabletarget);C、publicThread(Runnabletarget,Stringname);D、以上都正确参考答案:D92.在Java中,下列哪个一个操作不能使线程从等待阻塞状态进入对象阻塞状态A、等待阴塞状态下的线程被notify()唤醒B、等待阻塞状态下的纯种被interrput()中断C、等待时间到D、等待阻塞状态下的线程调用wait()方法参考答案:D93.在Java中,下列关于Thread类提供的线程控制方法的说法中,错误的一项是A、在线程A中执行线程B的join()方法,则线程A等待直到B执行完成B、线程A通过调用interrupt()方法来中断其阻塞状态C、可以通过创建类implementsThread实现多线程D、currentThread()方法返回当前线程的引用参考答案:C94.在Java中,哪个方法是实现Runnable接口必须实现的A、wait()B、run()C、stop()D、update()参考答案:B95.在Java中,某个资源读取非常消耗时间,为了减少重复读取资源造成的性能低下,可以采用下列A、简单工厂模式B、普通工厂模式C、单例模式D、静态工厂模式参考答案:C96.在Java中,两个线程争夺同一个资源A、一定死锁B、不一定死锁C、不会死锁D、以上说法都不对参考答案:B97.在Java中,可以使用()方法设置线程的优先级A、getPriority()B、setPriority()C、yield()D、wait()参考答案:B98.在Java中,关于线程的运行,说法错误的是A、线程之间是独立运行的B、线程的执行是抢占式的C、线程一旦运行就不可能停止,直到自己的运行代码执行完毕D、对于某些应用程序,开启多个线程能提高执行效率参考答案:C99.在Java中,关于同步代码块描述错误的是A、使用同步代码块可以保证同一时间只能一个线程对敏感数据的操作B、为了保证数据的安全性(准确),可以引入同步代码块C、同步代码块符合“加锁修改释放锁”的逻辑D、使用同步代码一定会造成死锁参考答案:D100.在Java中,方法resume()负责重新开始()线程的执行A、被stop()方法停止B、被sleep()方法停止C、被wait()方法停止D、被suspend()方法停止参考答案:D101.在Java中,对文本字符型文件操作最好用什么I/O流针对性更好?A、FileOutputStreamB、FileInputStreamC、ObjectOutputStreamD、FileWriter参考答案:D102.在Java中,Java系统提供了一个自动回收动态分配的内存的线程,它就是A、异步线程B、消费者线程C、垃圾收集线程D、守护线程参考答案:C103.在Java中,InetAddress类中哪个方法可以获取主机IP地址A、isReachable()B、getHostAddress()C、getHostName()D、getByName()参考答案:B104.在Java中,HTTP服务的常用端口号是A、80B、21C、23D、120参考答案:A105.在Java中,<?version="1.0"encoding=”UTF-8”>这行声明该文档采用了什么编码标准A、GB2312B、ANSIC、ISO-8859-1D、UTF-8参考答案:D106.在java网络编程中,使用TCP编程时编写服务端的套接字类是A、SocketB、DatagramSocketC、ServerSocketD、DatagramPacket参考答案:C107.在java程序中,下列关于线程的说法错误的是A、run方法内部是线程的任务代码B、多个进程运行时执行顺序是按顺序执行的C、如果线程死亡,它便不能运行D、在java中,高优先级的可运行线程可能会抢占低优先级线程的执行权参考答案:B108.在HDFS中,默认一个块多大?A、64MBB、32KBC、128KBD、16KB参考答案:A109.在HDFS文件系统根目录下创建一个名为mydir的文件夹的命令是()。A、hdfs.create(newPath(“hdfs:/mydir”))B、hdfs.open(newPath(“hdfs:/mydir”))C、hdfs.mkdirs(“hdfs:/mydir”)D、hdfs.mkdirs(newPath(“hdfs:/mydir”))参考答案:D110.在HDFS的数据读取过程中,DistributedFileSystem获取这些信息后,生成一个()_对象实例返回给客户端。A、DistributedFileSystemB、FSDataInputSystemC、FSDataOutputSystemD、InputSystem参考答案:B111.在HBase数据模型中,不可以作为行键的是()。A、字符串B、整数C、二进制串D、并行化的结构参考答案:D112.在HBase访问接口中,Pig主要用在哪个场合?A、适合HadoopMapReduce作业并行批处理HBase表数据B、适合HBase管理使用C、适合其他异构系统在线访问HBase表数据D、适合做数据统计参考答案:D113.在HBase的组件中,哪一个负责日志记录()A、HRegionB、HFileC、MemStoreD、WAL参考答案:D114.在Hadoop项目结构中,HDFS指的是什么?A、分布式文件系统B、分布式并行编程模型C、资源管理和调度器D、Hadoop上的数据仓库参考答案:A115.在Hadoop生态系统中,Kafka主要解决Hadoop中存在哪些的问题?A、Hadoop生态系统中各个组件和其他产品之间缺乏统一的、高效的数据交换中介B、不同的MapReduce任务之间存在重复操作,降低了效率C、延迟高,而且不适合执行迭代计算D、抽象层次低,需要手工编写大量代码参考答案:A116.在hadoop配置中yarn-site.xml作用是()A、用于定义系统级别的参数B、用于名称节点和数据节点的存放位置C、用于配置JobHistoryServer和应用程序参数D、配置ResourceManager,NodeManager的通信端口参考答案:D117.在Hadoop配置文件中,以下属于core-site.xml文件主要内容的是()A、用于定义系统级别的参数,如HDFSURL、Hadoop的临时目录等。B、名称节点和数据节点的存放位置、文件副本的个数、文件读取权限等。C、配置ResourceManager,NodeManager的通信端口,web监控端口等。D、包括JobHistoryServer和应用程序参数两部分,如reduce任务的默认个数、任务所能够使用内存的默认上下限等。参考答案:A118.在Hadoop官方的示例程序包hadoop-maprecduceexamples-2.6.4.jar中,封装了一些常用的测试模块。可以获得文件中单词长度的中位数的模块是(C)。A、wordcountB、wordmeanC、wordmedianD、wordstandarddeviation参考答案:C119.在HadoopMapReduce框架中,任何值类型***__***。A、需要实现Writable接口B、需要实现Comparable接口C、需要实现WritableComparable接口D、不需要实现任何接口参考答案:A120.在Hadoop2.x版本下,HDFS中的文件总是按照默认大小()被切分成不同的块,且备份3份。A、256MB、128MC、512MD、1024M参考答案:B121.在eclipse中执行如下代码,控制台会输出什么内容Filefile=newFile(“.”);System.out.println(file.getAbsolutePath())A、当前java文件所属目录的绝对路径B、当前项目src的绝对路径C、当前java文件的绝对路径D、当前项目根目录的绝对路径参考答案:D122.在Centos7中,如果想要查看本机的主机名可以使用下面哪个命令?A、rebootB、pwdC、tailD、hostname参考答案:D123.在()配置文件里可以修改文件块的副本数。A、hdfs-site.xmlB、SlavesC、Core-site.xmlD、Hadoop-env.sh参考答案:A124.云计算平台层(PaaS)指的是什么?A、操作系统和围绕特定应用的必需的服务B、将基础设施(计算资源和存储)作为服务出租C、从一个集中的系统部署软件,使之在一台本地计算机上(或从云中远程地)运行的一个模型D、提供硬件、软件、网络等基础设施以及提供咨询、规划和系统集成服务参考答案:A125.有关MapReduce,下面哪个说法是正确的()A、它提供了资源管理能力B、它提供了用户管理能力C、它是开源数据仓库系统,、用于查询和分析存储在Hadoop中的大型数据集D、它是Hadoop数据处理层参考答案:D126.由于Hive只支持等值连接,为了提高性能,建议把最大的表格放在连接的***__***端。A、最左B、中间C、最右D、任意参考答案:C127.以下选项中,哪种类型间的转换是被Hive查询语言所支持的()A、Double-NumberB、BigInt-DoubleC、Int-BigIntD、String-Double参考答案:D128.以下选项中,哪个程序负责HDFS数据存储()。A、NameNodeB、DataNodeC、SecondaryNameNodeD、ResourceManager参考答案:B129.以下四个Hadoop预定义的Mapper实现类的描述错误的是()A、IdentityMapper<K,V>实现Mapper<K,V,K,V>,将输入直接映射到输出B、InverseMapper<K,V>实现Mapper<K,V,K,V>,反转键/值对C、RegexMapper<K>实现Mapper<K,Text,Text,LongWritable>,为每个常规表达式的匹配项生成一个(match,1)对D、TokenCountMapper<K>实现Mapper<K,Text,Text,LongWritable>,当输入的值为分词时,生成(taken,1)对参考答案:B130.以下哪一项属于非结构化数据。A、企业ERP数据B、财务系统数据C、视频监控数据D、日志数据参考答案:C131.以下哪一项不属于Hadoop可以运行的模式()A、单机(本地)模式B、伪分布式C、互联网模式D、分布式模式参考答案:C132.以下哪项措施可以解决小文件问题?A、HAR文件B、Sequence文件C、HBaseD、其他都对参考答案:D133.以下哪个组件可以指定对key进行Reduce分发的策略?A、RecordReaderB、CombinerC、PartitionerD、FileInputFormat参考答案:C134.以下哪个命令可以终止一个用户的所有进程:A、skillallB、B.skillC、C.killD、D.killall参考答案:D135.以下哪个命令,不是Linux命令()A、pwdB、cdC、mkdirD、ipconfig参考答案:D136.以下哪个技术与大数据无关A、云技术B、B.分布式处理技术C、C.存储技术D、D.物联网技术参考答案:D137.以下哪个方法不是mapper类中的重写方法A、map()方法B、run()f方法C、setup方法D、clean()方法参考答案:D138.以下哪个不是数据仓库的特性:A、面向主题的B、集成的C、动态变化的D、反映历史变化的参考答案:C139.以下描述错误的是?A、输入分片InputSplit其实是对数据的引用B、可以通过重载isSplitable()方法来避免文件分片C、MultipleInputs可以设置多个数据源以及它们对应的输入格式D、ReduceTask需要等到所有的map输出都复制完才进行Merge参考答案:B140.以下关于NodeManager描述正确的是()A、NodeManager是ResourceManager在每台机器上的代理,负责容器管理;监控资源使用情况。B、NodeManager是DataNode在每台机器上的代理,负责管理和监控资源使用情况。C、NodeManager是负责从Scheduler中申请资源,以及跟踪资源的使用情况D、NodeManager实现了ApplicationMaster接口,负责接收新的任务。参考答案:A141.以下()文件中主要用来配置ResourceManager,NodeManager的通信端口,web监控端口等。A、core-site.xmlB、mapred-site.xmlC、hdfs-site.xmlD、yarn-site.xml参考答案:D142.以MapReduce统计学员的平均成绩,如果输出结果的格式为“学生姓名平均成绩”,例如“Alice89.5”,那么通过()选用输出键值对格式。A、job.setOutputKeyClass(Text.class);job.setOutputValueClass(Text.class);B、job.setOutputKeyClass(IntWritable.class)job.setOutputValueClass(Text.class);C、job.setOutputKeyClass(Text.class);job.setOutputValueClass(longWritable.class);D、job.setOutputKeyClass(Text.class);job.setOutputValueClass(DoubleWritable.class);参考答案:D143.一个文件大小156MB,在Hadoop2.0中默认情况下请问其占用几个Block()?A、1B、2C、3D、4参考答案:B144.验证java运行环境是否安装成功,使用哪个命令查看java版本,若出现版本号则表示安装成功()A、java-versionB、java-ipconfigC、java-editionD、java-Release参考答案:A145.写入数据到HDFS的Sink组件是()。A、HiveSinkB、HBaseSinkC、HDFSSinkD、HadoopSink参考答案:C146.现在在hadoop集群当中的配置文件中有这么两个配置,请问假如集群当中有一个节点宕机,主节点namenode需要多长时间才能感知到?<name>erval</name><value>3</value><name>erval</name><value>2000</value>A、26秒B、30秒C、34秒D、20秒参考答案:C147.显示当前所在目录的命令是()A、pwdB、lsC、cdD、mkdir参考答案:A148.下面与HDFS类似的框架是()?A、NTFSB、FAT32C、GFSD、EXT3参考答案:C149.下面有关NameNode和DataNode之间的Hearbeat说法错误的是()A、DataNode通过发送Heartbeat告诉NameNode自己还"活着",并且工作正常B、HeatBeat包含DataNode状态相关信息C、NameNode回复HeartBeat一些DatanodeCommandD、如果NameNode在某一固定时间内没有收到Datanode的Heatbeat,那么它会要求DataNode发送Heartbeat参考答案:D150.下面生成中间键值对的是()A、ReducerB、MapperC、CombinerD、Partitioner参考答案:B151.下面那个类型实现了Writable接口,以便用这些类型定义的数据可以被序列化进行网络传输和文件存储()A、IntB、DoubleC、LongD、Text参考答案:D152.下面那个不属于全球首次划分的大数据阶段()A、大数据出现阶段B、大数据热门阶段C、大数据时代特征阶段D、大数据全覆盖阶段参考答案:D153.下面哪一项不属于计算机集群中的节点?A、主节点(MasterNode)B、源节点(SourceNode)C、名称结点(NameNode)D、从节点(SlaveNode)参考答案:B154.下面哪一项不是MapReduce体系结构主要部分?A、ClientB、JobTrackerC、TaskTracker以及TaskD、Job参考答案:A155.下面哪个选项中的Daemon总是运行在同一台主机上()A、NameNode&JobTrackerB、SecondaryNameNode&JobTrackerC、NameNode&SecondaryNameNodeD、DataNode&TaskTracker参考答案:D156.下面哪个选项不是我们需要Hadoop的主要原因()A、我们需要处理PB级别的数据B、为每个应用建立一个可靠的系统是很昂贵的C、几乎每天都有结点坏掉D、把一个任务分割成多个子任务的方式是不好的参考答案:D157.下面哪个命令是用来定义shell的全局变量:A、exportfsB、B.aliasC、C.exportsD、D.export参考答案:D158.下面哪个命令可以显示安全模式的当前状态A、hadoopdfsadmin-safemodegetB、hadoopdfsadmin-safemodegetStatusC、hadoopdfsadmin-safemodestatusD、其他都不对参考答案:A159.下面哪个程序负责HDFS数据存储A、JobtrackerB、NameNodeC、secondaryNameNodeD、Datanode参考答案:D160.下面哪个不属于YARN的架构的组成部分?A、JobTrackerB、ResourceManagerC、NodeManagerD、ApplicationMaster参考答案:A161.下面哪个YARN的描述不正确的是?A、YARN指YetAnotherResourceNegotiator,是另一种资源协调者B、YARN只支持MapReduce一种分布式计算模式C、YARN最初是为了改善MapReduce的实现D、YARN的引入为集群在利用率、资源统一管理和数据共享等方面带来了巨大好处参考答案:B162.下面关于主服务器Master主要负责表和Region的管理工作的描述,哪个是错误的?A、在Region分裂或合并后,负责重新调整Region的分布B、对发生故障失效的Region服务器上的Region进行迁移C、管理用户对表的增加、删除、修改、查询等操作D、不支持不同Region服务器之间的负载均衡参考答案:D163.下面关于Shuffle过程描述正确的是()A、Job作业必须要实现Combiner过程。B、分组操作发生在溢写过程C、分组的目的是提高Job执行效率。D、压缩目的是提高效率。参考答案:D164.下面关于MapReduce模型中Map函数与Reduce函数的描述正确的是()A、一个Map函数就是对一部分原始数据进行指定的操作。B、一个Map操作就是对每个Reduce所产生的一部分中间结果进行合并操作。C、Map与Map之间不是相互独立的。D、Reducee与Reduce之间不是相互独立的。参考答案:A165.下面对分区描述的过程正确的是()A、merge是将多个溢写文件合并到一个文件B、merge过程不可能有Combiner处理C、缓冲区的作用不大D、以上都不正确参考答案:A166.下面对Shuffle过程描述的过程正确的是()A、shuffle过程包括map节点和reduce阶段B、merge过程不可能有Combiner处理C、缓冲区默认大小值为128MBD、以上都不正确参考答案:A167.下面对Shuffle过程Combiner描述正确的是()A、是将环形缓冲区中相同的key的value合并。B、默认情况下MapTask阶段的环形缓冲区就设置有Combiner可执行。C、是在执行溢写之前就执行Combiner操作D、Combiner的作用反而降低效率参考答案:A168.下列有关MapReduce中,说法是正确的是()。A、它提供了资源管理能力B、它是开源数据仓库系统C、它是Hadoop数据处理层D、它可用于查询和分析存储在Hadoop中的大型数据集参考答案:C169.下列选项中那些是Hadoop2.x版本独有的进程A、JobTrackerB、TaskTrackerC、NodeManagerD、NameNode参考答案:C170.下列选项中关于统一数据访问接口功能叙述不正确的一项为()。A、不同的数据展示、存储和管理B、访问接口与实现代码分离的原则C、屏蔽了数据源的差异和数据库操作细节D、提供一个统一的访问界面和一种统一的查询语言参考答案:A171.下列选项中不是大数据计算体系的基本层次的一项为()。A、数据应用系统B、数据开发系统C、数据处理系统D、数据存储系统参考答案:B172.下列选项中不是hadoop特点的是()。A、可靠性B、扩容能力C、高效率D、成本高参考答案:D173.下列选项中,哪一个命令用于删除文件?A、hadoopfs-rmr/hello.txtB、hadoopfs-rm/hello.txtC、hadoopfs-cat/hello.txtD、hadoopfs-mkdir/hello.txt参考答案:B174.下列选项中,哪一个命令用于删除文件?A、hadoopB、hadoopC、hadoopD、hadoop参考答案:B175.下列选项中,哪一个命令不可以用于查看文件内容?A、hadoopfs-ls/hello.txtB、hadoopfs-text/hello.txtC、hadoopfs-cat/hello.txtD、hadoopfs-tail/hello.txt参考答案:A176.下列选项中,哪一个不属于Zookeeper应用?()A、数据发布和订阅B、负载均衡C、配置管理D、数据仓库参考答案:D177.下列选项哪个不是ZooKeeper的应用场景?A、Master选举B、分布式锁C、分布式协调/通知D、存储非关系型数据参考答案:D178.下列选项描述错误的是?()A、HadoopHA即集群中包含SecondaryNameNode作为备份节点存在。B、ResourceManager负责的是整个Yarn集群资源的监控、分配和管理工作C、NodeManager负责定时的向ResourceManager汇报所在节点的资源使用情况以及接收并处理来自ApplicationMaster的启动停止容器(Container)的各种请求。D、初次启动HadoopHA集群时,需要将格式化文件系统后的目录拷贝至另外一台NameNode节点上。参考答案:A179.下列文件格式那个不是Hive文件的存储格式?(D)A、TextFile格式B、SequenceFile格式C、RCFILE格式D、DOCX格式参考答案:D180.下列说法错误的是()A、Partitioner负责控制map输出结果key的分割B、Reporter用于MapReduce应用程序报告进度C、OutputCollector收集Mapper或Reducer输出数据D、Reduce的数目不可以是0参考答案:D181.下列哪一种命令格式是不正确的()A、get表行健列族B、scan表时间戳起始行健结束行健C、alter表列族D、put表行键列族:列值参考答案:B182.下列哪一项不属于数据库事务具有ACID四性?A、间断性B、原子性C、一致性D、持久性参考答案:A183.下列哪些操作可以设置一个监听器Watcher()A、getDataB、getChildrenC、existsD、setData参考答案:D184.下列哪些不是ZooKeeper的特点()A、顺序一致性B、原子性C、多样系统映像D、可靠性参考答案:C185.下列哪项通常是集群的最主要瓶颈()。A、CPUB、网络C、磁盘IOD、内存参考答案:C186.下列哪项通常是集群的最主要的性能瓶颈?()A、CPUB、网络C、磁盘D、内存参考答案:C187.下列哪项通常是集群的最主要的瓶颈()A、CPUB、网格C、磁盘IOD、内存参考答案:C188.下列哪项不属于流计算的处理流程的三个阶段?A、数据实时采集B、数据批量采集C、数据实时计算D、实时查询服务参考答案:B189.下列哪个属性是hdfs-site.xml中的配置?A、dfs.replicationB、fs.defaultFSC、D、yarn.resourcemanager.address参考答案:A190.下列哪个程序通常与NameNode在同一个节点启动()。A、TaskTrackerB、DataNodeC、SecondaryNameNodeD、Jobtracker参考答案:D191.下列哪个不属于YARN体系结构中ResourceManager的功能?A、处理客户端请求B、监控NodeManagerC、资源分配与调度D、处理来自ApplicationMaster的命令参考答案:D192.下列命令中(在zookeeper安装文件夹的bin目录下执行),哪项是停止ZooKeeper的正确命令()A、start-all.shB、start-stop.shC、zkServer.shstopD、zkServer.shstart参考答案:C193.下列描述中不符合Map/Reduce的是?()A、Map是将数据映射成Key/Value再交给Reduce?B、Reduce先运行,然后运行Map?C、Map/Reduce是函数式的设计思想?D、以上都不正确参考答案:B194.下列描述中,哪项不属于Sqoop的缺点()A、无法控制任务的并发度B、格式紧耦合C、安全机制不够完善D、connector必须符合JDBC模型参考答案:A195.下列描述说法错误的是?()A、SecureCRT是一款支持SSH的终端仿真程序,它能够在Windows操作系统上远程连接Linux服务器执行操作。B、Hadoop是一个用于处理大数据的分布式集群架构,支持在GNU/Linux系统以及Windows系统上进行安装使用。C、VMwareWorkstation是一款虚拟计算机的软件,用户可以在单一的桌面上同时操作不同的操作系统。D、SSH是一个软件,专为远程登录会话和其他网络服务提供安全性功能的软件。参考答案:D196.下列关于使用MapReduce编程模型实现SQL中的join操作错误的是?A、ReduceJoin可以实现内链接,也能实现各种外连接B、ReduceJoin的join操作是在MapReduce程序中的reducer阶段完成的C、MapJoin不会产生数据倾斜D、MapJoin也适合各种join场景,也能实现内连接和各种外链接参考答案:D197.下列关于大数据中计算机存储容量单位的说法中,错误的是()A、基本存储容量单位是字节(Byte)B、汉字字符存储空间要大于英文字符存储空间C、一个英文字符需要2个字节的存储空间D、一个汉字字符需要2个字节的存储空间参考答案:C198.下列关于zookeeper描述正确的是:()A、无论客户端连接的是哪个Zookeeper服务器,其看到的服务端数据模型都是一致的B、从同一个客户端发起的事务请求,最终将会严格按照其发起顺序被应用到zookeeper中C、在一个5个节点组成的Zookeeper集群中,如果同时有3台机器宕机,服务不受影响D、、如果客户端连接到Zookeeper集群中的那台机器突然宕机,客户端会自动切换连接到集群其他机器参考答案:A199.下列关于Storm和Hadoop架构组件功能对应关系,哪个是错误的?A、HadoopJob对应StormTopologyB、HadoopTaskTracker对应StormSupervisorC、HadoopJobTracker对应StormSpoutD、HadoopReduce对应StormBolt参考答案:C200.下列关于MapReduce模型的描述,错误的是哪一项?A、MapReduce采用“分而治之”策略B、MapReduce设计的一个理念就是“计算向数据靠拢”C、MapReduce框架采用了Master/Slave架构D、MapReduce应用程序只能用Java来写参考答案:D201.下列关于Map/Reduce计算流程叙述不正确的一项为()。A、Mapper读取分派给它的输出Split,并生成相应的本地缓存。B、Mapper执行计算处理任务,将中间结果输出保存在本地缓存。C、ApplicationMaster调度Reducer读取Mapper的中间输出文件,执行Reduce任务。D、Reducer将最后结果写入输出文件保存到HDFS。参考答案:A202.下列关于Hive的说法中,描述错误的是()。A、是基于Hadoop的一个数据仓库工具B、可以将非结构化数据文件映射成一张表C、提供了简单的SQL查询功能D、可以将SQL语句装换成MapReduce作业运行参考答案:B203.下列关于HDFS的描述正确的是?A、DataNode通过长连接与NameNode保持通信B、NameNode磁盘元数据不保存Block的位置信息C、HDFS集群支持数据的随机读写D、如果NameNode宕机,SecondaryNameNode会接替它使集群继续工作参考答案:B204.下列关于HBase系统分层架构叙述不正确的一项为()。A、HDFS提供了HBase的顶层物理存储结构B、Hadoop平台提供了存储基础结构:Hadoop集群及系统软件C、客户端:提供了数据库访问接口D、RegionServer:管理多个regions并提供数据访问服务参考答案:A205.下列关于Combiner的描述,正确的是()。A、在MapReduce作业流程中可随意添加CombinerB、添加了Combiner意味着MapReduce程序的运行效率得到了优化C、Combiner可以代替ReducerD、应谨慎使用Combiner参考答案:D206.下列对Zookeeper基本操作描述错误的是()。A、getACL操作用于获取znode的ACLB、exists操作用于检测znode是否存在C、setData操作用于获取znode保存的数据D、sync操作用于将客户端的znode试图与zookeeper同步参考答案:C207.下列不属于HBase基本元素的一项是()。A、表B、记录C、行键D、单元格参考答案:B208.下列()命令可以显示出HDFS文件系统中在线的数据节点。A、hdfsdfsadmin-report-liveB、hdfsdfsadmin-report-activeC、hdfsdfsadmin-report-deadD、hdfsdfsadmin-report-decommissioning参考答案:A209.下列()不是云计算三层架构的概括。A、IaaSB、PaaSC、SaaPD、SaaS参考答案:C210.下列()通常与NameNode在一个节点启动。A、SecondaryNameNodeB、DataNodeC、TaskTrackerD、Jobtracker参考答案:D211.完全分布式,不需要修改的配置文件为()。A、core-site.xmlB、hdfs-site.xmlC、hadoop-env.shD、mapred-site.xml参考答案:C212.数据清洗的方法不包括A、缺失值处理B、B.噪声数据清除C、C.一致性检查D、D.重复数据记录处理参考答案:D213.使用下面那个命令可以将HDFS目录中所有文件合并到一起A、putmergeB、getmergeC、remergeD、mergeALL参考答案:B214.设置MapReduce参数传递的正确方式是()。A、通过变量赋值进行传递B、通过get)和set()方法传递C、通过conf.set("argName",args[n])传递D、通过job.set("argName",args[n])传递参考答案:C215.设计分布式数据仓库hive的数据表时,为取样更高效,一般可以对表中的连续字段进行()操作。A、分桶B、分区C、索引D、分表参考答案:A216.删除文件命令为:A、A:mkdirB、B.rmdirC、C.mvD、D.rm参考答案:D217.如没有配置hadoop.tmp.dir参数,此时系统默认的临时目录为()A、/tmp/hadoop-hadoopB、/usr/hadoop-hadoopC、/usr/local/hadoop-hadoopD、/usr/local/src/hadoop-hadoop参考答案:A218.如果要列出一个目录下的所有文件需要使用命令:A、ls-lB、B.lsC、C.ls-aD、D.ls-d参考答案:C219.日志消息的级别中那个是不会影响系统但值得注意()A、ALEKKTB、CRITC、NOTICED、DEBUG参考答案:C220.请问在Hadoop体系结构中,按照由下到上顺序,排列正确的是()PigHiveCrunch都是运行在MapReduce,Spark,或者Tez之上的处理框架Avro是一个克服了Writable部分不足的序列化系统A、CommonHiveHDFSB、CommonMapReducePigC、HDFSMapReduceHBaseD、HDFSAvroHBase参考答案:B221.配置主机名和IP地址映射的文件位置是()A、/home/hostsB、/usr/local/hostsC、/etc/hostD、/etc/hosts参考答案:D222.配置Hadoop文件参数时,配置项“dfs.replication”应该配置在哪个文件?()A、core-site.xmlB、hdfs-site.xmlC、mapred-site.xmlD、yarn-site.xml参考答案:B223.哪种场景适用于HDFSA、存储大量小文件B、实时读取C、需经常修改数据D、流式读取参考答案:D224.默认情况下管理员创建了一个用户,会在哪个目录创建一个用户主目录:A、/usrB、B./rootC、C./homeD、D./etc参考答案:C225.命令rpm-qa|grepvsftpd的功能是:A、A:安装vsftpdB、B.启动vsftpdC、C.检查系统是否已安装vsftpdD、D.运行vsftpd程序参考答案:C226.列出磁盘分区信息的命令是:A、mkfsB、B.fdisk-lC、C.fstabD、D.dfisk参考答案:B227.客户端连接Zookeeper集群的命令是()。A、get/zkB、delete/zkC、zkCli.shD、ls/参考答案:C228.克隆虚拟机之后需要修改()文件。①/etc/udev/rules.d/70-persistent-net.rules、②/ete/sysconfig/network-scriptd/ifcf-eth0、③/etc/sysconfig/networkA、①②B、①②③C、②③D、①③参考答案:B229.可以实现将本机公钥拷贝给其他机器的命令是A、ssh-keygen-trsaB、ssh-copy-nameroot@localhostC、ssh-copy-id-iroot@localhostD、ssh-keygen-copy-namersa参考答案:C230.禁用ipv6需要修改的是哪个配置文件()A、/etc/sysctl.confB、/etc/profileC、~/.bashrcD、/etc/networks参考答案:A231.结构化数据的表现形式为()。A、文本B、视图C、二维表D、查询参考答案:C232.结构化的数据,先有(),再有().A、数据结构B、结构数据C、内容结构D、结构内容参考答案:B233.将关系型数据库中的数据导入到Hadoop平台的工具是()。A、importB、exportC、overwriteD、drop参考答案:A234.加载数据到Hive表,哪种方式不正确?()A、直接将本地路径的文件load到Hive表中B、将HDFS上的文件load到Hive表中C、Hive支持insertinto单条记录的方法,所以可以直接在命令行插入单条记录D、将其他表的结果集insertinto到Hive表参考答案:C235.互联网发展的第()个时代为智能互联网。A、3.0B、4.0C、1.0D、2.0参考答案:A236.关与Hive与传统关系型数据库的对比,错误的是?(B)A、Hive基于HDFS存储,理论上存储量可无限扩展,而传统数据库存储量会有上限B、由于Hive基于大数据平台,所以查询效率比传统数据库快C、传统关系型数据库的索引机制发展的已经非常成熟,而Hive的索引机制还很低效D、由于Hive的数据存储在HDFS中,所以可以保证数据的高容错、高可靠参考答案:B237.关于自定义数据类型,下列说法正确的是(D)A、自定义数据类型必须继承Writable接口B、自定义MapReduce的key需要继承Writable接口C、自定义MapReduce的value需要继承WritableComparable接口D、自定义数据类型必须实现readFields(DataInputdatainput)方法参考答案:D238.关于基于Hadoop的MapReduce编程的环境配置,下面哪一步是不必要的()A、安装linux或者在Windows下安装CgywinB、安装javaC、安装MapReduceD、配置Hadoop参数参考答案:C239.关于Storm流计算叙述不正确的一项为()。A、Storm是一种NativeStreamProcessingSystem,即对流数据的处理是基于每条数据进行B、Storm其并行计算是基于有Spout和Bolt组成的有向拓扑图ToPology来实现C、Topology:定义了串行计算的逻辑模型(或者称抽象模型),也即从功能和架构的角度设计了计算的步骤和流程。D、Topology里的Spout和Bolt的功能是靠worker节点上的Task来实现参考答案:C240.关于shuffle阶段中描述错误的是()A、shuffle可以分为mapshuffle和reduceshuffle。B、Shuffle中可以排序C、Shuffle中有可能有combiner、partition过程。D、Shuffle中一定不会有压缩过程。参考答案:D241.关于Shuffle过程环形缓冲区描述正确的是()A、环形缓冲区必须是100MB.B、环形缓冲区可以提高Job执行效率C、环形缓冲区阀门值大小可以修改。D、以上都不正确。参考答案:B242.关于SecondaryNameNode下面哪项是正确的()。A、它是NameNode的热备B、它对内存没有要求C、它的目的是帮助NameNode合并编辑日志,减少NameNode启动时间D、SecondaryNameNode应与NameNode部署到一个节点参考答案:C243.关于SecondaryNameNode哪项是正确的()A、它是NameNode的热备B、它对内存没有要求C、它的目的是帮助NameNode合并编辑日志,减少NameNode启动时间D、都不正确参考答案:C244.关于SecondaryNameNode的说法错误的是()A、main方法是SecondaryNameNode的入口,它启动线程执行runB、启动前的构造过程主要是创建和NameNode通信的接口和启动HTTP服务器C、run方法每隔一段时间执行doCheckpoint()D、main方法从NameNode上取下FSImage和日志,和本地合并再传回NameNode(应该是run方法完成)参考答案:C245.关于MapReduce1和YARN的对比错误的是?A、MapReduce1由JobTracker负责作业调度与任务监控B、YARN的作业调度和任务监控都是由ResourceManager组件完成C、MapReduce1的任务节点叫做TaskTracker,而Yarn的任务节点为NodeManagerD、MapReduce1的资源调配单元为Slot,而Yarn的资源调配单元为Container参考答案:B246.关于MapReduce1.0的体系结构的描述,下列说法错误的是?A、Task分为MapTask和ReduceTask两种,分别由JobTracker和TaskTracker启动B、slot分为Mapslot和Reduceslot两种,分别供MapTask和ReduceTask使用C、TaskTracker使用“slot”等量划分本节点上的资源量(CPU、内存等)D、TaskTracker会周期性接收JobTracker发送过来的命
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 潍坊期末政治试题内容与答案揭晓
- 2026年留学生租房沟通AI英语对话
- ISO 10845-32021 建筑采购 - 第3部分标准招标条件标准立项发展报告
- ISO 787-22021 颜料和增量剂的一般测试方法 - 第2部分在105℃下挥发物质的测定标准立项发展报告
- 2026年4月自考13126《管理学原理(初级)》历年真题及答案
- 天津高考数列典型试题及答案分享
- 高中物理必修第一册拓展课七
- 2026年英语六级培训练习
- 高中数学高考导数压轴题10大题型全归纳(母题详解+双变式分层训练)
- 小学升学语文考题及参考答案
- 模板-定期风险评价报告模板
- 2025年公务员面试国际发展合作问题与答案
- GB/T 3672.1-2025橡胶制品的公差第1部分:尺寸公差
- 2025广东茂名市电白区事业单位招聘100人考试备考题库及答案解析
- 华润电力控股内蒙古区域招聘笔试题库2025
- 轧钢工(高级)轧钢工职业技能考试题(附答案)
- 比伐卢定护理
- 民间非营利组织会计制度【财会〔2024〕25号】
- 门诊护理礼仪规范与实务
- 普惠金融营销课件
- 宿管员安全知识培训
评论
0/150
提交评论