2025年河北省职业院校大数据应用与服务(中职组)赛项考试题库(含答案)_第1页
2025年河北省职业院校大数据应用与服务(中职组)赛项考试题库(含答案)_第2页
2025年河北省职业院校大数据应用与服务(中职组)赛项考试题库(含答案)_第3页
2025年河北省职业院校大数据应用与服务(中职组)赛项考试题库(含答案)_第4页
2025年河北省职业院校大数据应用与服务(中职组)赛项考试题库(含答案)_第5页
已阅读5页,还剩99页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

PAGEPAGE12025年河北省职业院校大数据应用与服务(中职组)赛项考试题库(含答案)一、单选题1.在Kafka中,()是ISR队列中最小的LEO。A、LEOB、ISRC、HWD、AR答案:C2.在配置好Hadoop集群之后,通过浏览器登录查看HDFS状态,以下是查看的URL()。A、http://master:8089B、:50070C、http://master:16010D、http://master:9999答案:B3.Flink中的任务并行度(TaskParallelism)是指()。A、任务执行的速度B、同一任务的多个实例并行执行C、不同任务之间的并行执行D、任务的执行顺序答案:B4.ZooKeeper的特点不包括()。A、顺序一致性B、原子性C、可靠性D、复合系统映像答案:D5.关于Dataset,下列说法错误的是()。A、Dataset能从RDD中构建B、Dataset提供了特定域对象中的弱类型集合C、Dataset结合了RDD和DataFrame的优点D、ataset可以通过SparkSession中的createDataset来创建答案:B6.Flume的事件可以包含哪些属性?()A、Timest,Type,Body,Headers,CountB、Timest,Type,Body,Headers,IDC、Timest,Type,Body,Headers,SequenceIDD、Timest,Type,Body,Headers,Number答案:C7.Flink的安装过程中,通常需要设置()来指定Flink的根目录。A、JAVA_HOMEB、PATHC、FLINK_HOMED、FLINK_PATH答案:C8.Kafka的消息传递语义是()。A、最终一致性B、强一致性C、弱一致性D、无一致性答案:C9.在Hive中,以下哪个配置参数用于指定HiveCLI的历史命令记录文件名()?A、B、hive.cli.history.fileC、mand.log.filenameD、hive.query.log.file答案:B10.Task运行在下面()选项中Executor上的工作单元。A、DriverprogramB、sparkmasterC、workernodeD、Clustermanager答案:C11.Kafka的生产者在发送消息时可以选择的传递方式是()。A、同步传递B、异步传递C、并行传递D、串行传递答案:A12.在HDFS文件操作中,上传文件的命令是()。A、putB、inputC、getD、up答案:A13.关于Hive描述正确的是()。A、count函数必须开窗口才能使用B、max函数是窗口函数C、lead函数是聚合函数,不是窗口函数D、min函数是聚合函数,不是窗口函数答案:B14.ClusterManager是()。A、资源的分配和管理B、从节点C、执行器D、主节点答案:A15.下面中不属于HIVE中的元数据信息()。A、表的名字B、表的列和分区及其属性C、表的属性(只存储内部表信息)D、表的数据所在目录答案:C16.Flume的事件Body可以包含什么类型的数据?()A、String,Byte数组,字节流,Map<String,String>和自定义对象序列化后的数据。B、String,Map<String,String>和自定义对象序列化后的数据。C、Byte数组,字节流和自定义对象序列化后的数据。D、String和自定义对象序列化后的数据。答案:A17.Dockerfile配置文件使用()命令指定基础镜像。A、IMPORTB、GETC、OPEND、FROM答案:D18.关于SparkSQL,以下说法正确的是()。A、HiveContext继承了SqlContextB、DataFrame其实就是RDDC、HiveContext只支持SQL语法解析器D、SparkSQL的前身是Hive答案:A19.在Hive中,以下哪个配置参数用于指定Hive表的默认存储格式()?A、hive.default.storage.formatB、hive.default.file.formatC、hive.default.formatD、hive.table.default.format答案:C20.关于Hive和传统数据库的比较描述正确的是()?A、Hive使用了查询语言HQL(HiveQueryLanguage),HQL与SQL没有任何关系B、Hive使用了查询语言HQL(HiveQueryLanguage),HQL与SQL没有任何关系C、Hive是建立在Hadoop之上的,所有Hive的数据都是存储在HDFS中的,而数据库则可以将数据保存在块设备或者本地文件系统中D、Hive的针对数据仓库设计,针对的是读多写少的场景灕灕灕灕灕灕答案:D21.下面()不是RDD的特点。A、可分区B、可序列化C、可修改D、可持久化答案:C22.Flume的源类型有哪些?()A、Log4j,Kafka,HBase,自定义B、File,Kafka,HBase,自定义C、File,Kafka,HBase,Spooling,自定义D、File,Kafka,HBase,Spooling,Exec答案:C23.Flume的哪个组件可以保证数据不会丢失?()A、通道B、接收器C、拦截器D、源答案:B24.将nginx容器接入自定义的myops网络的操作命令是()。A、dockernetworkjoinmyopsnginxB、dockernetworkconnmyopsnginxC、dockernetworkconnectmyopsnginxD、ockernetworkconnectnginxmyops答案:C25.Dockerfile中声明镜像内服务监听的端口的指令是()。A、LISTENB、EXPOSEC、ARGD、MONITOR答案:B26.在ZooKeeper中,Watcher是一次性的吗?()A、是,一旦触发就无法再次使用B、否,可以反复使用C、取决于Watcher的类型D、取决于节点的类型答案:C27.关于ZooKeeper临时节点的说法正确的是()。A、创建临时节点的命令为:create-s/tmpmyvalueB、一旦会话结束,临时节点将被自动删除C、临时节点不能手动删除D、临时节点允许有子节点答案:B28.下面哪个程序负责HDFS数据存储()。A、DatanodeB、NameNodeC、JobtrackerD、secondaryNameNode答案:A29.sqoop安装完成后,查看sqoop版本的命令是()。A、Sqoop-versionB、SqoopversionC、Sqoop-vD、Sqoopv答案:B30.下列描述中,哪项不属于Sqoop的缺点()。A、无法控制任务的并发度B、格式紧耦合C、安全机制不够完善D、connector必须符合JDBC模型答案:A31.在Docker的运行过程中,对镜像的操作不包括()。A、deleteB、searchC、pullD、push答案:A32.下列选项中,针对Spark运行的基本流程是错误是()。A、Driver端提交任务,向Master申请资源B、Master与Worker进行TCP通信,使得Worker启动ExecutorC、Executor启动会主动连接Driver,通过Driver->Master->WorkExecutor,从而得到Driver在哪D、river会产生Task,提交给Executor中启动Task去做真正的计算答案:B33.Hadoop组件在企业应用中,能用于大数据集实时查询的产品有()。A、HiveB、PigC、MahoutD、Hbase答案:D34.Flume的哪个版本开始支持Avro作为数据传输格式?()A、1.X版本B、2.X版本C、3.X版本D、4.X版本以后答案:D35.使用Dockerrun命令运行一个容器时,通过参数()可启动一个bash允许用户进行交互。A、itB、iaC、ntD、na答案:A36.要在Hive中启用Kerberos认证,应该设置哪个配置参数()?A、hive.security.authenticationB、hive.kerberos.enabledC、hive.auth.kerberosD、hive.authentication.method答案:A37.查看Docker所有容器的命令是()。A、dockerpsB、dockerps-aC、dockerpsallD、ockerall答案:B38.在Hive中,以下哪个配置参数用于指定Hive的执行引擎为Spark()?A、hive.execution.engine=sparkB、hive.spark.execution.engine=trueC、hive.spark.engine.enabled=trueD、hive.query.engine=spark答案:A39.关于ZooKeeper说法错误的是()。A、ZooKeeper是一个高可用的分布式数据管理和协调框架B、能够很好的保证分布式环境中数据的一致性C、越来越多的分布式系统(Hadoop、HBase、Kafka)中使用ZooKeeperD、Hadoop的高可用不需要用到ZooKeeper答案:D40.获取远程仓库中Docker镜像的操作命令是()。A、dockergetB、dockerpushC、dockerpullD、ockerdownload答案:C41.ZooKeeper中的一次读操作是原子的吗?()A、是,读操作是原子的B、否,读操作可能不是原子的C、取决于读操作的类型D、取决于节点的类型答案:A42.Flink的状态管理用于(),以支持容错性和状态化的计算。A、存储和检索中间结果B、控制数据流速度C、定时触发窗口操作D、执行数据清洗答案:A43.当之前下线的分区重新上线时,要执行Leader选举,选举策略为()。A、OfflinePartitionLeader选举B、ReassignPartitionLeader选举C、PreferredReplicaPartitionLeader选举D、ControlledShutdownPartitionLeader选举答案:A44.以下关于Spark计算框架,说法错误的是()。A、Spark支持内存计算B、Spark框架是使用Java编写的C、Spark提供了完整而强大的技术栈,包括SQL查询、流式计算、机器学习和图算法组件D、Spark可运行于独立的集群模式中,可运行于Hadoop中,也可运行于AmazonEC2等云环境中答案:B45.在Hive中,以下哪个配置参数用于指定Hive执行计划的输出目录()?A、hive.query.plan.output.directoryB、hive.exec.plan.output.directoryC、hive.plan.output.directoryD、hive.query.execution.directory答案:A46.使用create命令新建容器时,指定容器在网络中的别名的命令选项是()。A、net-nameB、net-aliasC、networkD、alias答案:B47.Flink的TableAPI和SQL用于()。A、数据可视化B、执行SQL查询C、数据流分析D、数据清洗答案:B48.在ZooKeeper中,SEQUENTIAL节点的特点是()。A、节点名称具有顺序性B、节点数据具有顺序性C、节点的触发器具有顺序性D、节点的ACL具有顺序性答案:A49.HadoopMapReduce支持多种语言编程,下列说法不正确的是()。A、可以用JAVA语言编写MapReduce应用程序B、可以用C/C++语言编写MapReduce应用程序C、可以用Python语言编写MapReduce应用程序D、可以用javascript语言编写MapReduce应用程序答案:D50.Flume的拦截器实现了哪个接口?()A、ChannelInterceptorB、EventInterceptorC、SinkInterceptorD、SourceInterceptor答案:B51.在导入开始之前,Sqoop检索出表中所有的列以及列的SQL数据类型,这些SQL类型被映射什么类型()。A、CB、C++C、JavaD、Python答案:C52.下列关于MapReduce说法不正确的是()。A、MapReduce是一种计算框架B、MapReduce来源于google的学术论文C、MapReduce程序只能用java语言编写D、MapReduce隐藏了并行计算的细节,方便使用答案:C53.关于Hive数据倾斜问题描述正确的是()。A、不需要了解业务,对业务进行数据探查无法解决数据倾斜B、每一个数据倾斜的作业都需要优化C、小文件合并不会解决数据倾斜的问题D、可以适当的通过控制mapper和reducer来控制数据倾斜的问题答案:D54.ZooKeeper使用的是()文件系统。A、HadoopDistributedFileSystem(HDFS)B、NetworkFileSystem(NFS)C、ZooKeeperFileSystem(ZFS)D、ExtensibleStorageEngine(ESE)答案:C55.Flume的事件传输方式是什么?()A、pull-basedB、push-basedC、stream-basedD、event-based答案:B56.Flink的Web界面通常用于()。A、编写Flink作业B、监控Flink集群C、运行Flink作业D、调试Flink作业答案:B57.Flume的哪个版本加入了对Thrift事件的的支持?()A、Flume1.0B、Flume1.1C、Flume1.2D、Flume1.3答案:B58.Flink的CEP(ComplexEventProcessing)库用于(),帮助检测和处理特定的事件模式。A、执行复杂数据处理操作B、处理图形数据C、处理实时事件流D、控制数据流速度答案:C59.以下关于Hive操作描述不正确的是()。A、Hive是一个建立在hadoop文件系统上的数据仓库架构,可以用其对HDFS上B、Hive依赖于MapReduce处理数据C、Hive的加载数据时候,可以用local进行修饰,表示从某个本地目录下加载数据D、Hive一般可以用于实时的查询分析答案:D60.Docker运行的核心模块是()。A、DockerServerB、DockerEngineC、DockerClient答案:B61.关于DataFrame与RDD在结构上的区别,以下描述错误的是()。A、DataFrame可以看作是分布式的Row对象的集合,在二维表数据集的每一列都带有名称和类型B、RDD是分布式的Java对象的集合C、RDD在转换数据形式时效率相对较高D、ataFrame提供了比RDD更丰富的算子答案:C62.Flume的默认Avro序列化方式是什么?()A、JSONB、inaryC、SpecificD、Generic答案:C63.关于Hive的SequenceFile格式描述正确的是()。A、SequenceFile是二进制文件格式,以list的形式序列化到文件中B、SequenceFile存储方式:列存储C、SequenceFile不可分割、压缩D、SequenceFile优势是文件和Hadoopapi中的MapFile是相互兼容的答案:D64.以下关于Spark中的RDD的说法,错误的是()。A、RDD就是一个分布式对象集合,本质上是一个只读的分区记录集合B、每个RDD可分成多个分区,每个分区就是一个数据集片段C、RDD提供了一种高度共享内存模型,RDD既可以读,也可以直接修改D、RDD的不同分区可以被保存到集群中不同的节点上,从而可以在集群中的不同节点上进行并行计算答案:C65.在ZooKeeper中,节点可以设置监听器吗?()A、是,可以设置监听器B、否,节点没有监听功能C、取决于节点的类型D、取决于节点的权限设置答案:A66.Flume的哪个拦截器可以按类型区分事件?()A、ETL拦截器B、分区拦截器C、以上都不是D、以上都是答案:A67.Docker的三大核心不包括()。A、容器B、算法C、镜像D、仓库答案:B68.Flume如何处理故障恢复?()A、使用事务性机制B、使用重试机制C、使用断点续传机制D、以上都不是答案:C69.ZooKeeper中的一致性协议ZAB是基于()算法实现。A、2PC(Two-PhaseCommit)算法B、Raft算法C、Paxos算法D、3PC(Three-PhaseCommit)算法答案:C70.Sqoop的作用是()。A、用于传统关系数据库和Hadoop之间传输数据B、提供对日志数据进行简单处理的能力C、是Hadoop体系中数据存储管理的基础D、是一个建立在HDFS之上,面向列的针对结构化和半结构化数据和动态数据库答案:A71.Sqoop中哪个参数用于指定要使用的分隔符,以便在导入数据时正确处理字段?()A、–field-separatorB、–fsC、–delimiterD、–split-by答案:A72.下列关于leader和follower的说法正确的是()。A、一个topic的每个分区可以没有leaderB、一个topic的每个分区可以没有followerC、消费者消费数据的对象都是leaderD、follower从leader中同步数据有一定延迟答案:C73.以下哪个是正确的sqoop命令,用于将数据从MySQL导入到HDFS?()A、bin/sqoopimport--connectjdbc:mysql://0:3306/userdb--usernameroot--delete-target-dir--target-dir/MysqlToHDFS1--tablestudentB、in/sqoopimport--connectjdbc:mysql://localhost:3306/userdb--usernameroot--delete-target-dir--target-dir/MysqlToHDFS1--tablestudentC、bin/sqoopimport--connectjdbc:mysql://localhost:3306/userdb--usernameroot--delete-target-dir--target-dir/MysqlToHDFS1--tablestudent--m11D、bin/sqoopimport--connectjdbc:mysql://localhost:3306/userdb--usernameroot--delete-target-dir--target-dir/MysqlToHDFS1--tablestudent--m11.3答案:D74.在Hive中,以下哪个配置参数用于指定Hive执行计划的缓存目录()?A、hive.query.plan.cache.dirB、hive.exec.plan.cache.dirC、hive.cache.plan.directoryD、hive.query.cache.directory答案:B75.制作镜像时,复制文件到镜像中使用的命令是()。A、DDB、COPYC、RUND、CMD答案:B76.下面()端口不是Spark自带服务的端口。A、8080.0B、4040.0C、8090.0D、18080.0答案:C77.Flink的安全性设置通常包括(),以确保只有授权用户能够访问Flink集群。A、访问控制和身份验证B、作业调度和任务管理C、数据加密和网络安全D、日志管理和监控答案:A78.Hive中以下操作不正确的是()。A、loaddatainpathintotablenameB、insertintotablenameC、insertoverwritetablenameD、upddatetablename答案:D79.在ZooKeeper中,ACL(访问控制列表)可以设置为()。A、CREATOR_ALL_ACLB、OPEN_ACL_UNSAFEC、AUTH_IDSD、所有选项都正确答案:D80.()参数不影响kafka重平衡?A、session.timeout.msB、erval.msC、message.max.bytesD、erval.ms答案:C81.在ZooKeeper中,在配置文件zoo.cfg中,请问initLimit表示的含义是()。A、Leader-Follower初始通信时限B、Leader-Follower同步通信时限C、lient-Server通信心跳时间D、Client-Server初始通信时限答案:A82.Kafka的消费者可以以什么方式进行消息偏移量的管理?()A、手动管理B、自动管理C、随机管理D、循环管理答案:B83.Flink的主要特点是()。A、高吞吐量B、低延迟C、Exactly-once处理语义D、以上都是答案:D84.关于MapReduce优点,下列说法不正确的是()。A、高容错性B、适合PB级以上海量数据的离线处理C、良好的扩展性D、适合做实时计算答案:D85.关于MapReduce的说法正确的是()。A、MapReduce1.0用YARN框架来进行资源调度的B、MapReduce是基于内存计算的框架C、MapReduce是分布式文件存储系统D、MapReduce1.0既是一个计算框架又是一个资源调度框架答案:D86.Flink的日志管理通常包括()这几个方面。A、日志存储和检索B、日志清理和压缩C、日志分析和报警D、以上都是答案:D87.ZooKeeper中的一次写操作是原子的吗?()A、是,写操作是原子的B、否,写操作可能不是原子的C、取决于写操作的类型D、取决于节点的类型答案:A88.sqoop的组件功能是()。A、sqoop只能实现关系型数据库向非关系型数据传输数据B、sqoop是关系型数据库C、sqoop实现在关系型数据库和非关系型数据库之间时行数据传输D、sqoop是非关系型数据库答案:C89.Kafka的消息是如何进行顺序写入的?()A、顺序写入到磁盘B、顺序写入到内存C、顺序写入到缓存D、顺序写入到索引文件答案:A90.Flume的哪个版本加入了Kafka作为源和汇点?()A、1.X版本B、2.X版本C、3.X版本D、4.X版本答案:B91.将一个RDD转换为DataFrame的方法是()。A、dataFrame()B、toDataFrame()C、DF()D、toDF()答案:D92.Flink的分布式部署需要的组件是()。A、JobManager和TaskManagerB、JobClient和JobTrackerC、Master和SlaveD、river和Executor答案:A93.搜索nginx引擎的操作命令是()。A、dockersearchnginxB、dockerpullnginxC、dockerpushnginxD、ockerrmnginx答案:A94.使用Dockerrm命令删除容器时只删除容器的链接,需要使用的命令选项是()。A、fB、lC、vD、i答案:B95.关于Hive用户自定义函数UDF的描述错误的是()。A、UDF(User-Defined-Function)一进一出B、UDAF(User-DefinedAggregationFuncation)聚集函数,多进一出C、UDTF(User-DefinedTable-GeneratingFunctions)一进多出D、上传UDFjar包至Hive环境即可使用自定义函数答案:D96.Kafka的消息以什么形式进行存储?()A、表格B、集合C、文档D、日志答案:D97.namenode在()模式下hdfs文件系统无法修改和写入文件。A、安全模式B、维护模式C、同步模式D、待机模式答案:A98.ZooKeeper中的Watcher是()。A、监视节点数据变更的机制B、监视节点子节点变更的机制C、监视节点连接状态的机制D、所有选项都正确答案:D99.Hive是以()技术为基础的数据仓库。A、HDFSB、MAPREDUCEC、HADOOPD、HBASE答案:C100.Flink的数据源可以是()。A、文件B、消息队列C、数据库D、以上都是答案:D101.Kafka的消息保留策略可以根据什么进行配置?()A、时间B、大小C、主题D、分区答案:A102.Hive中的自动分区是通过哪个配置参数启用的()?A、hive.auto.partitionB、hive.partition.autoC、hive.exec.dynamic.partitionD、hive.partitioning.auto答案:C103.下列说法错误的是()。A、生产者和消费者面向的都是一个topicB、生产者发送数据的对象是leaderC、当集群中的某个节点发生故障时,Replica上的partition数据不会丢失D、partition是一个没有顺序的队列答案:D104.Flume的Channel组件负责什么?()A、临时存储从Source组件接收的数据B、临时存储从下一组件接收的数据C、在Source和Sink之间传递数据D、在Source和Receiver之间传递数据答案:A105.允许开发人员为容器分配MAC地址的是()。A、网桥网络B、覆盖网络C、驱动网络D、主机网络答案:C106.Kafka的消息消费可以使用哪种模式?()A、单播B、组播C、广播D、串播答案:A107.当使用sqoop将数据从MySQL导入到HDFS时,以下哪个参数用于指定使用多个mapper?()A、-mB、-fC、-tD、-c答案:A108.Flink的广播状态(BroadcastState)用于()。A、在所有任务之间共享状态B、保持数据流的连续性C、加速数据处理D、控制数据流速度答案:A109.Flume的哪个版本引入了Kafka作为其事件源和接收器?()A、Flume1.6B、Flume1.7C、DH5.0D、CDH5.1答案:C110.以下哪个文件是能够修改HDFS的副本保存数量参数()。A、修改mapred-site.xml配置文件B、修改core-site.xml配置文件C、修改yarn-site.xml配置文件D、修改hdfs-site.xml配置文件答案:D111.Kafka的核心是由哪个组件组成?()A、ProducerB、ConsumerC、BrokerD、ZooKeeper答案:C112.在Hive中,以下哪个配置参数用于指定Hive服务器的端口号()?A、hive.server.portB、hive.server2.thrift.portC、hive.server.rpc.portD、hive.thrift.server.port答案:B113.查看Docker版本号的操作命令是()。A、docker-vB、docker--versionC、docker-lD、ocker-a答案:A114.Flink支持处理各种类型的数据,包括()数据。A、结构化B、半结构化C、无结构化D、以上都是答案:D115.Flink最常用的编程语言是()。A、JavaB、PythonC、ScalaD、C++答案:A116.查看Docker镜像信息的命令是()。A、lsdockerB、lsimagesC、dockerlistimagesD、ockerimages答案:D117.下列方法中,不能创建RDD的方法是()。A、makeRDDB、parallelizeC、textFileD、testFile答案:D118.Linux下启动HDFS的命令是()。A、HdfsB、startdfsC、start-dfs.shD、start-dfs.cmd答案:C119.Docker配置文件的语法格式中,代表单个字符的符号是()。A、∗B、?C、!D、^答案:B120.Docker的()命令用于构建镜像。A、createB、addC、buildD、new答案:C121.Docker中的每一个工作都可以抽象为一个()。A、实例B、进程C、JobD、请求答案:C122.使用消息队列的好处不包括()。A、能够有效解耦B、可恢复性增强C、提供缓冲空间D、能够同步通信答案:D123.下面()操作是宽依赖。A、map♂B、flatMapC、groupByKeyD、union答案:C124.Flink的集群部署通常需要()作为资源管理器。A、YARNB、ApacheZooKeeperC、ApacheKafkaD、HadoopHDFS答案:A125.当Kafka中日志片段大小达到()时,当前日志片段会被关闭。A、1MB、100MC、1GBD、10GB答案:C126.SparkStreaming中对DStream的转换操作会转变成对()的操作。A、sqlB、datasetC、rddD、ataframe答案:C127.在ZooKeeper中,Watcher是在()被触发。A、在节点数据变更之前B、在节点数据变更之后C、在节点数据变更期间D、取决于Watcher的设置答案:B128.HBase依赖()技术框架提供消息通信机制。A、ZookeeperB、ChubbyC、RPCD、Socket答案:A129.要在Hive中启用数据列级别的访问控制(RBAC),应该设置哪个配置参数()?A、hive.column.security.enabledB、hive.rbac.enabledC、hive.security.column.enabledD、hive.access.control.columns=true答案:C130.在Flink的配置文件中,()通常用来指定Flink任务并行度。A、parallelism.defaultB、task.parallelismC、parallelism.default-taskD、task.default-parallelism答案:D131.Flink支持的数据处理方式为()。A、批处理B、流处理C、以上都是D、无法确定答案:C132.Flink的作业提交通常需要()来管理作业的执行。A、JobManagerB、TaskManagerC、ResourceManagerD、NameNode答案:A133.Kafka最初是由哪家公司开发的?()A、GoogleB、FacebookC、LinkedInD、Microsoft答案:C134.在Sqoop中,使用哪个命令可以列出可用的数据库连接?()A、sqooplist-databasesB、sqoophelpC、sqoopconnectionsD、sqoopserver答案:A135.在Flink中,窗口(Window)的作用是()。A、控制数据流的速度B、对数据流进行分组C、对数据流进行时间切片D、对数据流进行过滤答案:C136.dockerfile文件的作用是()。A、普通文件B、用于自定义镜像C、用于保存容器配置D、用于存放docker配置答案:B137.Flume的核心组件有哪些?()A、Source,Channel,andSinkB、Source,Channel,andReceiverC、Source,Buffer,andSinkD、Source,Router,andChannel答案:A138.以下对hive中表数据操作描述正确的是()。A、hive可以修改行值B、hive可以修改列值C、hive不可以修改特定行值、列值D、以上说法都不对答案:C139.Flink的作业调度(JobScheduling)通常由()负责。A、ResourceManagerB、TaskManagerC、JobManagerD、ZooKeeper答案:C140.下列关于topic和partition的描述,错误的是()。A、Kafka中消息是以partition进行分类的B、与partition不同,topic是逻辑上的概念而非物理上的概念C、每个partition对应于一个log文件D、一个partition分为多个segment答案:A141.Flume的哪个版本开始支持Spoolingdirectorysource?()A、Flume1.0B、Flume1.1C、Flume1.2D、Flume1.3答案:C142.Hive中的哪个配置参数用于指定Hive的临时文件目录()?A、hive.tmp.dirB、hive.temp.directoryC、hive.temp.dirD、hive.tmp.directory答案:A143.Flink的时间语义(TimeSemantics)中的事件时间(EventTime)和处理时间(ProcessingTime)的区别是()。A、事件时间是事件发生的时间,处理时间是事件进入Flink的时间B、事件时间是事件进入Flink的时间,处理时间是事件发生的时间C、事件时间和处理时间是相同的D、事件时间和处理时间没有明确的定义答案:A144.下面哪个命令行参数可以用来删除Kafka中的Topic?()A、listB、createC、deleteD、escribe答案:C145.测试Sqoop是否能够正常连接MySQL数据库命令是()。A、sqooplist-database--connectjdbc:mysql://:3306/--usernameroot–PB、sqooplist-databases--connectionjdbc:mysql://:3306/--usernameroot–PC、sqooplist-databases--connectjdbc:mysql://:3306/--usernameroot–LD、sqooplist-databases--connectjdbc:mysql://:3306/--usernameroot–P答案:D146.在HDFS分布式文件系统中,一般采用冗余存储,冗余因子通常设置为()。A、1.0B、2.0C、3.0D、4.0答案:C147.Kafka的消费者在处理消息时可以选择的模式是()。A、单线程模式B、多线程模式C、分布式模式D、并行模式答案:B148.Kafka服务器默认能接收的最大消息是多大?()♂A、1MB、10MC、100MD、没有大小限制,因为支持大数据答案:A149.在Docker数据管理中,数据卷可以提供的特性不包括()。A、数据卷可以在容器之间共享和重用B、对数据卷内数据的修改立马生效C、对数据卷的更新不影响镜像D、挂载数据卷时要手工创建挂载目录答案:D150.Flink中的转换算子(TransformationOperator)通常用于()。A、计算作业的结果B、控制作业的执行顺序C、定义数据源D、过滤和转换数据流答案:D151.在ZooKeeper中,节点的数据版本是如何维护的?()A、自动递增B、手动指定C、根据节点的创建时间确定D、随机生成答案:A152.在ZooKeeper中,每个节点都有一个唯一的标识符,这个标识符是()。A、ZNodeB、EphemeralNodeC、PersistentNodeD、ZooNode答案:A153.在hadoop配置中core-site.xml的配置是()参数。A、集群全局参数B、HDFS参数C、Mapreduce参数D、集群资源管理系统参数答案:A154.以下关于RDD的宽依赖和窄依赖的说法错误的是()。A、窄依赖表现为子RDD的一个分区只依赖于某个(些)父RDD的一个分区B、宽依赖则表现为子RDD的一个分区依赖于同一个父RDD的多个分区C、宽依赖的RDD之间无Shuffle操作D、窄依赖的RDD之间无Shuffle操作答案:C155.关于DataFrame的优势,以下描述错误的是()。A、DataFrame提升了Spark框架的执行效率B、DataFrame减少了数据读取时间C、DataFrame可以优化执行计划D、ataFrame可以完全替换RDD答案:D156.Hive默认的元存储是保存在内嵌的()数据库中。A、MySQLB、DerbyC、OracleD、SqlServer答案:B157.Flume的哪个版本开始支持HTTP和HTTPS协议?()A、Flume1.0B、Flume1.1C、Flume1.2D、Flume1.3答案:D158.Flume的Sink组件负责什么?()A、将数据从Channel中读取并写入目标位置B、将数据从Channel中读取并发送到下一组件C、从Channel中读取数据并将其写入接收器D、从Channel中读取数据并将其写入目标位置。答案:D159.Flume的哪个版本加入了对Avro事件的的支持?()A、Flume1.0B、Flume1.1C、Flume1.2D、Flume1.3答案:C160.Flink的安装配置中,通过()来指定外部依赖库的路径。A、在Flink集群中心目录中添加依赖库B、在Flink作业中指定依赖库路径C、在Flink配置文件中设置lib.paths属性D、在Flink的CLASSPATH环境变量中添加路径答案:C161.以下关于Spark与Hadoop对比,说法错误的是()。A、Spark的计算模式也属于MapReduce,但不局限于Map和Reduce操作,还提供了多种数据集操作类型,编程模型比HadoopMapReduce更灵活B、Spark提供了内存计算,可将中间结果放到内存中,对于迭代运算效率更高C、Spark磁盘IO开销较大,任务之间的衔接涉及IO开销D、Spark基于DAG的任务调度执行机制,要优于HadoopMapReduce的迭代执行机制答案:C162.下列选项中,()不属于转换算子操作。A、filter(func)B、map(func)C、reduce(func)D、reduceByKey(func)答案:C163.MySQL数据库驱动文件放置于hive哪个目录下()。A、jarB、libC、binD、sbin答案:B164.在Hive中,以下哪个配置参数用于指定Hive元数据存储的数据库类型()?A、hive.metastore.urisB、hive.metastore.schemaC、hive.metastore.db.typeD、hive.metastore.db.url答案:C165.Hive中的哪个配置参数用于指定Hive表的默认分隔符()?A、hive.default.delimiterB、hive.default.separatorC、hive.default.field.delim答案:C166.Flink的高可用性(HighAvailability)设置通常需要配置的组件是()。A、JobManager和TaskManagerB、ResourceManager和NodeManagerC、NameNode和DataNodeD、ZooKeeper集群答案:D167.关于Hive内外表描述正确的是()。A、内部表数据由HDFS自身管理,外部表数据由Hive管理;B、内部表数据存储的位置是hive.metastore.warehouse.dir设置配置(默认:/user/hive/warehouse)C、外表存储必须指定LOCATIOND、内外表删除时,都会删除元数据和存储答案:B168.在ZooKeeper中,()角色负责协调其他节点的工作。A、领导者(Leader)B、跟随者(Follower)C、观察者(Observer)D、所有角色均可答案:A169.下列语句中,描述错误的是()。A、可以通过CLI方式、JavaApi方式调用SqoopB、Sqoop底层会将Sqoop命令转换为MapReduce任务,并通过Sqoop连接器进行数据的导入导出操作C、Sqoop是独立的数据迁移工具,可以在任何系统上执行D、如果在Hadoop分布式集群环境下,连接MySQL服务器参数不能是“localhost”或“”答案:C170.关于Hive数据模型描述正确的是()。A、Hive的元数据存储在HDFS中B、Hive的数据模型只包含:表、分区答案:B171.在linux系统中,提交hadoop程序的命令是()。A、hadoopjarB、hadoop-submitC、hadoop-jarD、hadoopfs答案:A172.在Flink中,水位线是()生成的。A、基于系统时间的周期性B、基于事件时间的周期性C、由用户手动指定D、实时答案:A173.Docker容器是在()层面上实现虚拟化。A、硬件层面B、操作系统层面C、应用程序层面答案:B174.Flink中的Watermark是用来(),帮助Flink正确地处理迟到的事件。A、测量数据流的速度B、表示数据流的起点C、处理乱序事件D、控制数据流的大小答案:C175.SparkSQL中,model函数可以接收的参数有哪些()。A、Override、IgnoreB、Override、Ignore、AppendC、Ignore、Append、ErrorIfExistsD、Override、Ignore、Append、ErrorIfExists答案:D176.与传统消息系统相比,Kafka的突出特点不包括()。A、能够持久化日志B、容错能力强,是一个分布式系统C、支持实时的流式处理D、提供在线消息同步和离线消息缓存的能力答案:D多选题1.Flink支持的Source包括()。A、自定义数据读取B、从集合中读取数据C、从文件中读取数据D、从消息列队中读取数据答案:ABCD2.下面哪个配置属性用于指定Hive查询的最大并行度()。A、hive.query.parallelismB、hive.exec.parallelC、hive.query.max.parallelD、hive.parallel.query.max答案:ACD3.Flink支持的时间操作类型包括()。A、结束时间B、处理时间C、采集时间D、事件时间答案:BD4.下面关于Flink的说法正确的是()。A、Flink起源于Stratosphere项目,该项目是在2010年到2014年间由柏林工业大学、柏林洪堡大学和哈索普拉特纳研究所联合开展的B、Flink可以同时支持实时计算和批量计算C、Flink不是Apache软件基金会的项目D、Flink是Apache软件基金会的5个最大的大数据项目之一答案:ABD5.Hive中的数据存储如何分区()。A、HDFSB、HBaseC、MySQL或DerbyD、Redis答案:CD6.创建镜像的主要方法有()。A、基于本地文件导入B、基于本地模板导入C、基于已有镜像的容器创建D、基于Dockerfile创建答案:BCD7.关于ZooKeeper顺序节点的说法不正确的是()。A、创建顺序节点的命令为:create/testvalue1B、创建顺序节点时不能连续执行创建命令,否者报错节点已存在C、通过顺序节点,可以创建分布式系统唯一IDD、顺序节点的序号能无限增加答案:ABD8.Flink是实时计算的代表技术之一,以下针对Flink表述正确的有()。A、Flink是构建在数据流之上的一款有状态计算框架B、Flink可对有限数据流和无限数据流进行有状态或无状态的计算C、Flink无法对大规模的数据进行快速计算D、Flink能够部署在各种集群环境答案:ABD9.Kafka的消息传递保证可以是()。A、最多一次B、至少一次C、正好一次D、恰好两次答案:AB10.Dockerfile配置文件中的指令包括()。A、ENABLEB、VOLUMEC、SHELLD、ADDE、ARG答案:BCDE11.关于spark容错说法错误的有()。A、在容错机制中,如果一个节点死机了,而且运算窄依赖,则只要把丢失的父RDD分区重算即可,依赖于其他节点B、宽依赖开销更大C、heckpoint可以节约大量的系统资源D、RDD的容错机制是基于SparkStreaming的容错机制答案:AD12.如果要在Hive中启用列级别的权限控制,哪个配置属性应该设置为true()。A、hive.column.level.securityB、hive.security.column.authorization.enabledC、hive.enable.column.level.securityD、hive.column.authorization.enabled答案:BCD13.Flink有哪些状态存储方式()。A、RocksDBStateBackendB、MemoryStateBackendC、KafkaD、FsStateBackend答案:ABD14.在Hive中,以下哪个配置属性用于启用动态分区()。A、hive.exec.dynamic.partitionB、hive.optimize.dynamic.partitionC、hive.dynamic.partition.modeD、hive.partition.dynamic.enabled答案:ACD15.要在Hive中启用LLAP(LowLatencyAnalyticalProcessing),哪个配置属性应该设置为true()。A、hive.llap.enabledB、hive.enable.llapC、hive.execution.llap.enabledD、hive.llap.execution.enabled答案:ABD16.Docker允许映射容器内应用的服务端口到本地宿主主机,主要方式有()。A、映射所有接口地址B、映射到指定地址的指定端口C、映射到指定地址的任意端口D、映射到任意地址的指定端口答案:ABC17.Kafka的特性()。A、高吞吐量、低延迟B、可扩展性、持久性、可靠性C、容错性D、高并发答案:ABCD18.Kafka相对传统技术有什么优势说法正确的是♂()。A、快速:单一的Kafka代理可以处理成千上万的客户端,每秒处理数兆字节的读写操作。B、可伸缩:在一组机器上对数据进行分区和简化,以支持更大的数据C、持久:消息是持久性的,并在集群中进行复制,以防止数据丢失D、设计:它提供了容错保证和持久性答案:ABCD19.Flink的时间窗口有()。A、滚动窗口B、滑动窗口C、定时窗口D、会话窗口答案:ABD20.Flink程序由以下()组成。A、DataSink数据输出B、DataNode数据节点C、Transformation算子D、ataSource数据源答案:ACD21.Flume可以应用于哪些数据传输场景?()A、数据中心之间传输数据B、跨网络传输数据C、日志数据传输D、数据库备份和还原答案:ABCD22.hadoopHA启动后,以下哪些进程运行在master()?A、QuorumPeerMainB、SecondaryNameNodeC、NamenodeD、ResourceManager答案:ABCD23.关于Docker容器的run命令,下列参数匹配正确的有()。A、d:在后台运行容器B、i:已交互模式运行容器C、p:随机端口映射D、h:指定容器的hostname答案:ABD24.Flume的Channel类型有哪些?()A、MemoryChannelB、FileChannelC、ForwardChannelD、ReplicatorChannel答案:ABD25.Flume的Spoolingdirectorysource有何特点?()A、可处理大文件B、可处理多个文件C、可自动滚动文件D、可自动清理旧文件答案:ABCD26.Sparkdriver的功能是()。A、作业的主进程B、负责了作业的调度C、负责向HDFS申请资源D、负责作业的解析答案:ABD27.要在Hive中配置HDFS的NameNodeURI,应该设置哪个属性()。A、node.uriB、node.uriC、D、node.uri答案:ABC28.与hadoop相比,Spark主要有()优点。A、提供多种数据集操作类型而不仅限于MapReduceB、数据集中式计算而更加高效C、提供了内存计算,带来了更高的迭代运算效率D、基于DAG的任务调度执行机制+C:F答案:ABCD29.Flink的兼容性体现在()。A、YARN能够作为Flink集群的资源调度管理器B、能够与Hadoop原有的Mappers和Reduces混合使用C、能够使用Hadoop的格式化输入和输出D、能够从本地获取数据答案:ABCD30.SparkStreaming的基本输入源有()。A、文件流B、kafkaC、套接字流D、RDD队列流答案:ACD31.下列有关ZooKeeper中的节点路径说法正确的是()。A、节点路径可以是临时节点B、节点路径可以是持久节点C、临时节点会话结束后自动删除D、临时节点不会自动删除答案:ABC32.关于dockerbuild命令支持的选项,下列匹配正确的有()。A、network:指定run命令时网络模式B、f:dockerfile名称C、add-host:添加自定义的主机名到IP的映射D、label:配置镜像的标签答案:ABC33.以下哪些组件属于Hadoop生态圈()。A、MySQLB、HiveC、HDFSD、Sqoop答案:BCD34.HadoopHDFS自身的局限性包括()。A、不适合做低延迟、细粒度访问B、无法高效存储大量的小文件C、不支持多文件的写入及任意修改文件D、无法实现数据的冗余备份存储答案:ABC35.ZooKeeper中的Watcher机制是通过以下()方式实现。A、回调函数B、轮询机制C、线程池D、事件驱动答案:AD36.ZooKeeper中的节点类型包括()。A、持久节点B、临时节点C、有序节点D、临时有序节点答案:ABCD37.Hive中的数据存储是如何分区的()。A、基于文件大小B、基于日期C、基于列名D、基于文件格式答案:BCD38.关于partition中的数据是如何保持到硬盘上的,说法正确的是()。A、一个topic分为好几个partition,每一个partition是以文件夹的形式保持在broker节点上面的B、每一个分区的命名是从序号0开始递增C、每一个partition目录下多个segment文件(包含xx.index,xx.log),默认是1GD、每个分区里面的消息是有序的,数据是一样的答案:ABC39.kafka容错性说话正确的是()。A、允许集群中节点失败(若副本数量为n,则允许n-1个节点失败)B、杀死集群中的主节点还是可以使用C、杀死集群中所有的副节点还是可以使用D、无论结束的是主还是副broker,都不会影响kafka使用,只要还有一个副本答案:ABCD40.使用dockerps命令可以查看到的信息有()。A、容器IDB、镜像名称C、容器的端口D、生存时间E、环境变量答案:ABCD41.Flume的拦截器可以完成哪些操作?()A、数据过滤B、数据转换C、数据加密D、数据压缩答案:ABC42.Sqoop目前支持两种增量导入模式,分别是()和()模式。A、lastmodifiedB、appendC、--tableD、-target-dir答案:AB43.Kafka的消息传递可以保证消息的可靠性传递通过()。A、复制机制B、冗余机制C、重试机制D、容错机制答案:AC44.要读取people.json文件生成DataFrame,可以使用下列()命令。A、spark.read.json("people.json")B、spark.read.text("people.json")C、spark.read.format("json").load("people.json")D、spark.read.format("csv").load("people.json")答案:AC45.下列关于镜像操作命令匹配正确的有()。A、获取镜像:dockerpushB、查看镜像:dockerimageC、创建镜像:dockercreateD、上传镜像:dockeruploadE、查找镜像:dockersearch答案:BE46.Flink流式处理的数据源类型包括()。A、CollectionsB、JDBCC、SocketStreamsD、Files答案:ABCD47.Hive的查询优化是通过什么实现的()。A、TezB、MapReduceC、SparkD、Flink答案:ABC48.Flink常见的应用场景包括()。A、数据流水线应用B、事件驱动型应用C、地图应用D、数据分析应用答案:ABD49.Docker在开发和运维过程中具有的优势有()。A、更快速的交付和部署B、更高效的资源利用C、更轻松的迁移扩展D、更简单的更新管理答案:ABCD50.Hive中的分区是如何定义的()。A、在表的创建时定义B、在查询时动态定义C、在元数据存储中定义D、在表的插入操作中定义答案:ABC51.关于ZooKeeper的特性说法正确的是()。A、能改变ZooKeeper服务器状态的操作称为事务操作B、是版本机制有效避免了数据更新时出现的先后顺序问题C、当节点发生变化时,通过watcher机制,可以让客户端得到通知D、watch能触发多次答案:ABC52.Flink的Sink有哪些类型()。A、RedisSinkB、KafkaSinkC、ElasticSearchSinkD、HiveSink答案:AB53.Stage的Task的数量不是由()决定。A、PartitionB、JobC、StageD、TaskScheduler答案:BCD54.Hive的数据存储是如何组织的()。A、表B、分区C、桶(Bucket)D、列族(ColumnFamily)答案:ABC55.SparkContext可以从()读取数据。A、本地磁盘B、webC、hdfsD、内存答案:ACD56.Hadoop的运行模式分为以下()种。A、单机模式B、伪分布模式C、全分布模式D、主备模式答案:ABC57.Sqoop中的--hive-drop-import-delims参数有什么作用?()A、在将数据从MySQL导入到Hive时,删除MySQL中存在的所有分隔符B、在将数据从MySQL导入到Hive时,删除MySQL中存在的所有换行符C、在将数据从MySQL导入到Hive时,删除Hive中存在的所有分隔符D、在将数据从MySQL导入到Hive时,删除Hive中存在的所有换行符答案:AC58.当使用Sqoop将数据从MySQL导入到HDFS时,以下()参数可以使用?A、--connectB、--usernameC、--passwordD、--table答案:ABCD59.当使用Sqoop进行数据导出时,以下哪些()选项是正确的?A、Sqoop可以使用多个mapper同时进行数据导出B、Sqoop导出的数据可以按照指定的列进行排序C、Sqoop导出的数据可以插入到已存在的HDFS目录中D、Sqoop导出的数据可以删除已存在的HDFS目录答案:ABC60.Flume的核心组件有哪些?()A、SourceB、ChannelC、SinkD、Receiver答案:ABC61.nginx可以提供的功能有()。A、作为HTTP服务器B、作为负载均衡服务器C、作为邮件代理服务器D、作为反向代理服务器答案:ABCD62.Hadoop核心主要由()部分组成。A、HDFSB、DFSC、MapReduceD、RDD答案:AC63.MLlib包括()。A、分类模型B、聚类模型C、特征抽取D、统计模型答案:ABCD64.管理自定义的网桥网络的操作命令有()。A、dockernetworkcreateB、dockernetworkconnectC、dockernetworkdisconnectD、ockernetworkrm答案:ABCD65.Docker数据卷的操作有()。A、dockervolumecreateB、dockervolumeinspectC、dockervolumermD、ockervolumesave答案:ABC66.Flink支持的部署模式有()。A、Standalone模式B、Local模式C、YARN集群模式D、HDFS模式答案:ABC67.关于HadoopHDFS的文件操作,正确的是()。A、HDFS可以创建文件并写入数据B、HDFS可以查看文件内容C、HDFS可以创建目录D、HDFS可以更改文件内容答案:ABC68.下列选项()是ZooKeeper的应用场景。A、Master选举B、分布式锁C、分布式协调/通知D、存储非关系型数据答案:ABC69.从RDD转换得到DataFrame包含两种典型的方法,分别是()。A、利用反射机制推断RDD模式B、使用编程方式定义RDD模式C、利用投影机制推断RDD模式D、利用互联网机制推断RDD模式答案:AB70.Flink的主要特性包括()。A、精确一次的状态一致性保障B、批流一体化C、精密的状态管理D、事件时间支持答案:ABCD71.zookeeper在kafka中的作用()。A、kafka将元数据信息维护在zookeeper上B、kafka的producer、consumer、topic、partition都需要依赖zookeeperC、kafka使用zookeeper来实现动态的集群扩展D、发送到topic的数据需要经过zookeeper答案:AC72.利用数据卷容器可以对其中的数据卷进行()操作。A、备份B、恢复C、压缩D、迁移答案:ABCD73.在Hive中,以下哪个配置属性用于指定HDFS存储位置的根目录()。A、hive.data.root.dirB、hive.hdfs.root.dirC、hive.storage.root.dirD、hive.fs.root.dir答案:ABC74.Docker的网络类型有()。A、bridgeB、overlayC、hostD、macvlanE、none答案:ABCDE75.ZooKeeper中的事务操作可以保证()特性。A、原子性B、一致性C、隔离性D、持久性答案:ABD76.Hive的分区和桶的主要区别是什么()。A、分区是物理存储层面的,而桶是逻辑存储层面的B、分区是逻辑存储层面的,而桶是物理存储层面的C、分区是由HiveMetastore管理的,而桶是用户自定义的D、分区和桶在Hive中没有区别答案:AC77.ZooKeeper中的数据节点可以存储的数据类型包括()。A、字符串B、整数C、浮点数D、二进制数据答案:ABCD78.Flume可以用于哪些方面的数据处理?()A、数据集中B、数据过滤C、数据聚合D、数据分布式处理答案:ABCD79.Flume的拦截器支持哪些操作?()A、数据过滤B、数据转换C、数据压缩D、数据加密E、数据脱敏答案:ABCD80.要配置Hive的元数据存储连接字符串,应该设置哪个属性()。A、hive.metastore.uriB、hive.metastore.connectionC、hive.metastore.jdbc.urlD、hive.metastore.connection.url答案:ACD81.Kafka负载均衡原理说法正确的是()。A、♂producer根据用户指定的算法,将消息发送到指定的partitionB、存在多个partiiton,每个partition有自己的replica,每个replica分布在不同的Broker节点上C、多个partition需要选取出leadpartition,leadpartition负责读写,并由zookeeper负责failoverD、通过zookeeper管理broker与consumer的动态加入与离开答案:ABCD82.要启用Hive的Tez执行引擎,应该配置哪个属性()。A、hive.execution.engineB、hive.exec.engineC、hive.tez.enableD、hive.use.tez答案:ABD83.ZooKeeper中的ACL(AccessControlList)用于()。A、控制节点的访问权限B、控制节点的读写权限C、控制节点的删除权限D、控制节点的创建权限答案:ABCD84.要启用Hive的压缩功能,应该配置哪个属性()。A、press.enableB、pressC、pression.codecD、pression答案:ACD85.下面是使用Sqoop将数据从Hive导入到MySQL的具体步骤()。A、创建Hive表B、插入数据C、使用Sqoop导出数据D、在MySQL中查看数据答案:ABCD86.Flume的HTTPSource和Sink组件支持哪些协议?()A、HTTPB、HTTPSC、AvroD、Thrift答案:ABD87.Flink组件中流类型包括()。A、有界流B、无界流C、字符流D、文件流答案:AB88.Hive中的数据类型包括哪些()。A、整数类型B、字符串类型C、时间类型D、自定义数据类型答案:ABCD89.Spark要想很好的支持SQL,需要完成三大过程。这三大过程包括()。A、加载loadB、解析parserC、优化optimizerD、执行execution答案:BCD90.Flume的HTTPSource和Sink组件支持哪些HTTP方法?()A、GETB、POSTC、PUTD、ELETE答案:BCD91.Docker的核心概念包括()。A、镜像B、主机C、容器D、仓库E、引擎答案:ACD92.RDD的操作主要是()操作。A、转换算子操作B、分组操作C、读写操作D、行动算子操作答案:AD93.Flink的特点包括()。A、流处理引擎B、可扩展性C、高吞吐量、低延迟D、容错、可靠性答案:ABCD94.如果要在Hive中启用动态分区插入,哪个配置属性应该设置为true()。A、hive.dynamic.partition.insert.enableB、hive.partition.insert.dynamicC、hive.enable.dynamic.partition.insertD、hive.dynamic.insert.enable答案:ACD95.()是流计算的处理流程。A、实时数据存储B、实时数据计算C、实时查询服务D、实时数据采集答案:BCD96.RDD有()缺陷。A、不支持细粒度的写和更新操作(如网络爬虫)B、基于内存的计算C、拥有schema信息D、不支持增量迭代计算答案:AD97.Kafka的消息传递可以使用的序列化器包括()。A、JSONB、AvroC、ProtobufD、XML答案:ABC98.ZooKeeper中的SEQUENTIAL节点的特点是()。A、有序节点B、无序节点C、节点名称自动递增D、节点名称不自动递增答案:AC99.Sqoop中哪些参数可以用于指定要导入/导出的表?()A、--tableB、--columnC、--whereD、--order答案:AC100.Sqoop是一个用于在Hadoop和结构化数据存储(如关系型数据库)之间传输数据的工具。以下哪些()是Sqoop的主要参数?A、--connectB、--usernameC、--tableD、-target-dir答案:ABCD101.后端容器化环境部署中使用的数据库一般有()。A、ccessB、kafkaC、RedisD、MySQLE、MongoDB答案:CDE102.关于spark中数据倾斜引发原因正确的选项有()。A、key本身分布不均衡B、计算方式有误C、过多的数据在一个task里面D、shuffle并行度不够答案:ABCD103.下列属于RDD的行动算子的是()。A、count()B、first()C、take()D、filter()答案:ABC104.Linux的特点是以下()方面。A、开放源代码的程序软件,可自由修改。B、与Unix系统不兼容,具备几乎所有Unix的优秀特性。C、可自由传播,免费使用,无任何商业化版权制约。D、适合Intel等x90CPU系列架构的计算机。答案:ACD105.Master的ElectedLeader事件后不做()操作。A、通知driverB、通知workerC、注册applicationD、直接ALIVE答案:ABC106.在Hive中,以下哪个配置属性用于指定Hive表的默认文件格式()。A、hive.default.input.formatB、hive.table.default.file.formatC、hive.default.file.input.formatD、hive.input.format.default答案:ABC107.Hadoop的优点有哪些()?A、扩容能力强B、成本低C、速度快D、占用资源少答案:AB108.Flink的缓存机制包含以下哪些内容(

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论