100K影像课堂测验_第1页
100K影像课堂测验_第2页
100K影像课堂测验_第3页
100K影像课堂测验_第4页
100K影像课堂测验_第5页
已阅读5页,还剩13页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

、选择题1、物联网的发展使得数据生成方式得以彻底的改变,其属于()。A被动式生成数据B主动式生成数据C感知式生成数据D半主动式生成数据2、从数据库技术诞生以来,产生大数据的方式主要经过了三个发展阶段,分别是()、主动式生成数据、感知式生成数据。A被动式生成数据B网络式生成数据C传感器生成数据D半主动式生成数据3、大数据的数据类型包括结构化数据、非结构化数据和()A半结构化数据B无结构数据C关系数据库数据D网页4、大数据的数据类型包括结构化数据、()和半结构化数据A非结构化数据B无结构数据C关系数据库数据D网页5、大数据的数据类型包括()、非结构化数据和半结构化数据A结构化数据B无结构数据C关系数据库数据D网页6、 常见的网络信息系统包括电子商务系统和()A社交网络B社会媒体C搜索引擎D以上三个选项都是7、下列与大数据密切相关的技术是()A蓝牙B云计算C博弈论Dwifi8、大数据应用依托的新技术是()A大规模存储与计算B数据分析C智能化D以上三个选项都是9、下列不属于数据抽取和集成引擎的是()。A基于物化或ETL方法的引擎B基于中间件的引擎C基于空间数据的引擎D基于数据流方法的引擎10、 大数据呈现出“4V1O”的特征,下列描述正确的是()AVolume、Variety、vacation、Velocity、On-LineBVolume、Variety、Value、Velocity、On-LineCVolume、Variety、Value、vehicle>On-LineDVolume、violence>Value、vehicle>On-Line11、 大数据“4V1O”的特征中,表示大数据种类和来源多样化的是()AVolumeBVarietyCValueDVelocity12、 大数据“4V1O”的特征中,表示大数据价值密度相对较低,需要很多的过程才能挖掘出来的是()AVolumeBVarietyCValueDVelocity13、 大数据“4V1O”的特征中,表示时效性要求高的是()AVolumeBVarietyCValueDVelocity14、 大数据“4V1O”的特征中,表示数据量大的是()AVolumeBVarietyCValueDVelocityD基本研究与人类资源15、 美国信息高速公路计划HPCC(高性能计算与通信)中包含的BRHR是指()A高性能计算机系统B国家科研与教育网格C先进软件技术与算法D基本研究与人类资源16、 大数据分析的典型工具中,属于实时计算系统的是()AHPCCBRapidMinerCApacheDrillDStorm17、 大数据分析的典型工具中,属于数据挖掘解决方案的是()AHPCCBRapidMinerCApacheDrillDStorm18、 大数据管理平台所必须考虑的要素是()A自动化和分布式B智能化和开放式C并行化和分布式D并行化和开放式19、 大数据采集一般分为()和基础支撑层A基础架构层B智能感知层C数据处理层D数据挖掘层20、 Hadoop是一个能够对大量数据进行()处理的软件框架A分布式B一体化C集成化D综合化21、 Hadoop是一个能够对大量数据进行分布式处理的()框架A系统B传感C硬件D软件22、 EDC系统在临床试验中的应用可以有效解决纸质CRF存在的问题,EDC是一种数据()系统。A归档B采集C分析D聚类23、 大数据的三大主要来源为()数据。A商业、互联网与传感器B商业、科研文献与视频C文字、图片与视频D商业、互联网与多媒体24、 ETL:即数据()的过程,是构建数据仓库的重要环节。A擦写、转换、列表B抽取、转换、列表C擦写、转换、装载D抽取、转换、装载25、 以安全为目标的HTTP通道英文缩写是()AHTTPSBODMCERPDRFID26、 网络数据采集的四个主要模块是:网络爬虫、数据处理、()和数据。AHTML队列BURL队列CAPP队列DWEB队列27、 网络数据处理的四个主要模块是:()和数据A网络爬虫、分词、排重B分词、排重、整合C分词、排重、处理D网络爬虫、排重、处理28、 大数据建模是为了理解事物而对事物做出的一种(),是对事物的一种无歧义的书面描述。A模型B整合C处理D抽象29、 CURE是一种针对大型数据库的高效的()算法A回归B关系C神经网络D聚类30、 数据挖掘中的建模是由()驱动的A事实B机制C数据D关系31、 以下关于数据模型的描述正确的是()A再大的随机抽样都不如局部抽样有代表性B统计学随机抽样不具有代表性C“大样本=总体”的思想是错误的D“大样本=总体”的思想是正确的32、 大数据建模的核心问题是海量数据()问题A随机抽样B大样本调查C挖掘D随机对照试验33、 Web挖掘任务可以被划分为三种主要类型:()挖掘A结构、内容和使用B结构、网页和后台数据库C网页、后台数据库和使用D网页、内容和使用34、 Web数据挖掘是一项综合性技术,指Web从文档结构和使用的集合C中发现隐含的模式P,如果将C看作是输入,P看作是输出,那么Web挖掘过程就可以看作是从输入到输出的一个()过程。A发现B映射C输入D输出35、 Hadoop是一个基于()的分布式密集数据处理和数据分析的软件框架AJavaBC++CC#DVFP36、 大数据分析模式根据实时性可分为()两类A在线和离线B内存和海量C算法和模型D离线和海量37、 以下关于大数据建模应遵循的规律中,正确的是()A数据挖掘减弱了对业务的认知B预测提高了信息作用能力C模式不因业务变化而变化D试验对寻找解决方案不是必要的38、 以下关于大数据建模应遵循的规律中,错误的是()A以业务目标作为实现目标B数据中总含有模式C大数据建模的价值在于预测的准确率D预测提高了信息作用能力A联机分析处理B机器学习C模式识别D分布式计算39、 数据可视化是关于数据()表现形式的科学技术研究A听觉B嗅觉C感觉D视觉40、 数据可视化技术是指运用计算机()和图像处理技术A语言B图形学C程序D代码41、 下列不属于数据可视化技术特点的是()A交互性B分析性C可视性D多维性42、 数据可视化流程中,操作控制所对应的流程是()A获取

43、44454647、48495051、B分析C过滤D交互数据可视化流程中,清晰易读所对应的流程是()A表述B交互C过滤D修饰数据可视化流程中,视觉模型所对应的流程是()A表述B分析C过滤D挖掘数据可视化流程中,统计辨析所对应的流程是()A获取B分析C过滤D挖掘数据可视化技术的数据分析是指对()数据进行切片、块、旋转等动作剖析数据A一维B图片C影像D多维时间可视化是指通过时间的维度来查看事物值的变化情况,一般通过增加时间轴的形式,也就是()图A柱形B散点C圆环D趋势()图适用于四维以上的多维数据,且每个维度必须可以排序A雷达B气泡C散点D直方()适用于三维数据集,并且其中有两维数据需要比较A雷达B气泡C散点D直方()适合多个二维数据集的比较A雷达B气泡C折线D散点下列属于数据可视化工具特性的是()

A实时性B更丰富的展现C多种数据集成支持方式D以上都是52、 下列可视化工具中的统计分析工具是()ARBNodeBoxCProcessingDPolyMaps53、 下列可视化工具中的地图工具是()ARBNodeBoxCProcessingDOpenLayers54、 Nodebox是一个建立在()语言基础上的开源图形软件APythonBC#CJavaDSQL55、 OpenGL是一个功能强大,调用方便的()A图标格式B查询开发库C计算机程序设计语言D图形程序接口56、 下列不属于Hadoop架构核心内容的是()AHDFSBMapReduceCCommonDSpark57、 下列内容中,不属于Hadoop优点的是()A可扩展B高成本C高效率D可靠58、 下列内容中,不属于Hadoop优点的是()A可扩展B低成本C低效率D可靠59、 下列关于HDFS的说法正确的是()AHDFS是一个高度容错的系统BHDFS在高成本的通用硬件上运行CHDFS不遵循文件的一致性模型DHDFS不适合带有大型数据集的应用程序60、 下列关于HDFS的说法错误的是()AHDFS是一个高度容错的系统BHDFS在低成本的昂贵硬件上运行CHDFS遵循文件的一致性模型DHDFS适合带有大型数据集的应用程序61、 HDFS系统能检测和应对硬件故障,用于在()硬件上运行A低成本、通用B高成本、通用C低成本、特殊D高成本、特殊62、 HDFS采用()结构模型A通用B主从C并行D串行63、 MapReduce中的Reduce对中间结果中()的所有值进行规约A所有键B相同键C不同键D中间键64、 MapReduce是一种()模型A架构B存储C编程D优化65、 YARN是一个资源管理系统,其基本设计思想是将MapReduce中的()拆分成了两个独立的服务AResourceManagerBApplicationMasterCJobTrackerDApache66、 YARN中的ResourceManager负责()系统的资源管理和分配,ApplicationMaster则负责()应用程序的管理。A整个、整个B单个、单个C整个、单个D单个、整个67、 下列有关Hive与关系型数据库(RDBMS)的对比,说法正确的是()AHive查询实时性强BRDBMS查询实时性差CHive存储文件系统是HDFSDHive与RDBMS都有索引68、 下列关于Hive的说法错误的是()AHive是一个数据仓库工具BHive使用的计算模型是MapReduceCHive有专门的数据存储格式DHive没有为数据建立索引69、 下列关于Hive的说法正确的是()AHive是一个数据仓库工具BHive不提供类SQL查询功能CHive有专门的数据存储格式DHive有为数据建立索引70、 Hive最早是由Facebook设计,基于Hadoop的一个()工具A关系数据库B列数据库C数据仓库D操作系统71、 下列有关HBase的说法错误的是()AHBase是一个适合于存储结构化数据的数据库BHBase是基于列而不是基于行的模式CHBase表示疏松的数据DHBase是一个开源数据库72、 下列有关HBase与Hive的关系说法正确的是()AHBase执行效率不如HiveBHBase与Hive都用Hadoop作为底层存储CHive是物理表DHBase是纯逻辑表73、 HBase是一个分布式、面向()的开源数据库A列B键值C网状D二维表74、 下列属于对大型数据集进行分析和评估的平台是()AHBaseBAvroCChukwaDPig75、 下列用于监控和分析大型分布式系统的平台是()AHBaseBAvroCChukwaDPig76、 Spark是一个()的通用()计算框架A开源、并行分布式B开源、并行集群式C不开源、并行分布式D不开源、并行集群式77、 以下关于Spark的说法错误的是()ASpark不适用需要迭代的MapReduce算法BSpark基于MapReduce算法实现的分布式计算C弹性分布式数据集是Spark中最核心的模块和类DSpark支持两种分布式存储系统:HDFS和AWSS3n78、 下列说法中,不属于Spark优点的是()A重量级快速处理B支持多语言C支持复杂查询D实时的流处理79、 GFS是()A一个可扩展的分布式文件系统B一个开放源码的分布式应用程序协调服务C建立在应用层和传输层基础上的安全协议D一种多范式的编程语言80、 下列关于HDFS异构软硬件平台间的可移植性描述正确的是()AHDFS适用低延迟数据访问BHDFS适用大量的小文件CHDFS适用多用户写入修改文件DHDFS关注数据的吞吐量81、 关于对HDFS的设计目标描述错误的是()AHDFS是一个高度容错性的系统BHDFS能提供较高的数据传输带宽CHDFS上的一个典型文件大小一般都在KB至MBD运行在HDFS上的应用需要流式访问它们的数据集82、 下列关于HDFS架构描述正确的是()ADataNode是HDFS系统中的管理者BNameNode会定期将自己的负载情况通过心跳信息向NameNode汇报CDataNode是HDFS文件系统中保存数据的结点DClient是HDFS文件系统的管理者83、 HDFS的4类源代码包括()A基础包、实体实现包、应用包、WebHDFS相关包B基础包、实体实现包、应用包、数据挖掘包C基础包、虚拟实现包、应用包、数据挖掘包D基础包、虚拟实现包、应用包、WebHDFS相关包84、 Hadoop提供了一个统一的远程过程调用机制来处理通信,该远程过程调用机制称为()。ARPCBClientProtocolCBMPDInterDataNodeProtocol85、 下列关于HDFS和MapReduce的关系说法错误的是()AMapReduce在集群上实现了分布式计算BHDFS在集群上实现了任务处理CHDFS在MapReduce任务处理过程中提供了对文件操作和存储的支持DMapReduce在HDFS的基础上实现任务的分发、跟踪、执行等工作,并收集结果86、 下列关于MapReduce技术特征的说法错误的是()A易于使用B良好的伸缩性C分布式存储D大规模数据处理87、 下列关于MapReduce工作机制的说法错误的是()AMapReduce的实现采用了Master/Slave结构BMapReduce的整个工作机制包含了2个独立的实体CMapReduce将运行作业所需要的资源文件复制到HDFS上DMapReduce在客户端启动一个作业,在作业提交之前,需要对作业进行配置88、 下列关于MapReduce执行流程的说法正确的是()A向MapReduce框架提交一个计算作业时,它会首先将文件分配为多个数据片段BMap的数目通常是由输入数据的多少决定的CReduce的输入就是Map已经排好序的输入DReduce的数目建议是任务处理最小值与系数的乘积89、 Map(映射)和Reduce(化简)是MapReduce的主要思想,Map负责将数据(),Reduce负责对数据进行()A聚集、打散B打散、聚集C化简、打散D化简、聚集90、 下列MapReduce技术特征描述错误的是()A易于使用B良好的伸缩性C大规模数据处理D大规模文件存储91、 关于MapReduce接口的说法错误的是()AMapReduce接口模型位于应用程序层和MapReduce执行器之间BMapReduce接口可以把海量数据的计算人工并发和分布执行CMapReduce工具层可以方便用户编写复杂的MapReduce程序D实现Map和Reduce方法有4个参数,分别为Key、Value、OuputCollector和Reporter92、 Common为Hadoop的其他模块提供了一些常用工具程序包,主要包括系统配置工具()、远程过程调用()、序列化机制和Hadoop抽象文件系统等。AFileSystem、RPCBconfiguration、RPCCFileSystem、configurationDRPC、configuration93、 ()是重复反馈过程的活动,其目的通常是为了逼近所需目标或结果A系统优化B迭代C任务调度D排序算法94、 大数据的一致性策略CAP,即()、Availability和PartitionToleranceAcentimetreBConsistencyCconcentrationDconnection95、 下列不属于数据分区算法的是()A范围分区B列表分区C动态分区D哈希分区96、 下列不属于NoSQL数据库种类的是()A键值存储B列存储C关系存储D图形存储97、 为解决海量数据的放置问题,涌现了很多数据放置的算法,其中随机放置策略通常是基于某一()函数来实现对数据的放置的,A范围B列表C动态D哈希98、 以下关于大数据分布式缓存技术说法正确的是()A分布式缓存将普通U盘作为数据对象的存储介质B分布式缓存通过手工分配增加或减少结点应对变化的数据访问负载C分布式缓存基于冗余机制实现高可用性,但不支持故障的自动发现D分布式缓存提供单一的数据与管理视图99、 Bigtable属于哪一种类型NoSQL的典型产品A键值存储B列存储C文档存储D图形存储100、 列存储是按列对数据进行存储的,在()效率上有很大的提升A统计B数据分析C存储D查询101、 以下关于面向文档存储的描述正确的是()A面向文档的数据库中存在表、行、列或关系B面向文档数据库是由一系列非自包含的文档组成的C面向文档数据库中,文档被看作是数据处理的基本单位。D面向文档数据库中,数据段被看作是数据处理的基本单位。102、 下列面向文档存储数据库与传统关系数据库区别描述正确的是()A文档数据库不支持数据的共享B面向文档数据库不支持连接C文档数据库可以完全替代关系数据库D博客适合使用关系数据库103、 下列关于Bigtable描述正确的是()ABigtable是一个分布式非结构化数据存储系统BBigtable运用按列存储数据的方法CBigtable是一个开源的系统DBigtable支持完整的关系数据模型104、 以下不属于Bigtable数据库特点的是()A适合大规模海量数据,PB级数据B适用于廉价设备。C适合于读操作,不适合写操作。D适用于传统关系型数据库。105、 以下关于CouchDB数据管理系统的说法正确的是()ACouchDB是一个非开源的面向文档的数据管理系统BCouchDB提供了高可用性和高可靠性CCouchDB不可以安装在Linux和MacOSX操作系统上DCouchDB是一个传统的关系数据库106、 以下关于CouchDB特点描述错误的是()ACouchDB是分布式的数据库BCouchDB是面向文档的数据库CCouchDB支持RESTfulAPIDCouchDB存储结构化的数据107、 以下关于CouchDB的工作原理说法正确的是()ACouchDB构建在强大的B-树引擎上BCouchDB的数据结构具有固定模式CCouchDB的文档更新模型是有锁的DCouchDB与传统的SQL相同108、 下列关于Neo4j的描述正确的是()ANeo4j是一个高性能的NoSQL键值存储数据库BNeo4j将结构化数据存储在表中CNeo4j可以被看作是一个高性能的图引擎DNeo4j不具备大规模可扩展性109、 ()是一个经加密后形成的凭证文档,包括文件的摘要Digest、收到文件的日期和时间及数字签名三部分组成。A时间戳B原子性C并发锁DB-树110、 ()把任意长度的输入通过散列算法,变换成固定长度的输出A分区键BB-树C哈希函数D并发锁111、 ()是一套具有可扩充能力的机器学习类库APigBFlumeCZookeeperDMahout112、 ()是一个基于Hadoop并运用MapReduce和HDFS实现大规模数据分析的平台APigBFlumeCZookeeperDMahout113、 ()是一个高可用、高可靠性、分布式的海量日志采集、聚合和传输的系统APigBFlumeCZookeeperDMahout114、 SearchAPI是()A应用编程接口B搜索接口C商业智能D实时应用集群115、 ()数据杂乱无章,同一主题的数据既可来自于同一网站众多不同的网络用户,也可来自不同的网站A区域卫生信息平台B自我量化C医院医疗大数据D网络大数据116、 传统意义上的数据分析主要针对()数据展开,且已经形成了一整套行之有效的分析体系A半结构化B关系C结构化D非结构化117、 人为因素可能导致据

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论