版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
PAGEPAGE12023年能源大数据应用开发技能竞赛理论考试题库大全-中(多选题汇总)多选题1.Dataworks中,调度系统提供了一些常用的时间参数,周期性调度任务使用这些参数后,在调度运行时参数会自动赋值为具体的时间,以下()参数是调度系统内置时间参数。A、{yyyymmdd}B、{date}C、{yyyy-mm-dd}D、{bdp.system.cyctime}E、nan答案:BD2.涉及个人信息处理的部门和单位,在制定相关制度时应明确个人信息处理规则,建立()的告知同意机制,并采取必要的技术措施确保收集的个人信息安全。A、规范化B、体系化C、多层次D、全方位E、nan答案:BC3.下列关于深度学习说法正确的是A、LSTM在一定程度上解决了传统RNN梯度消失或梯度爆炸的问题B、CNN相比于全连接的优势之一是模型复杂度低,缓解过拟合C、只要参数设置合理,深度学习的效果至少应优于随机算法D、随机梯度下降法可以缓解网络训练过程中陷入鞍点的问题E、nan答案:ABD4.鉴别了多元共线特征。那么下一步可能的操作是什么()A、移除两个共线变量B、不移除两个变量,而是移除一个C、移除相关变量可能会导致信息损失,可以使用带罚项的回归模型(如D、nanE、nan答案:BC5.在典型的卷积神经网络架构中,能看到的是?A、多个卷积层后面跟着的是一个池化层B、多个池化层后面跟着的是一个卷积层C、全连接层(FD、位于最后的几层E、全连接层(FF、位于开始的几层G、nan答案:AC6.在假设检验中,当原假设为“伪”,但数据分析人员没有拒绝它时犯的错误叫()。A、α错误B、β错误C、取伪错误D、弃真错误E、nan答案:BC7.大数据应用应严格遵守国家数据安全相关法律法规和公司数据安全相关规定,严格保护()、()、()安全,严格执行数据获取、数据传输、数据储存、数据使用、数据共享、数据销毁等环节安全管理要求,确保大数据应用工作安全合规。A、商业秘密B、国家秘密C、公司商业秘密D、个人信息安全E、nan答案:BCD8.评估内容包括但不限于____和____两个方面,具体可包括使用频率、使用范围及应用大数据带来的效率提升、增加的社会或经济效益等。A、应用推广B、应用背景C、应用性能D、应用效益E、nan答案:CD9.OTS以()的形式组织数据。A、schemaB、表组C、表D、实例E、nan答案:CD10.以下图像技术中属于图像处理技术的是()。A、图像编码B、图像合成C、图像增强D、图像分类E、nan答案:AC11.加强数据传输、存储过程中的安全管理,釆取加密、隔离、备份等安全技术手段,确保符合相应安全条件或技术标准,具备灾备能力,防范数据()风险。A、泄露B、篡改C、损毁D、丟失E、nan答案:ABCD12.Maxpute的资源类型包括:()。A、FileB、TableC、JarD、ArchiveE、nan答案:ABCD13.下列项目空间属于开发环境的是A、odps_zj_dm_equ_prodB、odps_zj_dm_grid_devC、dm_ls_prodD、dm_wz_devE、nan答案:BD14.分布式列式存储的功能有()。A、支持在线快速读写B、支持线性扩展C、具备节点监控管理D、数据同源不压缩E、nan答案:ABC15.以下哪些属于自适应学习率方法()。A、Mini-batchB、AdagradC、RMSpropD、AdamE、nan答案:BCD16.常见的聚类性能度量外部指标有()。A、Jaccard系数B、DB指数C、FM指数D、以上答案都正确E、nan答案:AC17.大数据计算服务(Maxpute,原ODPS)提出了安全沙箱的概念,为了保证整个计算环境的安全,某些特殊操作会被禁止。以下()操作会受到沙箱的影响。A、使用内置函数B、使用MRC、使用DDL创建表D、使用UDFE、nan答案:BD18.使用极大似然估计的前提条件有()。A、数据服从某种已知的特定数据分布型B、已经得到了一部分数据集C、提前已知某先验概率D、数据集各个属性相对独立E、nan答案:AB19.Hadoop框架的缺陷有()。A、MR编程框架的限制;B、过多的磁盘操作,缺乏对分布式内存的支持;C、无法高效支持迭代式计算;D、不支持多用户写入并任意修改文件;E、nan答案:ABCD20.感知机能容易实现逻辑(__)、(__)、(__)运算A、加减B、与C、或D、非E、nan答案:BCD21.在MaxputeSQL中可以通过命令清空表中已有的数据,以下命令正确的包括()。A、对非分区表truncateB、对分区表truncateC、对分区表alterD、对所有表dropE、nan答案:AC22.以下关于降维方法,叙述正确的是()。A、主成分分析是一种常用的非线性降维方法B、核化线性降维是一种常用的线性降维方法C、流形学习是一种借鉴拓扑流形概念的降维方法D、度量学习绕过降维的过程,将学习目标转化为对距离度量计算的权重矩阵的学习E、nan答案:CD23.下面关于Python中的列表和字典说法正确的是()。A、字典和列表都可以通过“[]”操作符访问元素的值B、列表的索引必须是整型数或者切片C、字典不过是列表的另一个名字。二者没有区别D、字典的长度是动态的,而列表的长度是固定的E、nan答案:AB24.以下现象属于过拟合的是A、训练集Loss下降,验证集loss不变B、训练集Loss下降,验证集loss上升C、训练集Loss上升,验证集loss.上升D、训练集Loss下降,验证集loss下降E、nan答案:AB25.公司对外提供数据时,应通过与外部合作单位和供应商签订合同(含保密条款)、保密协议、保密承诺书等方式进行数据安全管控,合同、协议、承诺书由____会同____根据实际情况制定,内容需明确数据使用范围、途径等。A、供应商B、总师室C、业务部门D、法律合规部门E、nan答案:CD26.下列场景适合使用Python的是()。A、可作为脚本语言,快速编写小型程序、脚本等B、可应用在数据科学、交互式计算及可视化领域C、可作为胶水语言,整合如C++等语言代码D、Python适用于低延时、高利用率的应用场景E、nan答案:ABC27.变量名可以包含()。A、字母B、数字C、下划线D、空格E、nan答案:ABC28.下面关于reduce函数功能描述正确的是()。A、合并value值,形成较小集合B、采用迭代器将中间值提供给reduce函数C、map()函数处理后结果才会传输给reduce()D、内存中不会存储大量的value值E、nan答案:ABCD29.在决策树基本算法中,有三种情形会导致递归返回,这三种情形分别是(__)。A、当前结点包含的样本全属于同一类别,无需划分B、当前属性集为空,或是所有样本在所有属性上取值相同,无法划分C、当前结点包含的样本集合为空,不能划分D、当前结点包含的样本不属于同一类别,不可划分E、nan答案:ABC30.关于HDFS的文件写入,正确的是()。A、不支持多用户对同一文件的写操作;B、用户不可以在文件任意位置进行修改;C、默认将文件复制成三份存放;D、复制的文件块默认不存在同一机架上;E、nan答案:ABCD31.下列哪个神经网络结构会发生权重共享。A、卷积神经网络B、循环神经网络C、全连接神经网络D、Softmax层E、nan答案:AB32.下列对字符串函数或方法说法正确的有()。A、istitle()B、max(str)C、replace(old,newD、upper()E、nan答案:ABC33.()等都是Scikit-Learn中包含的算法。A、SVMB、随机森林C、Lasso回归D、密度聚类E、nan答案:ABCD34.在MaxputeSQL中可以通过reatetable语句创建一个新表,创建表时可以指定ifnotexists,以下说法正确的有:()。A、如果在创建表时指定ifB、如果在创建表时指定ifC、如果在创建表时不指定ifD、如果在创建表时不指定ifE、nan答案:AC35.鼓励各部门、各单位强化大数据成果转化、应用与推广。对内赋能()等实际工作,对外支撑国家治理能力现代化和新兴业务发展,切实发挥电力大数据的经济价值和社会效益。A、电网运行B、经营管理C、客户服务D、基层减负E、nan答案:ABCD36.图像识别的一般步骤包括()。A、预处理B、特征提取C、超像素生成D、识别分类E、nan答案:ABD37.下面哪些属于可视化高维数据技术()。A、矩阵B、平行坐标系C、星形坐标D、散布图E、nan答案:ABC38.建立数据驱动的电网运行新模式,实现(),全面提升电网主业的精益化、智能化水平。A、状态实时感知B、故障精准识别C、运行自主优化D、清洁能源全消纳E、nan答案:ABC39.强化()等关键环节管控,组织各业务部门编制本专业数据合规审查要点,确保对外提供的数据产品及服务等合法合规。A、数据产品B、数据处理C、服务开发D、数据对外开放E、nan答案:ACD40.当图像分类的准确率不高时,可以考虑以下哪种方法提高准确率A、数据增强B、调整超参数C、使用预训练网络参数D、减少数据集E、nan答案:ABC41.图像数字化应该包括哪些过程()。A、采样B、模糊C、量化D、统计E、nan答案:AC42.MapReduce与HBase的关系,哪些描述是正确的()。A、两者不可或缺,MapReduce是HBse可以正常运行的保证B、两者不是强关联关系,没有MapReduce,HBase可以正常运行C、MapReduce可以直接访问HbaseD、它们之间没有任何关系E、nan答案:BC43.对于神经网络,以下哪些是超参数?A、神经网络的层数(numberB、神经网络的学习率(learningC、神经网络的权重(weights)D、神经网络的偏置(bias)E、nan答案:AB44.下列说法正确的有()。A、网站服务器可以识别你使用的访问软件,因为在发送访问请求中有特定位置的字符串和软件类型相关B、低级别的代理服务器十分容易被识别C、可以通过修改opener的proxy来模拟浏览器访问D、爬取图片的流程被中断时,之前所有爬取的信息都将被自动删除E、nan答案:AB45.EDA(探索性数据分析)方法与传统统计学的验证性分析方法的区别有()。A、EDA需要事先提出假设,而验证性分析不需要B、EDA中采用的方法往往比验证性分析简单C、在一般数据科学项目中,探索性分析在先,验证性分析在后D、EDA更为简单、易学和易用E、nan答案:BCD46.参数估计可以分为()。A、点估计B、一致估计C、区间估计D、无偏估计E、nan答案:AC47.关于数据订阅订阅数据变更类型,正确的是:()。A、updateB、deleteC、insertD、replaceE、nan答案:ABCD48.国网数据中台能力架构中数据接入能力包含()。A、数据复制B、ETLC、数据交换D、消息队列E、nan答案:ABCD49.下面关于中台架构,中台之间关系说法正确的是()A、数据中台接收业务中台传输的数据,通过大数据算法、建模等技术,对数据进行清洗加工和分析处理B、其结果支撑业务中台供前端业务应用即时调用C、前端业务应用产生的新数据又流转到数据中台形成闭环D、技术中台为业务中台、数据中台分别提供相应的技术服务。E、nan答案:ABC50.关于MaxputePolicy授权的特点,说法正确的是:()。A、授权对象支持以通配符“*”B、删除一个对象时,与该对象相关的policy授权会被删除C、policy支持通过xml文件的方式授权D、当Allow和deny同时存在时,则以deny优先原则E、nan答案:AD51.Client端上传文件的时候下列哪项正确()。A、数据经过NameNode传递给DataNodeB、Client端将文件切分为C、Client只上传数据到一台DataNode,然后由NameNode负责Block复制D、Client如果上传的时候没有上传成功指定的副本数,则整次上传不成功E、nan答案:BD52.关于数据中台、数据平台、数据仓库三者的区别描述正确的是:A、数据中台是企业级的逻辑概念,体现企业B、数据仓库是一个相A具体的功能概念,是存储和管理一个或多个主题数据的集合,为业务提供服务的方式主要是分析报表;C、数据平台是在大数据基础上出现的融合了结构化和非结构化数据的数据基础平台,为业务提供服务的方式主要是直接提供数据集;D、数据中台距离业务更近,为业务提供速度更快的服务;E、数据仓库是为了支持管理决策分析,而数据中台则是将数据服务化之后提供给业务系统,不仅限于分析型场景,也适用于交易型场景;答案:ABCDE53.字典的遍历正确的有()。A、forB、forC、forD、forE、nan答案:BC54.()等纳入负面清单的数据,由数据使用方提出申请,经数据产生的总部业务部门和数据归口管理部门审批后方可对内跨部门、跨单位给数据使用方使用。A、国家秘密B、商业秘密C、工作秘密D、个人信息E、nan答案:BCD55.在数据科学中,计算模式发生了根本性的变化——从集中式计算、分布式计算、网格计算等传统计算过渡至云计算,有一定的代表性的是Google云计算三大技术,这三大技术包括()。A、HadoopYRN资源管理器B、GFS分布式存储系统C、MaoRedue分布式处理技术D、BigTable分布式数据库E、nan答案:BCD56.深度学习的实质及其与浅层学习的说法正确的是(__)。A、DL强调模型深度B、DL突出特征学习的重要性.特征变换+非人工C、没有区别D、以上答案都不正确E、nan答案:AB57.关于模型参数(权重值)的描述,正确的说法是哪些?A、训练好的神经网络模型存储于一定结构的神经元之间的权重和神经元的偏置中B、在训练神经网络过程中,参数不断调整,其调整的依据是基于损失函数不断减少C、模型参数量越多越好,但没有固定的对应规则D、每一次Epoch都会对之前的参数进行调整,迭代次数越多,损失函数一般越小E、nan答案:ABD58.ADS的DMS图形界面提供了()性能相关的信息。A、QPSB、访问量C、磁盘使用率D、平均响应时间E、nan答案:ABCD59.以下方法中可用于图像分割的有()。A、霍夫曼编码B、分水岭算法C、K-meansD、区域增长法E、nan答案:BCD60.在Spark的基本流程中,主要涉及()。A、DriverProgramB、CusterManagerC、WorkerNodeD、ExecutorE、nan答案:ABCD61.生成对抗网络中的生成模型可以A、输入噪声生成图像B、输入噪声和标签生成图像C、输入图像生成图像D、输入文字描述生成图像E、nan答案:ABCD62.图像压缩是建立在图像存在()几种冗余之上。A、编程冗余B、像素间冗余C、心理视觉冗余D、计算资源冗余E、nan答案:ABC63.在ADS中,两个事实表进行join的充要条件包括:()。A、张表的hash分区数必须一致B、两个表在一个表组C、张表的joinD、两个表的joinE、nan答案:ABCD64.在SQL语言中,关于DML的理解错误的是()?A、DML是数据查询语言B、DML是数据操纵语言C、DML是数据定义语言D、DML是数据控制语言E、nan答案:ACD65.加强公司数据跨境管理,按规定做好()等工作。A、审核B、报批C、安全评估D、认证E、nan答案:BCD66.下列关于ROC曲线和AUC说法正确的是:A、TPR=(TP)/(TP+FN)B、FPR=(FP)/(TP+FN)C、ROC曲线的纵轴是“真正确率”D、ROC曲线的横轴是“假正确率”E、nan答案:ABCD67.许多功能更为强大的非线性模型可在线性模型基础上通过引入()和()而得。A、层级结构B、高维映射C、降维D、分类E、nan答案:AB68.人工智能平台总体架构由平台层、应用层、服务层组成。其中,平台层包括()、()、()、()、()支撑A、模型库B、样本库C、模型平台D、底层硬件算力E、nan答案:ABCD69.下列关于探索型数据分析常用图表的说法,正确的有:A、绝大部分情况下使用饼图代替条形图能更加直观地展示数据之间的特征和对比B、探索型数据分析常用的图表包括条形图、直方图、饼图、折线图、散点图、箱型图等C、在探索型数据分析时应该尽量避免使用饼图,然而在数据报告中可以使用饼图达到更加美观的效果D、直方图和箱型图都可以用来展示数据的分布情况E、nan答案:BCD70.常用的数据审计方法可以分为()。A、预定义审计B、自定义审计C、可视化审计D、结构化审计E、nan答案:ABC71.Flume特点包括()。A、分布式B、高可靠C、高容错D、易于定制和扩展E、nan答案:ABCD72.为什么最好的mini-batch的大小通常不是1也不是m,而是介于两者之间?A、如果mini-batch的大小是1,那么在取得进展前,需要遍历整个训练集B、如果mini-batch的大小是m,就会变成批量梯度下降。在取得进展前,需要遍历整个训练集C、如果mini-batch的大小是1,那么将失去mini-batch将数据矢量化带来的的好处D、如果mini-batch的大小是m,就会变成随机梯度下降,而这样做经常会比mini-batch慢E、nan答案:BC73.无master架构的MPP数据库的优势在于哪些方面:A、所有服务节点A等B、可以通过任意服务节点查询和加载数据C、无单点风险D、无性能瓶颈E、nan答案:ABC74.用大数据计算服务构建海量的数据仓库时,分区表是一种很常见的做法,对于分区表的描述正确的有:()。A、支持hash分区、范围分区、列表分区及组合分区B、在通过SQL读取分区表中的数据时,可以通过指定分区的方法只读取一部分分组,减少IO开销C、可以单独处理指定分区中的数据,不会对其他分区数据产生影响D、对于过期的数据可以将对应的分区drop掉,不会影响其他分区中的数据E、nan答案:BCD75.对以下代码说法正确的是()。x=np.linspace(0.05,10,1000)y=np.sin(x)plt.plot(x,y,ls="-.",l=2,c="c",label="plotfigure"plt.legend()plt.grid(linestyle=":",color="r")plt.show()?Python语言?A、该图表是一个蓝绿色的散点图?B、图表中有红色实线的网格线?C、图表中有图例?D、该图画的是sin曲线;?CDA、该图表是一个蓝绿色的散点图B、图表中有红色实线的网格线C、图表中有图例D、该图画的是sin曲线;E、nan答案:CD76.依据《信息安全技术网络安全等级保护基本要求》《信息安全技术个人信息安全规范》等标准文件,落实数据()、()、()和()等技术要求。A、完整性B、保密性C、备份恢复D、个人信息保护E、nan答案:ABCD77.Python的模块符合以下哪些说法()。A、模块让你能够有逻辑地组织你的B、Python拥有丰富的模块,不支持自定义模块C、把相关的代码分配到一个模块里能让你的代码更好用,更易懂D、模块能定义函数,类和变量,模块里也能包含可执行的代码。E、nan答案:ACD78.下面对范数规则化描述正确的是()。A、L0是指向量中0的元素的个数B、L1范数是指向量中各个元素绝对值之和C、L2范数向量元素绝对值的平方和再开平方D、L0是指向量中非0的元素的个数E、nan答案:BCD79.区块链是()等计算机技术的新型应用模式。A、分布式数据存储B、点对点传输C、共识机制D、加密算法E、nan答案:ABCD80.下列说法中正确的是()。A、云计算的主要特点是非常昂贵。B、大数据是多源、异构、动态的复杂数据,即具有4V特征的数据C、大数据是数据科学的研究对象之一D、MapReduce是采用云计算这种新的计算模式研发出的具体工具软件(或算法)E、nan答案:BCD81.数据使用环节,应结合数据业务场景采用脱敏、水印、审计等技术手段实现差异化防护,遵循最小授权原则访问和处理()。A、个人信息B、企业数据C、明细数据D、企业重要数据E、nan答案:AD82.下列哪个是Hadoop运行的模式()。A、单机版B、伪分布式C、分布式D、全分布式E、nan答案:ABC83.以下属于数据挖掘与分析工具的有()。A、TableauB、PythonC、SPSSD、AlteyxE、nan答案:ABCD84.大数据计算服务图计算框架在计算过程中通过对图进行编辑、演化最终求解出结果,在计算过程中用户可以对图进行()编辑操作。A、增加点B、修改边的权值C、增加边D、删除点E、nan答案:ABCD85.以下几种场景的数据哪些不适合增量数据同步?A、网站浏览点击日志数据B、电信运营商通话详单数据C、电商客户信息数据D、电商系统商品目录数据E、nan答案:CD86.以下()场景可以使用大数据计算服务(Maxpute,原ODPS)的TunnelSDK方式实现。A、定时批量上传数据B、下载某个分区表的一个分区的数据C、一次性上传本地格式化文本文件D、随时变化的数据,通过事件(消息)驱动触发E、nan答案:ABC87.开展数据产品研发、发布等活动时,应确保遵从____、____、____等数据安全保护要求。A、国家法律法规B、数据主体授权范围C、通用数据保护条例D、公司相关规章制度E、nan答案:ABD88.图像分割中常使用的领域有()。A、0邻域B、4邻域C、8邻域D、24邻域E、nan答案:BC89.下列关于流计算特点的描述中,正确的是:()。A、实时且流式的B、数据是无界的C、事件触发D、用户触发E、nan答案:ABC90.下面是文件基本操作的函数()。A、closeB、readC、renameD、removeE、nan答案:ABCD91.下列关于包裹式选择的描述正确的是(__)。A、包裹式特征选择方法直接针对给定学习器进行优化B、从最终学习器性能来看,包裹式特征选择比过滤式特征选择更好C、包裹式特征选择的计算开销通常比过滤式特征选择大得多D、包裹式特征选择的典型算法:LVW算法,其特征子集搜索采用了随机策略E、nan答案:ABCD92.以下关于负面清单描述正确的是()。A、国网公司坚持“以共享为原则、不共享为例外”,遵循“最小化”要求,建立数据共享负面清单B、纳入公司负面清单的数据主要包括:涉及商业秘密和工作秘密、个人隐私及相关敏感事项的数据C、负面清单数据在公司范围内可直接共享使用D、投标标底、审计事项、问题线索等未涉及相关敏感事项的负面清单数据E、nan答案:ABD93.tunnelupload命令可以上传数据到大数据计算服务中去,请判断以下()数据对象可以作为上传的目标。A、资源B、非分区表C、视图D、分区表E、nan答案:BD94.下列对于十大业务域和英文简称的说法,正确的是()A、资产域,ASTB、财务域,FINC、客户域,CSTD、安全域,SAFE、nan答案:ABCD95.影响聚类算法效果的主要原因有:()A、特征选取B、模式相似性测度C、分类准则D、已知类别的样本质量E、nan答案:ABC96.下列哪些是情感分析的途径()。A、关键词识别B、数据增强C、统计方法D、概念级技术E、nan答案:ABCD97.推进大数据在促进清洁能源消纳,基于大数据划分电网安全运行边界条件,优化()的调度管理,支撑智慧能源体系建设。A、新能源调度B、源网荷储协调C、清洁能源消纳D、新能源发电预测E、nan答案:BC98.以下关于周期刷新编码正确的是:A、按分钟刷新B、按小时刷新C、按日刷新D、按周刷新E、按月刷新答案:BCDE99.已定义级(DefinedLevel)的主要特点包括()。A、组织机构已明确给出了关键过程的“标准定义”,并定期对其进行改进。B、已提供了关键过程的测量与预测方法。C、关键过程的执行过程并不是简单或死板地执行组织机构给出的“标准定义”,而是根据具体业务进行了一定的“裁剪”工作。D、数据的重要性已成为组织机构层次的共识,将数据当作成功实现组织机构使命的关键因素之一E、nan答案:ABCD100.Hadoop生态系统中,核心是()。A、FlumeB、MapReduceC、PigD、HDFSE、nan答案:BD101.关于数据组织的维度,以下选项中描述正确的是()。A、数据组织存在维度,字典类型用于表示一维和二维数据B、高维数据有键值对类型的数据构成,采用对象方式组织C、二维数据采用表格方式组织,对应于数学中的矩阵D、一维数据采用线性方式组织,对应于数学中的数组和集合等概念E、nan答案:BCD102.在大数据计算服务(Maxpute,原ODPS)的客户端工具odpscmd中开发SQL时,用户对project1和project2都有足够的操作权限,当前所在的项目空间是project1,想要查看project2中有哪些表,可以通过以下()操作。A、showB、showC、useD、showE、nan答案:AC103.MaxputeSQL不支持的是:()。A、deleteB、updateC、索引D、事务E、nan答案:ABCD104.处理图像平滑处理的滤波有()。A、盒式滤波B、均值滤波C、高斯滤波D、中值滤波E、nan答案:ABCD105.以下()是scipy.stats可实现的连续随机变量方法。A、rvsB、pdfC、ppfD、cdfE、nan答案:ABCD106.Maxpute中可以通过配额管理一个项目中可以使用的资源的上限,包括:()资源。A、存储B、带宽C、内存D、CPUE、nan答案:ACD107.聚类性能度量的指标主要分为外部指标和内部指标,其中属于内部指标的是()。A、Jaccard指数B、FM指数C、DB指数D、Dunn指数E、nan答案:CD108.总部数据管理重点工作中,数据管理的工作目标是以数据资产“易懂、易取、易用”为目标,坚持“()()()”的原则A、面向专业B、面向基层C、面向应用D、面向业务E、nan答案:ABC109.循环神经网络主要被应用于哪些场景(__)。A、语音识别B、语音建模C、机器翻译D、图像识别E、nan答案:ABC110.卷积神经网络能通过卷积以及池化等操作将不同品种的鸟归为一类。关于卷积神经网络能达到该效果的原因,下列说法正确的是()A、同样模式的内容(如鸟嘴)在图像不同位置可能出现B、池化作用能使不同种类鸟变得相似C、不同种类的相同部位(如鸟嘴)形状相似D、池化之后的图像主题内容基本不变E、nan答案:ACD111.神经网络模型(NeuralNetwork)因受人类大脑的启发而得名。神经网络由许多神经元(Neuron)组成,每个神经元接受一个输入,对输入进行处理后给出一个输出。请问下列关于神经元的描述中,哪一项是正确的(__)。A、每个神经元有一个输入和一个输出B、每个神经元有多个输入和一个输出C、每个神经元有一个输入和多个输出D、每个神经元有多个输入和多个输出E、nan答案:ABCD112.以下哪些是pytorch支持的数据类型()。A、float64B、float16C、boolD、int32E、nan答案:ABCD113.关于参数共享的下列哪个陈述是正确的?A、它减少了参数的总数,从而减少过拟合。B、它允许在整个输入值的多个位置使用特征检测器。C、它允许为一项任务学习的参数即使对于不同的任务也可以共享(迁移学习)。D、它允许梯度下降将许多参数设置为零,从而使得连接稀疏E、nan答案:BD114.Feigenbaum等人在著名的《人工智能手册》中将机器学习划分为机械学习和(_)四种。A、深度学习B、示教学习C、类比学习D、归纳学习E、nan答案:BCD115.若想知道定时作业的运行情况,可在下列哪个页面查看:A、作业监控B、实例监控C、任务监控D、通知管理E、nan答案:AB116.下面哪些是基于核的机器学习算法(__)。A、最大期望算法B、径向基核函数C、线性判别分析法D、支持向量机E、nan答案:BCD117.常见的图像降噪方式包括()。A、中值滤波B、均值滤波C、平均滤波D、加权平均滤波E、nan答案:ABCD118.关于Hive的说法正确的是()。A、Hive是基于Hadoop的数据仓库工具B、Hive可以将结构化的数据文件映射为一张数据库表C、最初,Hive由Google开源,用于解决海量结构化日志数据统计问题D、Hive的主要应用场景是离线分析E、nan答案:ABD119.促进能源大数据分类洞察、供需匹配、策略优化的产品化,强化大数据服务业务创新及市场化运营能力,打造()创新点。A、电力服务B、能源服务C、金融服务D、数据增值服务E、nan答案:CD120.数据集成功能包括:()。A、表/文件/整库迁移B、增量数据迁移C、事务模式迁移D、字段转换E、nan答案:ABCD121.大数据计算服务(Maxpute,原ODPS)提供的是海量数据的存储和计算能力,和我们熟悉的关系型数据库存在较大的差别。以下说法中正确的是:()。A、不支持事务B、不支持deleteC、不支持索引D、不支持压缩E、nan答案:ABC122.通常情况下,通过DataWorks的工作空间实现数据开发和运维,包含以下操作:A、建表并上传数据B、创建业务流程、同步任务C、设置周期和依赖D、运行及排错E、nan答案:ABCD123.开展数据产品()等活动时,应确保遵从国家法律法规、数据主体授权范围、公司相关规章制度等数据安全保护要求。A、验收B、规划C、研发D、发布E、nan答案:CD124.在模型评估与度量的方法中,下列描述正确的是(__)。A、在留出法中,如果从采样的角度来看待数据集划分的过程,则保留类别比例的采样方式通常称为分层采样B、通常,我们可通过实验测试来对学习器的泛化误差进行评估并进而做出选择。C、我们需要一个测试集来测试学习器对新样本的判别能力D、测试样本不可从样本真实分布中独立同分布采样而得E、nan答案:ABC125.客户端使用get方式读取HBase用户数据时,需要查询meta表哪些数据?A、RegionB、RegionC、RegionServerD、RegionE、nan答案:CD126.常用的冲突消解策略有包括()。A、投票法B、排序法C、元规则法D、调研法E、nan答案:ABC127.DataWorks中,调度系统提供了一些常用的时间参数,周期性调度任务使用这些参数后,在调度运行时参数会自动赋值为具体的时间,以下哪些参数是调度系统内置时间参数?A、{yyyymmdd}B、{date}C、{yyyy-mm-dd}D、{bdp.system.cyctime}E、nan答案:BD128.依托()等渠道,建立数据合规管理投诉、举报机制,及时受理内外部投诉举报。A、红网B、95598C、网上国网D、中国互联网协会12321网络不良与垃圾信息举报受理中心E、nan答案:BCD129.ETL包含下列哪些过程()A、数据抽取B、数据转换C、数据加载D、数据展现E、nan答案:ABC130.数据中台将业务生产资料转变为数据生产力,通过()推动数据价值释放,反哺业务,实现数据增值、赋能新业务。A、数据整合B、提纯加工C、数据可视化D、数据分析E、nan答案:ABC131.加强数据安全()能力建设,提高对各类数据安全事件发现、响应和溯源能力。A、监测B、预警C、审计D、处置E、nan答案:ABCD132.数据再利用的意义在于()A、挖掘数据的潜在价值B、提高社会效益,优化社会管理C、实现数据重组的创新价值D、优化存储设备,降低设备成本E、利用数据可拓展性拓宽业务领域答案:ACE133.DataHub目前支持进行数据同步的离线数据仓库包含以下哪些。A、ADSB、RDSC、表格存储D、对象存储E、nan答案:ABCD134.幵展公司数据在内网、外网、内外网间的传输,应最大限度避免()操作,并做好工作记录留存、日志审计等日常工作,确保敏感数据可溯源、可追踪、可审计。A、手工B、自动C、在线D、离线E、nan答案:AD135.公司大数据应用需求与立项管理遵循数字化项目管理规范,严格落实项目制管理要求,主要包括()和计划编制与调整等工作。A、需求征集B、评审C、储备D、立项E、nan答案:ABCD136.根据业界研究,企业数字化转型在()三方面都呈现出新的趋势A、要素驱动B、流程变革C、技术创新D、价值创造E、nan答案:ABD137.下列属于字符串匹配的分词方法的是()。A、正向最大匹配法(由左到右的方向)B、逆向最大匹配法(由右到左的方向)C、最少切分(使每一句中切出的词数最小)D、双向最大匹配法(进行由左到右、由右到左两次扫描)E、nan答案:ABCD138.根据OLAP系统的典型特征,下列属于OLAP系统的是:A、银行交易核心系统B、信用卡系统C、ACRM系统D、分线管理系统E、nan答案:CD139.当我们构造线性模型时,我们注意变量间的相关性。在相关矩阵中搜索相关系数时,如果我们发现3对变量的相关系数是(Var1和Var2,Var2和Var3,Var3和Var1)是-0.98,0.45,1.23.我们可以得出什么结论:()。A、Var1和Var2是非常相关的B、因为Va1r和Var2是非常相关的,C、Var3和Var1的1.23相关系数是不可能的D、nanE、nan答案:ABC140.Python变量命名规则()。A、变量名只能包含字母、数字和下划线。变量名可以字母或下划线开头,但不能以数字开头,例如,可将变量命名为message_1,但不能将其命名为1_message。B、变量名不能包含空格,但可使用下划线来分隔其中的单词。例如,变量名greeting_message可行,但变量名greetingC、不要将Python关键字和函数名用作变量名,即不要使用Python保留用于特殊用途的单词,如print。D、变量名应既简短又具有描述性。例如,name比n好,student_name比s_n好,name_length比length_of_persons_name好。E、nan答案:ABCD141.在神经网络中,下列哪种技术用于解决过拟合。A、DropoutB、正则化C、earlyD、BatchE、nan答案:ABCD142.数据应用的重点业务中赋能电网转型升级包括()。A、优化人员配置B、优化生产运行C、优化设备管控D、优化能源配置E、nan答案:BCD143.OGG的部署分为源端和目标端两部分组成,除Manager外还有哪些主要组件。A、ExtractB、Pump、C、CollectorD、ReplicatE、nan答案:ABCD144.先进计算与电力大数据技术,主要研究内容包括:();研究大数据环境下数据治理及安全技术,研究电力大数据仿真、测试与评价技术;研究大数据应用基础理论和标准体系,研究面向智能电网的各业务领域的大数据典型应用。A、研究数据采集、数据抽取、数据融合及数据存储技术B、研究先进计算体系及高性能计算关键技术C、研究新型计算架构与混合计算技术D、研究电力大数据分析挖掘算法、优化策略和可视化展现技术E、nan答案:ABCD145.在根虚拟节点的基础上,每个项目空间都应设置的二级虚拟节点类型包括:A、正常调度B、闲时调度C、顺序调度D、轮询调度E、nan答案:AB146.下列关于RNN、LSTM、GRU说法正确的是(__)。A、RNN引入了循环的概念B、LSTM可以防止梯度消失或者爆炸C、GRU是LSTM的变体D、RNN、LSTM、GRU是同一神经网络的不同说法,没有区别E、nan答案:ABC147.对于ADS的索引说法正确的是:()。A、一个列可以设置列属性disableIndex=true,用于屏蔽ADS的默认列索引B、ADS弱化了索引的概念,用户无需亲自为自己的数据表配置索引C、ADS拥有高度智能的自动化索引机制,会搜集相关信息,去自动创建索引D、用户需要对某列进行hashE、nan答案:ABC148.神经网络模型(neuralnetwork)因受人类大脑的启发而得名。神经网络由许多神经元(neuron)组成,每个神经元接受一个输入,对输入进行处理后给出一个输出。下列关于神经元的描述正确的有()。A、每个神经元有一个输入和一个输出B、每个神经元有多个输入和一个输出C、每个神经元有一个输入和多个输出D、每个神经元有多个输入和多个输出E、nan答案:ABCD149.以下属于关键词提取算法的有()。A、TF-IDF算法B、TextRank算法C、LSA(潜在语义分析)D、LDAE、nan答案:ABCD150.已测量级(MeasuredLevel)的主要特点包括()。A、已构建了关键过程矩阵。B、已定义了变革管理的正式流程。C、已实现用定量化方式计算关键过程的质量和效率。D、关键过程的质量和效率的管理涉及整个生命周期E、nan答案:ABCD151.Spark的部署模式包括()。A、本地模式B、standalone模式C、SparkonyarnD、mesos模式E、nan答案:ABCD152.因业务需要,确需向境外提供的,应经公司()审批,根据国家相关规定做好安全评估等工作,视情况向国家有关部门报备。A、主管领导B、信息安全小组C、保密办D、业务部门E、nan答案:CD153.从内外部环境与市场需求来看,大数据应用的业务规划将聚焦在()核心领域上。A、电网运营B、经营管理C、客户服务D、业务创新E、对外服务答案:ABCDE154.DataWorks中工作流任务如果配置为周期性调度,所支持的周期包括:()。A、月调度B、周调度C、天调度D、小时调度E、nan答案:ABCD155.下面对LDA判别分析的思想描述正确的是()。A、同类样例的投影点尽可能近B、异类样例的投影点尽可能远C、同类样例的投影点尽可能远D、异类样例的投影点尽可能近E、nan答案:AB156.训练CNN时,GPU显存溢出,此时可以采取的措施有()。A、减少B、移除一些卷积层C、减少图片输入大小D、增加激活函数E、nan答案:ABC157.国家电网有限公司关于加强数据合规管理的指导意见,坚持:()的原则A、全面覆盖B、统筹协调C、严格管控D、与时俱进E、nan答案:ABCD158.对内赋能()等实际工作,对外支撑国家治理能力现代化和新兴业务发展,切实发挥电力大数据的经济价值和社会效益。A、电网运行B、经营管理C、客户服务D、基层减负E、nan答案:ABCD159.以下MaxputeSQL中语法错误的是:()。A、selectB、selectC、selectD、selectE、nan答案:AB160.大数据应用建设及运营过程中如发生数据安全问题,应立即暂停大数据应用建设或运营工作,向____、____、法规部及相关专业管理等部门报告。A、数字化部B、信通公司C、安规部D、总师室E、nan答案:AC161.卷积神经网络通过哪些措施来保证图像对位移、缩放、扭曲的鲁棒性(__)。A、局部感受野B、共享权值C、池采样D、正则化E、nan答案:ABC162.下列哪些选项属于桌面运维人员在对桌面计算机及外设进行日常运行时的工作范围()A、到货验收,资产登记B、外设安装、调试、与计算机或网络的连接及更换耗材C、提供耗材D、计算机硬件的安装、调试、从局域网接入交换机至设备网线的跳接E、nan答案:ABD163.下面()函数不是字符串处理函数。A、TRUNCB、TO_CHARC、SUBSTRD、INSTRE、nan答案:AB164.数据传输环节,在互联网大区传输重要数据时应加密保护。采用公司统一密码基础设施签发的(),实现企业重要数据的加密传输。A、密钥B、证书C、授权D、密码E、nan答案:AB165.以下哪些选项可以用于实现爬虫功能()。A、BeautifulSoup库B、re模块C、Scrapy框架D、urllibrequest库E、nan答案:ACD166.大数据应用建设及运营过程中如发生数据安全问题,应立即暂停大数据应用建设或运营工作,向()、()、()及相关专业管理等部门报告。A、互联网部B、安保部C、法规部D、安监部E、nan答案:ABC167.下列说法中,对Python中的for语句描述正确的是()。A、Python中for语句只有一种写法:“forin”B、for语句可以用break终止当前循环,重新进入循环&C、continue语句可以跳过循环的当前一步D、for语句可以有else部分E、nan答案:ACD168.神经网络可以按()A、学习方式分类B、网络结构分类C、网络的协议类型分类D、网络的活动方式分类E、nan答案:ABD169.关于数据中台架构原则,以下说法正确的是()。A、模型统一B、资源汇聚C、同源维护D、共建共享E、nan答案:ABCD170.数据挖掘的主要功能包括概念描述、趋势分析、孤立点分析及()等方面。A、挖掘频繁模式B、分类和预测C、机器学习分析D、偏差分析E、nan答案:ABCD171.下面()接口或工具是Maxpute用于导入导出数据的。A、TunnelB、DataxC、CDPD、DshipE、nan答案:ABCD172.图像识别的精度会受到以下那些因素的影响()。A、数据类别数量不平衡B、输入图像尺寸不同C、图像中存在类标之外的环境干扰D、图像中存在随机噪声E、nan答案:ACD173.Caffe框架支持哪些语言。A、C++B、PythonC、MATLAD、RE、nan答案:ABC174.通过技术创新和管理变革交叉赋能,完成以客户为中心的快速迭代与创新,实现公司在客户、电网等核心业务能力提升及资源聚合。A、技术创新B、管理变革C、模式创新D、政策变革E、nan答案:AB175.下列关于嵌入式选择描述正确的是(__)。A、嵌入式选择是将特征选择过程与学习器训练过程融为一体B、嵌入式选择在学习器训练过程中自动地进行了特征选择C、对于嵌入式选择,特征选择过程与学习器训练过程在同一个优化过程中完成D、嵌入式特征选择方法直接针对给定学习器进行优化E、nan答案:ABC176.下列算法中,可以用神经网络去构造的有A、KNNB、线性回归C、逻辑回归D、岭回归E、nan答案:BCD177.下面关于机器学习的理解正确的是()。A、非监督学习的样本数据是要求带标签的B、监督学习和非监督学习的区别在于是否要求样本数据带标签C、强化学习以输入数据作为对模型的反馈D、卷积神经网络一般用于图像处理等局部特征相关的数据E、nan答案:BCD178.以下()情况不适合使用Maxputemapjoin。A、or连接关联条件B、关联表中有临时表C、两个表无条件关联D、两个大表关联E、nan答案:BCD179.假设你使用带正则的逻辑回归进行目标分类,然而你将算法用于一个新的测试数据集上时,原本在训练数据集上表现很好的模型产生了很大的测试误差,可以如何处理A、减小回归正则系数B、使用更多的训练数据C、增大回归正则系数D、使用更少的训练数据E、nan答案:BC180.(__)可以帮助解决训练集在特征空间中线性不可分的问题。A、硬间隔B、软间隔C、核函数D、拉格朗日乘子法E、nan答案:BC181.按规定开展网络安全等级保护测评,强化()等技术措施。A、信息脱敏B、定密加密C、去标识化D、安全认证E、nan答案:ABC182.Hadoop的优点包括()。A、可靠的B、高效的C、可伸缩的D、低成本E、nan答案:ABCD183.关于长短时神经网络的叙述中正确的是()。A、引用自循环思想B、产生梯度长时间持续流动的路径C、积累的时间尺度不可以因输入序列而改变D、可应用于语音识别和机器翻译E、nan答案:ABD184.关于AlexNet描述正确的是()。A、用dropout来控制全连接层的模型复杂度B、包含5层卷积和2层全连接隐藏层,以及1个全连接输出层C、将LeNet中的ReLU激活函数改成了Sigmoid激活函数D、首次证明了学习到的特征可以超越手工设计的特征E、nan答案:ABD185.以下关于HTML标签嵌套规则的说法,正确的是()。A、块元素可以包含内联元素或某些块元素,但内联元素也可以包含块元素B、HTML标签包括块级元素和内嵌元素C、内嵌元素一般用在网站内容之中的某些细节或部位,用以“强调区分样式上标下标锚点”等,通常包括:aabbrbbrfontiimginputkbdlabelqsselectsmallspansubttuvar等D、其中块级元素一般用来搭建网络架构布局承载内容,通常包括的标签有:addressdirdivdldtddformh1~h6hrisindexmenunoframesnoscriptolppretableul等E、nan答案:BCD186.类的特点有()。A、封装B、继承C、多态D、重复E、nan答案:ABC187.建立健全()制度,明确数据违规事件发生后的处置流程和时间节点,最大化防范和化解风险。A、突发事件应急预案B、违规事件报告C、风险防控D、数据安全E、nan答案:AB188.数据存储环节,企业重要数据原则上应存储于管理信息大区,在互联网大区存储企业重要数据时应加密存储。落实重要()等技术应用。A、数据备份B、访问控制C、加密传输D、安全审计E、nan答案:ABD189.严格遵守囯家法律、法规和公司相关规定,在保护国家秘密和企业秘密,且不损害()等相关方权益的前提下,有序推动数据对外幵放,重点防范对外幵放过程中的敏感数据泄露。A、公司B、用户C、客户D、供应商E、nan答案:ABD190.下列关于AUC面积描述正确的是()。A、AUC被定义为ROC曲线下与坐标轴围成的面积B、AUC面积的值大于1C、AUC等于0.5时,则真实性最低,无应用价值D、AUC越接近1.0,检测方法真实性越高E、nan答案:ACD191.以下属于规则的分词方法的是()。A、正向最大匹配法B、逆向最大匹配法C、双向最大匹配法D、条件随机场E、nan答案:ABC192.在使用阿里云大数据计算服务MaxputeMapReduce的过程中,会遇到程序执行时间过长,运行缓慢等问题,针对这种情况,我们一般可以使用以下哪些方法来提升MaxputeMapReduce的执行效率?A、增加中间环节,将多个串行的作业拆成多个map及reduce的循环阶段,增加中间表落磁盘的操作。B、输入数据进行列裁剪,也就是只关心需要的列数据。C、尽量增加Reducer数量。D、合理的使用biner,对map阶段输出的结果中的重复key进行合并处理。E、nan答案:BD193.pandas中主要的数据结构是()。A、DataB、DataFrameC、FrameD、SeriesE、nan答案:BD194.常用的爬虫技巧有以下哪些()。A、更改header,伪装成浏览器进行爬取B、设置爬取的时间间隔C、应用神经网络算法识别网站验证码D、通过代理服务器进行爬取E、nan答案:ABCD195.下列关于神经网络说法正确的是()。A、不如决策树稳定B、高速寻找优化解C、非线性D、具有自学习、自组织、自适应性E、nan答案:BCD196.加强数据传输、存储过程中的安全管理,釆取()等安全技术手段,确保符合相应安全条件或技术标准,具备灾备能力,防范数据泄露、篡改、损毁、丟失风险。A、加密B、隔离C、备份D、存储E、nan答案:ABC197.()能知道一个MaxputeSQL在运行时占用了多少instance。A、根据表的大小,自己计算B、使用psC、用odpscmd提交时,从返回的状态中查看D、打开logview查看E、nan答案:CD198.数据来源和目标用户已定的情况下,不同视觉通道的表现力不同。视觉通道的表现力的评价指标包括()。A、精确性B、可辨认性C、可分离性D、视觉突出性E、nan答案:ABCD199.加强数据安全标识、数据源鉴别等技术应用,对采集数据进行()校验。A、合规性B、有效性C、一致性D、合理性E、nan答案:BD200.卷积神经网络中,底层的卷积层可以提取到图片的哪些特征?()。A、边缘B、线段C、局部块D、以上都不是E、nan答案:AB201.以下关于Hbase文件存储模块描述正确的有:()。A、应用在FusionInsightB、HFS封装了Hbase与HDFS的接口C、为上层应用提供文件存储、读取、删除等功能D、HFS是:Hbase的独立模块E、nan答案:ABCD202.()等纳入负面清单的数据,由数据使用方提出申请,经数据产生的总部业务部门和数据归口管理部门审批后方可对内跨部门、跨单位给数据使用方使用。A、商业秘密B、工作秘密C、个人信息D、电网公开数据E、nan答案:ABC203.数据应用优化生产运行,提升电网质效包括()。A、优化源网荷储协调和清洁能源消纳的调度管理B、优化配电网运行C、提升电网防灾抗灾能力D、优化设备物资供应链E、nan答案:ABC204.Maxpute支持多种常见数据类型,包括:()。A、booleanB、decimalC、clobD、multivalueE、nan答案:AB205.在BP网络中,常用于缓解其过拟合的策略有()。A、早停策略B、正则化策略C、全局最小策略D、局部最小策略E、nan答案:AB206.DataWorks中,调度任务每次运行前都先将任务实例化,即生成实例,调度运行时实际上在执行相应的实例。在调度的不同阶段,实例会处于不同的状态,包括()A、未完成B、运行中C、未运行D、失败E、nan答案:BCD207.神经网络中参数极多,常用的初始化方法有哪些?A、全零初始化B、随机初始化C、加载预训练模型D、使用深度信念网络E、nan答案:ABC208.Apriori算法的计算复杂度受()影响。A、支持度阀值B、项数(维度)C、事务数D、事务平均宽度E、nan答案:ABCD209.经典LSTM网络中使用tanh激活函数的模块是()A、输入门B、输出门C、遗忘门D、更新门E、nan答案:AB210.下列算法,哪些属于深度学习模型A、支持向量机SVMB、深度残差网络C、集成学习GBDTD、卷积神经网络CNNE、nan答案:BD211.集成学习中多样性的增强有哪些()A、数据样本扰动B、输入属性扰动C、输出表示扰动D、算法参数扰动E、nan答案:ABCD212.ElasticSearch具有什么特点?A、支持集群拓展B、支持结构化数据检素C、支持非结构化数据检索D、支持事务机制E、nan答案:ABCD213.严格采取()的方式收集数据,对照法律法规、规章、国家与行业标准,区分数据收集对象和收集方式,制定有效的安全管理策略和保障措施。A、合规B、合法C、最小化D、正当E、nan答案:BD214.下列哪些是词语情感分析的方法()。A、基于网络的分析方法B、基于word-embedding的分析方法C、基于词典的分析方法D、基于词频的分析方法E、nan答案:AC215.采用深度学习根据图像训练一个植物分类模型前,一般需要做以下哪些操作()A、搜集大量植物图像样本B、搜集少量典型植物图像样本C、对植物样本进行标注D、每类植物仅需搜集一张图像E、nan答案:AC216.下面哪些是使用卷积网络的开源实现(包含模型/权值)的常见原因?A、为一个计算机视觉任务训练的模型通常可以用来数据扩充,即使对于不同的计算机视觉任务也是如此。B、为一个计算机视觉任务训练的参数通常对其他计算机视觉任务的预训练是有用的。C、使用获得计算机视觉竞赛奖项的相同的技术,广泛应用于实际部署。D、使用开源实现可以很简单的来实现复杂的卷积结构E、nan答案:BCD217.在视觉智能建模过程中,已有数据整体通常分为训练集、验证集、测试集三部分,其中训练集的作用以下描述哪些是错误的()。A、用于训练模型B、验证模型的有效性C、衡量模型的性能D、比较同类算法的性能E、nan答案:BCD218.下列关于偏差、方差、均方差、泛化误差描述有误的是(__)。A、方差度量了学习算法的期望预测与真实结果的偏离程度。B、偏差度量了同样大小的训练集的变动所导致的学习性能的变化。C、泛化误差表达了在当前任务上任何学习算法所能达到的期望泛化误差的下界,即刻画了学习问题本身的难度。D、泛化误差可分解为偏差、方差与噪音之和。E、nan答案:ABC219.以下跟图像处理相关的是()。A、图像识别B、人脸识别C、视频分析D、自然语言处理E、nan答案:ABC220.各单位要坚持维护()并重。A、数据管理B、数据安全C、促进数据利用D、促进数据开发利用E、nan答案:BD221.python中,字符串格式化的方式()。A、%B、formatC、inD、inputE、nan答案:AB222.有关通道的说法,哪些说法是正确的?A、在卷积操作时,每个卷积核要对输入特征图的所有通道分别做卷积后求和,得到对应的新特征图B、卷积层的输入特征图的通道数和输出特征图的通道数是相同的C、通道数越多,获得的特征图越多,网络获得的特征越充分D、随着卷积网络深度的增加,一般使用更小的卷积核和更多的通道,兼顾训练速度和网络分类性能E、nan答案:CD223.以下描述中属于Analytics2.0的主要特点的是()。A、侧重嵌入式分析B、重视非结构化数据的分析C、以决策支持为主要目的D、注重解释性分析和预测性分析E、nan答案:BCD224.以下算法中可以应用于图像分割的是()。A、边缘检测技术B、阈值分割技术C、基于区域的分割技术D、区域生长方法E、nan答案:ABCD225.下列不符合地市共享层的模型命名规的名称是A、DWD_HZ_CST_T_CSTORGB、DWD_UZ_CST_T_CSTORGC、TEMP_DWD_CST_T_C_CONSD、ADS_CST_DLXFZS_YQ_YYXRL_MFE、nan答案:CD226.大数据人才培养机制包括A、培养B、选拔C、组建人才库D、制定标准E、nan答案:ABC227.确保数据____、______、_______并不断跟踪反馈、迭代更新数据模型A、完整B、准确C、有效D、安全E、nan答案:ABC228.数据中台由()五大板块组成,采用总部和省市公司两级部署模式构建。A、贴源层B、共享层C、分析层D、统一数据服务调度E、数据资产管理答案:ABCDE229.下面是Python注释语句的是()。A、hello'B、''hello'''C、"hello"D、E、nan答案:BD230.下面关于连续型随机变量以及连续型概率密度函数的说法,正确的是。A、“一个客服一天可能接听到多少个电话”是一个连续型随机变量B、正态分布是一种连续型随机变量的概率分布C、可以使用概率密度函数来描述连续型随机变量的概率分布D、连续型概率密度函数曲线下方的面积之和为1E、nan答案:BCD231.下列关于聚类法方法描述正确的是(__)。A、k均值算法B、学习向量化算法试图找到一组原型向量来刻画聚类结构C、高斯混合聚类采用概念模型来表达聚类原型D、学习向量化算法属于层次聚类E、nan答案:AB解析:属于原型聚类深度学习232.关于VACUUM,下列说法正确的是:A、可以使用VACUUMB、产生空间碎片的原因是因为进行了大量的更新或删除操作C、数据膨胀如果不加清理,会逐渐降低查询的效率D、VACUUM可以生成表的统计信息E、nan答案:ABC233.对外发布特定数据产品和服务,需按照国家、行业相关法律法规要求,获得相应的(),根据《征信管理条例》,涉及提供征信服务的产品,须获得经营许可),并报业务部门和数据管理工作归口部门备案。A、备案B、授权C、资质D、牌照E、nan答案:ACD234.打造生活性服务新模式,开展交通预测、房屋节能、建设规划等领域业务拓展,推动围绕等领域的业态创新,打造生活性服务新模式。A、城市大脑B、智慧城市C、数字乡村D、智能家居E、nan答案:BCD235.大数据应用专业支撑单位应落实大数据应用相关数据____和____,加强数据安全前沿技术研究应用,提升数据安全感知、监测、追溯和控制等能力,为大数据应用工作做好数据安全技术保障。A、安全策略B、管控措施C、技术研究D、技术应用E、nan答案:AB236.特征选择的目的:()。A、减少特征数量、降维B、使模型泛化能力更强C、增强模型拟合能力D、减少过拟合。E、nan答案:ABD237.对于某一预测,其TP和FN为2,FP和TN为3,以下那种说法是正确的()。A、召回率为0.4B、精确率为0.4C、召回率为0.5D、精确率为0.5E、nan答案:BC238.以下关于数据维度的描述,正确的是()。A、采用列表表示一维数据,不同数据类型的元素是可以的B、JSON格式可以表示比二维数据还复杂的高维数据C、二维数据可以看成是一维数据的组合形式D、字典不可以表示二维以上的高维数据E、nan答案:ABC239.健全数据合规管理体系,落实管理职责,强化(),突出事前防范和过程管控,加强违规事件应对处置,严格管控数据合规风险。A、横向到边B、横向协调C、纵向指导D、纵向贯通E、nan答案:BC240.Python的优点有()。A、变量不用预定义类型B、数据结构功能强大C、语言可解释性强D、变量类型固定E、nan答案:ABC241.Hadoop的HDFS是一种分布式文件系统,适合以下哪种场景的数据存储和管理()。A、大量小文件存储B、高容错、高吞吐量C、低延迟读取D、流式数据访问E、nan答案:BD242.时序数据库TSDB是一种()的在线时序数据库服务,为您提供高效读写、高压缩比存储、时序数据插值及聚合计算等服务。A、高性能B、低成本C、稳定可靠D、nanE、nan答案:ABC243.技术中台为业务中台、数据中台及前台提供“()、()、()”的技术创新服务,助力企业数字化应用快速建设。A、统一B、易用C、多样D、强健E、nan答案:ABD244.项目空间(project)是大数据计算服务(Maxpute,原ODPS)的基本组织单元,它类似于传统数据库的Database。以下关于项目空间的说法中正确的有:()。A、所有的对象都会属于某个项目空间B、一个帐号可以拥有多个项目空间的权限C、一个帐号可以创建多个项目空间,最多不能超过10个D、通过安全授权,可以在一个项目空间中访问另一个项目空间中的数据E、nan答案:ABD245.以下是数据中台的建设目标的是:A、企业全局复用B、服务标准稳态C、数据融合共享”D、nanE、nan答案:ABC246.关于Maxpute的视图的描述,下列正确的是:()。A、视图可以引用视图,包括自身B、创建视图时,必须对引用表有读权限C、如果想保存当前视图中的数据,可以插入一张表或者使用物化视图D、视图只能包含一个有效的select语句E、nan答案:BD247.列存表有以下哪些特性:A、insert效率高B、适用于OLAPC、select效率高D、update效率高E、nan答案:BC248.下列表示同一种学习方法的是(__)。A、集成学习B、多分类器系统C、基于委员会的学习D、平均策略E、nan答案:ABC249.以下关于Pig说法正确的是()。A、弥补MapReduce编程复杂性B、封装MapReduce处理过程C、PigLatin是一种数据分析语言D、适用于并行处理E、nan答案:ABCD250.长短时记忆神经网络三个门是()。A、进化门B、输出门C、输入门D、遗忘门E、nan答案:BCD251.Spark的关键技术包括以下哪几个()。A、RDD;B、Scheduler;C、Storage;D、Shuffle;E、nan答案:ABCD252.某单位运用随机森林算法思想建立抢修热点模型。该模型主要预测下期台区工单数量,构建抢修热点。以下模型算法构建步骤中合理的顺序是:()。A、将历史数据进行随机自助法重抽样,生成N个训练样本集B、将N个训练样本集分别做决策树,生成N棵决策树C、将N棵决策树随机构成随机森林D、未来根据预测样本气候环境、设备属性、设备工况进行随机森林决策投票,得出针对该预测样本最优的决策树进行运算,并计算出最终结果。E、nan答案:ABCD253.机器学习的三个关键组成要素是()。A、任务TB、性能指标PC、目标函数VD、经验来源EE、nan答案:ABD254.Maxpute中,当一个大表和多个小表做连接时,可以考虑使用mapjoin,以下关于mapjoin的限制,说法正确的是:()。A、leftB、fullC、最多支持8张小表D、所有小表占用内存综合不能超过256ME、nan答案:AB255.大数据常见的计算方式有三种:离线计算、流计算以及在线计算,关于这几种计算方式的说法正确的有:()。A、流计算是消息驱动的,数据更新一般是定时更新B、离线计算的数据更新以定期的批量更新为主C、在线计算一般在用户发起请求时(比如查询)发生D、流计算可以应用于实时数值统计、实时事件预警等领域E、nan答案:BCD256.大数据应用的业务规划将聚焦核心领域,打造共5大重点业务、12个业务领域、34项业务方向。A、5B、10C、12D、34E、nan答案:ACD257.以下做法可以解决避免陷入局部最优解的有()A、随机梯度下降B、增大batchC、设置不同初始值D、设置momentumE、nan答案:ACD258.RDD具有()和()特征。A、可容错性;B、简洁性;C、并行数据结构;D、结构化;E、nan答案:AC259.以下哪些应用适合使用循环神经网络来完成?()。A、看图说话B、机器翻译C、社交网络用户情感分类D、从一张合影照片找到特定的人E、nan答案:ABC260.HighBias(高偏差)解决方案:()。A、BoostingB、复杂模型(非线性模型、增加神经网络中的层)C、更多特征D、nanE、nan答案:ABC261.DRDS的全局唯一ID主要特点有:()。A、全局有序B、没有单点性能瓶颈C、全局唯一D、大并发获取E、nan答案:BCD262.Analytics1.0的主要特点有()。A、分析活动滞后于数据的生成B、重视结构化数据的分析C、以对历史数据的理解为主要目的D、注重描述性分析E、nan答案:ABCD263.以下描述中正确的是()。A、统计学是数据科学的理论基础之一B、Python语言是统计学家发明的语言C、机器学习是数据科学的理论基础之一D、数据科学是统计学的一个分支领域(子学科)E、nan答案:AC264.以习近平新时代中国特色社会主义思想为指导,全面贯彻习近平总书记关于网络强囯的重要思想和国家网络空间安全战略、国家大数据发展战略,认真落实囯务院国资委加强合规管理、建设法治央企工作部署,紧扣“稳、进、育、幵”四字要求,秉持()理念。A、引领规范B、合法合规C、支撑推动D、引领推动E、nan答案:AC265.在大数据计算服务SQL中使用distributeby和sortby可以对数据进行局部排序,以下对distributeby、sortby的用法描述正确的有:()。A、数据会按照distributeB、使用sortC、sortD、在一个分片中,数据会按照sortE、nan答案:ABD266.去除噪声数据的方法有哪些?A、分箱B、回归C、离群点分析D、特征提取E、nan答案:ABC解析:阿里中台267.哪些是离线批处理的特点?A、处理数据量巨大,PB级B、处理时间要求高C、容易产生资源抢占D、多个作业调度复杂E、nan答案:ACD268.以下关于数据中台的描述,正确的是()。A、数据中台是企业级数据能力共享平台。B、数据中台将业务生产资料转变为数据生产力,通过数据整合、提纯加工、数据可视化推动数据价值释放,反哺业务,实现数据增值、赋能新业务。C、数据中台通过实现各类型数据资源全量纳管、处理分析,推动数据业务化。D、国网数据中台采用总部和省市公司两级部署模式构建。E、nan答案:ABCD269.针对维数灾难,我们主要采用的降维方法有哪些()。A、多维缩放B、主成分分析C、核化线性降维D、流形学习E、度量学习答案:ABCDE270.使用数据集成做数据同步,为了避免对数据源造成过大压力,如下通道控制的配置方法哪些是正确的?A、增大任务期望最大并发数B、减小任务期望最大并发数C、同步速率选择限流D、同步速率选择不限流E、nan答案:BC271.以下哪层是卷积神经网络的组成部分。A、卷积层B、中间层C、池化层D、全连接层E、nan答案:ACD272.以下可用于处理由于光照不均带来的影响的图像处理方法有()。A、同态滤波B、顶帽变换C、基于移动平均的局部阈值处理D、拉普拉斯算子E、nan答案:ABC273.以下属于HiveSQL中DDL的是:()。A、修改表B、删除表C、数据导入D、建表E、nan答案:ABD274.依据《国家电网有限公司数据管理办法》,建立基于负面清单的公司对内数据共享机制,坚持“以共享为原则、不共享为例外”,改变当前()的数据应用授权方式。A、安全第一B、一事一议C、层层审批D
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2026年乡村医生考试题库及答案
- 钢筋工程专项施工方案
- 湖北省武汉市黄陂区2025~2026学年高一下册期末考试数学试卷【附解析】
- 2026年宿迁泽达职业技术学院单招职业倾向性测试题库附答案
- 桡骨远端骨折护理查房
- 2026年乾安县事业单位专项招聘普通高校毕业生6人笔试模拟试卷(知识)含答案解析
- 2026年秋季学期高一历史必修一第一课单元检测练习卷
- 26-27六年级上人教版数学开学摸底测试卷二(含答案)
- 医院护理安全相关知识试题及答案
- 2025-2026年考研数学线性代数重点习题
- 《劳动争议处理》课件
- 无人机组装与调试 课件 项目1任务1 多旋翼无人机飞行平台组装调试
- 2024年10月高等教育自学考试13013高级语言程序设计试题及答案
- GB/T 44848-2024工业通风机通风机振动测量方法
- 《工程概论》课件
- 游乐场项目策划方案
- 电子商务课件教学课件
- DL∕T 1252-2013 输电杆塔命名规则
- 2025届云南师大附中高一下数学期末检测试题含解析
- DL-T5054-2016火力发电厂汽水管道设计规范
- 银行消保服务培训课件
评论
0/150
提交评论