2026年IT运维监控与性能调优笔试试题(完整版)_第1页
2026年IT运维监控与性能调优笔试试题(完整版)_第2页
2026年IT运维监控与性能调优笔试试题(完整版)_第3页
2026年IT运维监控与性能调优笔试试题(完整版)_第4页
2026年IT运维监控与性能调优笔试试题(完整版)_第5页
已阅读5页,还剩2页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

2026年IT运维监控与性能调优笔试试题(完整版)2026年IT运维监控与性能调优笔试试题(完整版,适合运维工程师、云运维、应用运维、监控运维岗位)适用方向:传统IDC运维、云原生运维、系统性能调优、全链路监控、故障排查

总分:100分答题时间:90分钟一、单项选择题(每题2分,共30分)Linux系统中,查看进程级CPU占用、线程消耗,实时刷新命令是()

A.topB.vmstatC.htopD.iostat下列指标属于CPU软中断统计查看命令()

A.sar-qB.sar-iC.sar-PD.sar-n一台服务器出现大量D状态进程(不可中断休眠),根本原因通常是()

A.CPU满载B.磁盘IO阻塞C.内存OOMD.网络丢包监控系统中,直方图Histogram最适合统计哪种指标?()

A.CPU使用率瞬时值B.HTTP接口响应耗时分布

C.磁盘总容量D.当前在线连接数Prometheus的数据采集模型是()

A.主动推送PushB.服务端主动拉取PullC.双向长连接D.消息队列中转Linux内存指标中,available含义正确的是()

A.单纯free空闲内存

B.free+buffers+cached可回收内存总和

C.仅缓冲区内存

D.已分配未使用内存TCP三次握手失败,服务端大量出现SYN_RECV,最可能问题()

A.服务端防火墙拦截返回ACKB.端口未监听

C.客户端端口耗尽D.应用进程崩溃数据库慢查询导致业务卡顿,属于性能分层哪一层瓶颈?

A.基础设施层B.中间件层C.应用层D.存储层Grafana+Prometheus告警无法触发,不属于常见原因的是()

A.rule规则语法错误B.target实例状态down

C.指标名称大小写不一致D.服务器CPU空闲Linux磁盘IO调度算法,SSD固态硬盘推荐使用()

A.deadlineB.cfqC.noopD.anticipatory全链路追踪(Tracing)核心不会采集以下哪项?

A.Span耗时B.调用栈关系C.GC日志D.TraceId一台主机持续大量pageout(页写出),说明()

A.内存充足B.物理内存不足,频繁使用swap

C.磁盘读写速度快D.CPU负载过高Nginx监控中accepts>handled>requests,说明()

A.连接被nginx拒绝/队列溢出

B.正常流量

C.后端服务响应慢

D.磁盘满云环境下容器监控相比宿主机监控,最大难点是()

A.CPU监控B.网络namespace隔离、容器资源限额监控

C.磁盘使用率D.系统负载下列哪项不属于容量规划监控指标()

A.CPU平均使用率趋势B.内存增长曲线

C.瞬时5xx错误数D.磁盘每月增长率二、多选题(每题3分,多选少选不得分,共15分)常见Linux系统性能四大维度(黄金四指标)包含()

A.CPUB.内存C.IOD.网络E.端口数量Prometheus生态常用监控组件包含()

A.node-exporterB.alertmanagerC.jaegerD.blackbox-exporter系统出现TCP连接耗尽(cannotassignrequestedaddress)优化手段有()

A.调大ip_local_port_range端口范围

B.缩短tcp_tw_reuse、tcp_fin_timeout

C.开启tcp_syncookies

D.增大文件句柄数nofile应用响应缓慢,排查需要收集哪些监控数据()

A.系统负载、上下文切换

B.接口响应时间、错误率

C.GC日志/线程堆栈

D.数据库锁等待、慢SQL主流可观测性三大支柱包含()

A.Metrics指标B.Logs日志C.Traces链路追踪D.配置中心三、判断题(每题1分,共10分,√/×)LoadAverage大于CPU核心数,代表CPU一定繁忙。()Swap频繁使用一定代表内存不足。()Prometheus默认数据持久化能力弱,长期存储建议搭配Thanos/VictoriaMetrics。()iowait高一定是磁盘性能差,和CPU无关。()TIME_WAIT状态是客户端主动关闭连接产生。()node-exporter可以直接采集容器内部进程指标。()监控告警阈值尽量设置越低越好,保证不放过任何异常。()上下文切换(contextswitch)过高会消耗CPU性能。()histogram_quantile函数可以直接计算百分位延迟P95/P99。()OOMKiller杀死进程时,系统一定会先触发swap。()四、简答题(每题5分,共25分)简述Linux系统负载LoadAverage含义,举例:4核CPU,loadavg=6代表什么?请区分:iowait%和%util(磁盘饱和指标),什么时候%util达到100%但业务不卡顿?PrometheusTarget显示down,请列出至少5种常见排查原因。线上业务接口偶发延迟高、无规律报错,请写出标准化排查思路(从监控分层角度)。简述监控系统告警风暴产生原因以及至少4种抑制方案。五、实操分析题(每题10分,共20分)题目1(系统性能故障分析)线上服务器指标:CPU使用率30%,但上下文切换持续3万+/秒iowait很低,内存充足,无swap业务接口响应波动大问题:

1)初步判断瓶颈在哪里?

2)给出排查命令和优化方向。题目2(监控与云原生场景)业务使用K8s+Prometheus监控微服务,开发反馈:部分Pod监控指标时有时无,Grafana图表出现空洞。

请分析可能原因,并给出对应的解决方案。=====================参考答案分割线=====================参考答案(面试官可直接使用,附带解析)一、单选1.C2.B3.B4.B5.B

6.B7.A8.C9.D10.C

11.C12.B13.A14.B15.C二、多选1.ABCD

2.ABD(jaeger是链路追踪)

3.ABD

4.ABCD

5.ABC三、判断1.×(等待IO进程也会拉高load,不一定CPU繁忙)

2.√

3.√

4.×(进程等待IO会拉高iowait)

5.√

6.×,需要cAdvisor

7.×,阈值过低造成大量无效告警

8.√

9.√

10.×,极端场景可直接触发OOM四、简答题参考答案LoadAverage:等待运行(R状态+不可中断D状态)进程平均数;

4核CPUload=6:系统平均有6个进程等待CPU/IO资源,系统过载。%iowait:CPU空闲且等待磁盘IO的时间占比;

%util:设备有IO请求的时间占比;

多队列SSD并行读写场景,磁盘并发处理IO,util=100%但IO延迟很低,业务无卡顿。Targetdown常见原因:

①exporter进程崩溃;②防火墙/安全组拦截9100等端口;③DNS解析失败;④Prometheus配置错误;⑤目标主机宕机;⑥证书认证失败;⑦网络策略限制(k8snetworkpolicy)分层排查思路:基础设施监控→系统资源(CPU/内存/磁盘/网络)→中间件(redis/mq)→数据库(慢查询、锁)→应用指标(错误率、GC、线程)→全链路追踪定位慢调用。告警风暴原因:单一故障连锁触发大量告警;

解决方案:告警分组、告警抑制、告警静默、设置告警持续时间、告警聚合、分级告警。五、实操分析题简答题11)大量上下文切换,大概率:大量线程频繁竞争锁、频繁创建销毁线程、进程调度频繁。

2)排查:pidstat-w查看进程自愿/非自愿上下文切换;perf分析;

优化:减少线程数量、优化锁竞争、调整线程池。题2Pod指标断档空洞原因1.Pod

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论