版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
2024.5第07章:Availability
and
Disaster
Recovery云计算与虚拟化技术讨论提纲2高可用的分层模型vSphere
HA配置实现VMCP
:Virtual
Machine
Component
Protection主动式HA:Proactive
HA:准入控制:Admision
controlvSphere
FT启用FT-enabled
VM的操作FT对性能的影响Virtual
Machine
ClusteringVMware
Solutions31.1什么是高可用1.高可用的分层模型高可用(High
Availability)是系统或服务在面对各种故障、异常情况或高负载时,仍然能够持续稳定地运行,并保持一定的服务能力。高可用的主要特点:故障容忍性:能够承受部分组件的故障,如硬件故障、软件错误等,而不导致整个系统崩溃。快速恢复能力:当发生故障后,能够迅速恢复正常运行状态,减少服务中断的时间。持续服务:确保在大多数情况下用户都能持续地访问和使用服务。41.1什么是高可用1.高可用的分层模型高可用(High
Availability)是系统或服务在面对各种故障、异常情况或高负载时,仍然能够持续稳定地运行,并保持一定的服务能力。实现高可用的常用措施:冗余设计:包括硬件冗余(如多服务器、备用电源等)和软件冗余(如备份数据、副本等)。负载均衡:将工作负载均匀分配到多个资源上,防止单点故障和过载。监控预警:实时监测系统状态,及时发现问题并发出警报。容错容灾:制定应对各种故障情况的策略和预案。1.2高可用的分层模型1.高可用的分层模型51.2高可用的分层模型1.高可用的分层模型6RAC
AlwaysOnMicro-Services
ArchitectureRAC
AlwaysOnMicro-Services
ArchitectureApplication
ProxyvSphere
High
Availability
(HA)vSphere
Fault
Tolerance
(FT)vSphere
Replicationmultiple
network
interface
cards
(NICs)Host
bus
adapters
(HBAs)SANRAIDRedundant
power
supply7no
one-size-fits-all
solutionno
a-package
solution没有“一刀切、一揽子”的解决方案82.1实现HA2.
vSphere
High
Availability
(HA)vSphere
HA主要用于确保虚拟机的高可用性。在群集中的多个主机上监测虚拟机的状态。当检测到某个主机出现故障时,自动在群集中的其他健康主机上重新启动受 影响的虚拟机,从而最大程度地减少停机时间,保障业务的连续性。vSphere
HA保护级别:针对ESXi
Host硬件故障的保护针对零停机计划内的维护针对ESXi
Host计划外停机和灾难的保护92.1实现HA2.
vSphere
High
Availability
(HA)vSphere
HA启用的基本要求vCenter
ServerHA必须依赖于vCenter
Server才能实现,没有vCenter
Server将无法启用HA。启用vMotion当ESXi
Host发生故障时,HA会选择新的ESXi
Host对虚拟机进行重新启动,这 个过程实质是迁移主机。迁移主机使用的技术是vMotion,使用HA必须启用vMotion作为前提。网络冗余HA要求网络具有冗余功能,如无冗余的管理网络,HA提示配置错误。安装VMware
Tools不仅添加了虚拟机驱动程序,部分HA检测机制也通过VMware
Tools完成。群集ESXi
Host数量要求:至少2个ESXi
Host节点10112.2理解HA的工作原理2.
vSphere
High
Availability
(HA)vSphere
HA运行原理启用HA时,系统会在群集中自动选举一台ESXi
Host作为首选主机(Master), 其余ESXi
Host作为从属主机(Slave)。Master与vCenter
Server进行通信,并监控所有受保护的从属主机状态。Master使用管理网络和数据存储检测信号来确定故障的类型。当ESXi
Host故障时,Master检测到并自动处理故障,让虚拟机重新启动。当Master本身出现故障时,Slave会重新选举产生新的Master。vSphere
HA群集中,主机故障由三种类型:故障:主机停止运行。隔离:主机出现网络隔离。分区:主机失去与首选主机的网络连接。122.2理解HA的工作原理2.
vSphere
High
Availability
(HA)vSphere
HA如何工作?群集中每台ESXi
Host均自行维护运行的VM列表。VM列表存储在共享存储的【vSphere-HA/<FDM集群ID>目录】。当心跳检测到ESXi
Host主机故障时,则依据列表在群集中的其他ESXi
Host启动VM。13142.3
vSphere
HA
heartbeats2.
vSphere
High
Availability
(HA)心跳检测是用于确保ESXi
Host已启动和运行。如果在配置时间周期内没有接收到心跳,则认为ESXi
Host已关闭。随后,触发HA事件处理机制。在正常运行ESXi
Host上,重新启动无响应ESXi
Host上的VM。vSphere
HA进行心跳检测的两种方式:Network
heartbeat:Master
node定期通过ICMP协议检查Slave
node通过网络是否可以连通。Storage
heartbeat:群集中的每台ESXi
Host都在共享存储上各存储一个空文件。共享存储上的文件由创建文件的ESXi
Host锁定。当该文件未被锁定,则视为该文件对应的ESXi
Host无法访问共享存储。15162.4
VMCP2.
vSphere
High
Availability
(HA)VMCP:Virtual
Machine
Component
Protection,虚拟机存储保护针对VM,提供存储层面常见两种故障的支持。PDL:Permanent
Device
Loss,永久设备丢失PDL是指存储设备出现永久性故障或以管理方式被移除或排除时的情况,预计该设备将来也 不再可用。当存储阵列完全无法访问时,存储阵列将会发送一个SCSI指令到ESXi
Host。ESXi
Host收到指令后,将停止向该存储设备进行IO操作。APD:All
Path
Down,全部路径异常APD则是当存储设备的所有路径都出现故障,但没有迹象表明这是永久性还是暂时性设备丢失时的情况。如果ESXi
Host无法访问存储阵列,且存储阵列也没有发送SCSI指令,则ESXi
Host会将该 存储设备标记为不可用。但是,ESXi
Host将不断尝试向存储设备发送IO指令,直到APD超时。17检测到故障的VMCP工作流程18192.5
Proactive
HA2.
vSphere
High
Availability
(HA)Proactive
HA:主动预防系统故障传统的HA是被动的,只有当服务器故障时,才会把受保护的VM转移到其 他的服务器上去。现在主流服务器厂商提供硬件系统监控和预警功能,使主 动预防成为可能。vSphere
6.5及以后版本,可以通过接口与以下服务器厂商的系统管理工具相集 成,以实现主动预防式HA
(Proactive
HA),例如:Dell
Openmanage、HP Insight
Manager、Cisco
UCS
Manager服务器厂商的系统管理工具会把服务器的一些异常状况向vSphere告警。例如某个散热风扇发生故障,某块硬盘的读写故障率超出正常阈值范围等等。当告警发生时,意味着服务器处于亚健康状态,vSphere就会把这台服务器处于隔 离模式(Quarantine
mode),这意味着该服务器上不会再启动新的虚机,并且
vSphere会尽可能地把该服务器上的虚拟机vMotion到其他服务器上去。20212.6
Admission
control2.
vSphere
High
Availability
(HA)Admission
control:准入控制vSphere
HA使用准入控制确保在主机出现故障时预留足够资源用于恢复。vSphere
HA准入控制的基础是群集保证可故障切换的主机故障数。可通过三种方式来设置主机故障切换容量:群集资源百分比插槽策略专用故障切换主机准入控制对资源使用施加限制,任何可能违反限制的操作都不会被允许。启用准入控制机制后,可能不允许的操作:打开虚拟机电源迁移虚拟机增加虚拟机的CPU或内存预留22vSphere
HA准入控制:/cn/VMware-vSphere/6.7/com.vmware.vsphere.avail.doc/GUID-53F6938C-96E5-4F67-9A6E-479F5A894571.html2.
vSphere
High
Availability
(HA)232.6
Admission
control243.1了解FT3.
vSphere
Fault
Tolerance
(FT)vSphere
Fault
Tolerance
(FT)是提高关键VMs可用性的技术,旨在实现VMs零宕机(a
zero-downtime
technology)。vSphere
FT的工作原理:在两台ESXi
Host上连续复制同一个VM的状态:the
primary
VM,主VMthe
secondary
VM,辅助VM由于辅助虚拟机与主虚拟机的执行方式相同,并且辅助虚拟机可以无中断地 接管任何状态下的执行,因此可以提供容错保护。如果运行主虚拟机的ESXi
Host发生故障,将会执行透明故障切换,立即启用辅助虚拟机以替换主虚拟机。同时创建新的辅助虚拟机,自动重新建立FT冗余。如果运行辅助虚拟机的ESXi
Host发生故障,在立即在新的ESXi
Host上创建故障 主机上的辅助虚拟机,实现FT冗余。253.1了解FT3.
vSphere
Fault
Tolerance
(FT)vSphere
FT的功能限制:每个VM只能够具有最多8
vCPU。每台ESXi
Host上最多支持4个辅助虚拟机。使用FT的ESXi
Host必须使用相同系列的CPU、配置EVC。使用FT的ESXi
Host必须使用10Gbps的网络,推荐使用专网。启用FT的虚拟机不支持下面的vSphere高级功能:Storage
vMotionLinked
clonesVMCPVirtual
volume
datastoresStorage-based
policy
managementSnapshots26273.2实现FT3.
vSphere
Fault
Tolerance
(FT)vSphere
FT的启用非常简单,但是必须基于单台VM进行配置。283.3
FT-enabled
VM的操作3.
vSphere
Fault
Tolerance
(FT)VM启用FT后,增加的与FT相关的操作有:关闭:Turn
Off
Fault
Tolerance将删除辅助虚拟机及其配置以及所有历史记录。恢复:Suspend
Fault
Tolerance挂起:Resume
Fault
Tolerance迁移辅助虚拟机:Migrate
Secondary在为主要虚拟机打开vSphere
Fault
Tolerance之后,可以迁移其关联的辅助虚拟机。测试故障恢复:Test
Failover可以通过诱发所选主要虚拟机的故障切换来测试容错保护。测试重新启动辅助虚拟机:Test
Restart
Secondary可以通过诱发辅助虚拟机发生故障以测试为所选主要虚拟机提供的容错保护。293.4
FT对性能的影响3.
vSphere
Fault
Tolerance
(FT)FT使虚拟机和应用程序的停机时间为零,但虚拟机的性能会受到影响。受FT保护的VM的性能会降低。每个CPU指令、内存更改或存储I/O都需要复制到辅助VM。根据工作负载,FT还可能生成大量网络流量。30VMware
vSphere
6
Fault
Tolerance
Architecture
and
Performancehttps:///files/pdf/techpaper/VMware-vSphere6-FT-arch-perf.pdf3.
vSphere
Fault
Tolerance
(FT)313.4
FT对性能的影响324.1数据库业务的高可用4.
Virtual
machine
clustering需求:某数据库业务使用MS
SQL
Server,由3台服务器实现集群服务。数据库服务器使用VM实现(配置:16
vCPU、128G
RAM、2
*
1GbE)需要实现数据库业务的高可用。HA切换时中断数据不同步FT配置比较高性能有下降Cluster由业务系统实现高可用334.2
Clustering
VMs4.
Virtual
machine
clusteringClustering
VMs:对虚拟机进行聚类,虚拟机集群化将多个虚拟机组织在一起,形成一个具有特定特性和功能的集群。通过聚类来提高虚拟机的可靠性和可扩展性,实现业务高可用。具体的集群实现由操作系统和应用程序本身实现,和vSphere无关。vSphere能够支持Clustering
VMs的部署模式vSphere将多个系统和应用作为一个单一的逻辑单元来管理。vSphere支持三种模式的集群实现:Cluster-in-a-Box:VMs在同一ESXi
Host实现集群。Cluster-out-of-the-Box:VMs在多台ESXi
Host实现集群。VM
and
physical
server
clustering:推荐方案集群内的一个节点在物理服务器上运行。集群内的另一节点作为VM在ESXi
Host上运行。34vSphere支持Clustering
VMs的部署模式354.2
Clustering
VMs4.
Virtual
machine
clusteringvSphere提供的Clustering
VMs集群支持技术:SCSI
bus
sharing
for
virtual
disks
on
VMFS
volume:多个VMs可以同时访问同一个虚拟磁盘。SCSI
bus
sharing
for
RDM
devices:VM不使用VMFS磁盘,直接映射Raw虚拟机格式。Multi-writer
flag
on
the
virtual
disk:多个VMs可以读写同一个虚拟磁盘。In-guest
iSCSI:VM不使用VMFS磁盘,使用映射的iSCSI存储.364.3
RDM4.
Virtual
machine
clusteringRDM:Raw
Device
Mapping,原始设备映射,直通式磁盘RDM允许一个虚拟机直接访问SAN中的一个存储LUN(Logical
Unit Number)。RDM磁盘实现虚拟机直接使用存储中的LUN,而不经过虚拟化层。使用RDM,VMkernel不会对LUN进行格式化,而由虚拟机客户操作系统对LUN执行格式化。在存储效率和IO性能上,RDM比创建的虚拟磁盘具有更好的表现。RDM通常使用在高IO的VM上,例如:Oracle、SQL
Server等RDBMS用于视频点播或文件共享的大容量共享文件服务Docker或者K8S集群服务将RDM磁盘添加到虚拟机/cn/VMware-vSphere/6.7/com.vmware.vsphere.vm_admin.doc/GUID-4236E44E-E11F-4EDD-8CC0-12BA664BB811.html4.
Virtual
machine
clustering374.3RDM38RDM的工作流程39ConfiguringSQL
Server
Always
OnFailover
Cluster
InstancesUsing
RDM
On
vSphere什么是Always
On可用性组件:/zh-cn/sql/database-engine/availability-groups/windows/overview-of-always-on-availability-groups-sql-server?redirectedfrom=MSDN&view=sql-server-ver15部署指南:/configuring-sql-server-always-on-failover-cluster-instances-using-rdm-on-vsphere-7/何为Always
On:/dba_huangzj/article/details/54015470Getting
Started
with
Always
On
Availability
Groups:/en-us/sql/database-engine/availability-groups/windows/getting-started-with-always-on-availability-groups-sql-server?view=sql-server-ver15405.1
VMware
BC-related
solutions5.
VMware
Solutions从传统业务向虚拟化迁移的最大驱动力是:业务连续性、业务高可用。虚拟化有助于服务器整合资源、利旧等,实现降低IT成本的目标。虚拟化更有助于提高可用性、业务弹性和故障恢复效率。影响业务连续性和高可用的因素有两个方面:非计划事件:服务器故障等计划事件:服务器维护等VMware提供了整体的解决方案来提升可用性。VMware
BC-related
solutions:BC:关键业务与服务,business-critical
applications
and
services方案具有简单易用、经济高效、部署灵活。415.1
VMware
BC-related
solutions5.
VMware
SolutionsVMware
BC-related
solutions:本地可用:Localavailability数据保护:Data
protection灾难恢复:Disaster
recovery:灾难避免:Disaster
avoidancevSphere
HA,vSphere
FT,vMotion…Clone,Snap,Backup…vSphere
Replication,VMware
SRMvSphere
Metro
Storage
Cluster(vMSC)425.2
VMware
Site
Recovery
Manager
(SRM)5.
VMware
SolutionsVMware
Site
Recovery
Manager:
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2026年保育师四级(中级)资格考试理论知识全真模拟考试卷及答案(六)
- 2026中国智能照明控制系统市场分析及投资价值研究报告
- 2026周边游市场开发潜力与消费体验提升分析报告
- 2026超高清视频产业市场生态分析及内容需求与技术投资趋势报告
- 2026猪皮胶原蛋白提取市场前景调研及技术研发难点与创新应用报告
- 2026重庆磁器口旅游市场现状古镇保护与发展投资评估规划分析研究报告
- 2026中南工业机器人末端执行器领域竞争态势发展现状技术升级投资图景
- 2026中国智能智能物流跟踪系统行业市场规模现状分析及未来趋势评估报告
- 2026中国数字孪生技术行业渗透与平台建设报告
- 2026咨询咨询咨询咨询服务劳动劳动劳动劳动劳动劳动劳动咨询服务服务服务服务服务服务服务就业
- 2026年中考语文真题文言文汇编56份(分师生版)
- 江苏银行2027届校园招聘笔试参考题库及答案详解
- 中央空调工艺考核制度
- 江西省职业技能等级认定个人申报表、承诺书、职业技能等级认定档案材料清单
- 健身房会员合同样本
- DB13∕T 6056-2025 涉路工程技术评价规范
- 板框压滤机工艺培训
- 2025年法务专业知识试题及答案
- 构造地质学看图题与答案
- 02章 电催化过程
- 模块3 项目论证与评估《现代项目管理》教学课件
评论
0/150
提交评论