虚拟化在灾难恢复和业务连续性方面的具体应用(三):「英方周末」第二十期

时间:2016-09-19

导语:HA高可用与FT容错是虚拟化基础设施保障业务连续性的核心技术。本文以VMware vSphere为实操对象,讲解vSphere HA与FT容错功能概念、配置步骤、关键参数与前置约束,帮助理解虚拟化环境下灾难恢复的落地实践。

HA&FT 高可用与容错

虚拟化环境HA与FT基础概念

基础设施可用性策略的核心要素为HA(高可用性)。HA常见应用于防火墙、路由器、负载均衡等网络设备,架构上设置主设备+同配置冗余备机,主设备故障时备机接管业务。这套思想同样可以迁移到虚拟化平台,多台宿主机组成集群,一台作为主节点,其余作为冗余故障恢复节点。

FT(容错)是VMware虚拟化平台特有技术,提供另一种虚拟机冗余与高可用实现方式。本篇实操演示在VMware vSphere中配置高可用性HA与容错FT。

vSphere5 HA工作机制

vSphere5的HA本质是虚拟机“故障恢复+重启”机制。当启用HA的ESXi宿主机故障,集群会将受影响虚拟机在其他健康HA主机上重新启动。集群内一台ESXi作为主服务器,维护从主机心跳、缓存集群配置,并向vCenter上报HA集群运行状态。

vSphere HA集群配置步骤

步骤1:右键现有集群,选择「编辑设置」,勾选开启vSphere HA。

步骤2:基础集群选项配置

  • 启用主机监控:建立主机之间心跳检测,感知主机不可用;强烈建议开启,若无其他监控工具则必须勾选。
  • 允许控制:防止资源耗尽时虚拟机盲目上电,建议所有HA集群开启。
  • 允许控制策略:配置故障容忍规则,可设置最大故障主机数、预留CPU备份占比、故障待迁移虚拟机数量。

步骤3:虚拟机选项配置(支持全局/单虚拟机覆盖)

  • 虚拟机重启优先级:主机故障后虚拟机启动恢复次序,单台虚拟机设置优先级可覆盖集群全局。
  • 主机隔离响应:宿主机管理网络断开但系统仍运行时的处置策略,可选通电、硬断电、优雅关闭操作系统;优先选择通电或OS优雅关机,降低数据损坏风险。

步骤4:虚拟机监控参数

借助VMware工具实现虚拟机内部心跳监控,建议开启虚拟机与应用监控,可设置监控灵敏度:低(120s)、中(60s)、高(30s),也支持自定义参数:

  • 故障间隔:丢失心跳后判定虚拟机故障的秒数
  • 最小开机时间:虚拟机启动完成后才开始故障检测的等待时长
  • 每个虚拟机重置的最大值:故障后允许重置的最大次数
  • 最大重置时间窗口:重置计数的统计时间周期(小时)

步骤5:数据库心跳设置

管理网络发生故障时,依靠vCenter数据库对象维持集群心跳;推荐选择监控全部集群数据库。

步骤6:确认全部配置,点击OK保存。

vSphere FT 容错功能介绍与启用

FT技术源自VMware工作站记录‑重放机制,为虚拟机生成一台同步副本,主虚拟机出现故障,副本立刻无缝接管业务。

FT启用前置条件:

  • 开启主机证书检查
  • 集群已经启用vSphere HA
  • 每台ESX/ESXi主机配置虚拟网卡,开启FT日志
  • CPU硬件需要兼容FT特性
  • 待开启FT的虚拟机不能存在快照

虚拟机开启FT操作:右键目标虚拟机 → 容错 → 打开容错;确认警告提示,平台自动准备并启用容错。开启成功后虚拟机图标变更,FT运行状态可在虚拟机概览面板查看。

下期预告:虚拟化平台不止VMware,下一期将实践演示Microsoft Hyper‑V、Citrix XenServer平台下高可用与容错配置。

及时响应,快速服务,为您保驾续航

立即注册

请先完成图形验证

验  证  码:

英方官网验证码
第三方二维码 第三方二维码
英方公告铃铛图标
英方公告铃铛图标

公告

英方侧边栏向右箭头
英方高亮提示圆点
英方软件公告
各位求职者、合作伙伴:
近期有第三方冒用英方名义发布虚假招聘、不实业务信息。我司正规招聘全程零收费,非官网渠道信息均不作数。
信息核验热线:400-0078-655
遇诈骗请保留证据,及时联系我们并报警
英方软件
2026 年 6 月 23 日
英方邮件咨询图标
英方邮件咨询图标

邮件

英方销售支持图标
英方销售支持图标

销售

英方侧边栏向右箭头
联系销售:400-0078-655 转 1