如何使用查询在 SQL Server 中备份数据库
2026-07-24
2026-07-24
2026-07-24
2026-07-24
VMware SRM 自动化 VMware 站点之间的灾难恢复故障切换,但其架构和许可在 Broadcom 收购后已发生变化。本文深入解析 SRM 是什么、其工作流程如何实际运行,以及确保恢复计划可靠性的最佳实践。
VMware Site Recovery Manager (SRM),现称为 VMware Live Site Recovery,常被误认为是一个复制产品。
实际上,VMware SRM 本身并不复制虚拟机。它通过协调底层的复制技术来编排灾难恢复,自动化故障切换和故障恢复,并在VMware 环境中执行预定义的恢复计划。
本指南说明其架构如何组合、故障切换期间会发生什么,以及保持恢复操作可预测和可靠的最佳实践。
VMware Site Recovery Manager (SRM),现称为 VMware Live Site Recovery (VLSR),是 VMware 的灾难恢复编排平台。它自动化受保护 VMware 站点之间的故障切换、故障恢复和恢复测试。

SRM 本身并不复制 VM 数据。它使用底层的复制技术协调恢复过程,将手动操作手册转变为可预测的自动化工作流。
理解 SRM 最简单的方法是将编排与复制分开。SRM 是编排层,而 vSphere Replication 或基于存储阵列的复制负责站点间的数据传输。SRM 从不直接复制 VM 数据。相反,当恢复计划运行时,它会按正确顺序注册、配置并启动已复制的虚拟机 (VM)。
自 Broadcom 收购 VMware 以来,SRM 的新名称现在是 VMware Live Recovery 产品组合中的 VMware Live Site Recovery。大多数系统管理员、技术文档和社区讨论仍称其为 SRM,因此您会看到这两个名称被互换使用。
VMware Live Site Recovery 提供了一组功能,可简化和自动化灾难恢复管理。管理员无需依赖手动操作手册,而是可以直接从 vCenter 定义、测试和执行恢复计划。
这降低了运维复杂性,并有助于在计划内迁移或非计划中断期间实现更一致的恢复过程。
SRM 的核心能力之一是自动化恢复编排。管理员可以精确定义恢复应用堆栈的确切顺序和条件,而不是一次性启动所有虚拟机。
SRM 允许管理员在不中断生产工作负载的情况下验证恢复计划。
在测试期间,平台使用复制数据在恢复站点创建一个隔离的测试环境,使团队能够验证应用启动、网络连接和恢复工作流,而不会影响生产工作负载。
SRM 直接与 vCenter Server 集成,为管理灾难恢复操作提供了一个集中界面。
管理员可以从单个控制台配置保护组、清单映射和恢复计划,同时监控本地环境或 VMware Cloud on AWS 部署中的复制状态和恢复就绪状况。
这提供了对整个环境中复制状态和 DR 就绪状况的全面可见性。
理解 SRM 的工作方式需要同时审视其架构和恢复工作流。该平台使用配对站点架构,连接受保护站点和恢复站点以协调灾难恢复操作。
典型的 SRM 部署在受保护(主)站点和恢复(辅助)站点各包含一个 vCenter Server 和一个 SRM 设备。这些组件被安全地配对,使它们能够交换配置信息、恢复元数据和健康状态,从而协调恢复操作。

SRM 本身并不复制虚拟机数据。相反,它依赖于底层的复制技术来保持站点间工作负载的同步。管理员通常选择以下两种复制方法之一:
| 功能 | vSphere Replication | 基于阵列的复制 |
|---|---|---|
| 粒度 | 按 VM | 数据存储或 LUN 级别 |
| 所需硬件 | 适用于任何受支持的 vSphere 存储 | 两端需要兼容的存储阵列 |
| 复制类型 | 异步 | 同步或异步 |
| 恢复点目标 (RPO) | 5 分钟到 24 小时 | 接近零(同步)或供应商定义的异步 RPO |
| 集成方式 | 原生 vSphere 功能 | 存储复制适配器 (SRA) |
SRM 将灾难恢复配置组织为三个逻辑对象。
清单映射
清单映射定义了受保护站点的资源如何对应恢复站点的资源,包括网络、文件夹、集群、资源池和占位数据存储。
保护组
保护组确定哪些虚拟机被共同保护和恢复。根据复制方法的不同,它们可以代表复制的数据存储或单个虚拟机。
恢复计划
恢复计划通过将多个保护组与启动优先级、脚本、网络映射和恢复设置相结合来编排恢复过程。
当执行恢复计划时,SRM 执行以下顺序:
VMware SRM 的恢复生命周期遵循一个可重复的步骤序列。
管理员首先配对受保护站点和恢复站点,然后配置保护组和恢复计划。
通过恢复测试验证配置后,可以在需要时执行故障切换,并为未来的故障恢复重新保护环境。

成功实施 VMware SRM 需要的不仅仅是配置复制和恢复计划。定期测试、一致的配置和谨慎的基础设施管理都是确保在实际中断期间恢复操作按预期工作的关键。
SRM 是编排层,而非复制引擎。其实际的 RTO 和 RPO 完全取决于底层复制数据的机制——无论是 vSphere Replication 还是存储阵列的 SRA。
这两种选项都有其限制。vSphere Replication 是异步复制,RPO 下限为 5 分钟,且仅支持 VMware 到 VMware。基于阵列的复制需要两端匹配的 SRA(这是上述最佳实践中较常见的故障点之一),并将恢复绑定到特定存储供应商。后期切换存储平台意味着需要从头重建复制层。
这就是像 i2Availability 这样的存储无关复制工具可以作为 SRM 编排工作流底层替代层的地方。
请注意,i2Availability 自身的故障切换机制——心跳检测和主备服务器之间的自动切换——是为每个应用或每个数据库的持续性高可用性而设计的。
这与 SRM 的使用场景不同,SRM 编排的是计划内的站点级恢复,涉及大量 VM,而非检测故障并自动切换。与 SRM 的重叠点具体在复制层。
对于同时处理持续数据保护或数据库特定复制需求的团队,i2CDP 和 i2Stream 分别应对相邻场景:持续时间点保护和数据库/大数据复制。上述存储无关的角度是与 SRM 架构最直接相关的方面。
如果 SRA 兼容性或复制粒度在您的环境中经常成为限制因素,那么像 i2Availability 这样的存储无关复制层值得针对架构中的该部分进行评估。
问 1:VMware SRM 现在还叫这个名字吗?
Broadcom 已正式将该产品更名为 VMware Live Site Recovery (VLSR),归属于 VMware Live Recovery 产品组合。
但“SRM”作为业界标准名称已使用超过十年,因此大多数管理员、存储合作伙伴和文档仍称其为 SRM。
问 2:两端都需要 vCenter 吗?
是的。SRM 使用双 vCenter 架构。每个站点——受保护站点和恢复站点——都需要自己的 vCenter Server 和恢复设备。
这两个 vCenter 实例保持配对,以同步元数据、资源映射和配置详细信息。
问 3:VMware SRM 可以做故障恢复吗?
可以,通过一个称为 reprotect(重新保护)的流程。当主站点恢复且正常运行后,您从恢复计划中运行 reprotect。
这会反转复制方向,将变更同步回主站点,然后将工作负载在其原始位置启动。
问 4:VMware SRM 随 vSphere 免费提供吗?
不是。它是一个独立产品,有自己的订阅或许可证,通常按 VM 销售或作为更大的 VMware SDDC 套件的一部分销售。
SRM 处理的是编排,而非复制。理解这一区别后,其架构的其余部分——从保护组到恢复计划在故障切换期间的实际执行方式——就更容易理解了。
这里涵盖的最佳实践,从优先级组到 SRA 兼容性检查,归结为一件事:确保编排层和其下的复制层配置为能够可靠地协同工作。
如果 SRA 兼容性或复制粒度在您的环境中反复成为限制因素,那么像 英方软件 的 i2Availability 这样的存储无关复制层值得针对架构中的该部分进行评估。
公告
邮件
销售