一家南美电力运营公司在规划混合云容灾时,提出了一个很具体的要求:业务恢复到华为云后,原 IP 地址不能改变。
听上去,这只是一个网络配置问题。但随着项目团队继续梳理业务环境,这个要求背后的真正难题逐渐显现出来。
这家企业长期在本地 VMware 数据中心运行 ERP、业务应用、身份认证、文档管理和文件服务等多套关键系统。经过多年演进,应用与数据库之间、业务系统与认证服务之间,已经形成了复杂而稳定的依赖关系。IP 地址也早已不只是一个网络参数。它可能存在于数据库连接、防火墙白名单、身份认证、文件共享路径、DNS 解析和上下游系统调用中。一旦恢复后的 IP 发生变化,需要调整的就不只是网络配置,而是一整套业务连接关系。
这意味着,即使虚拟机已经在云端启动,业务也未必真正恢复。
一个 IP 要求,暴露了混合云容灾真正的复杂度
对于电力企业而言,灾难恢复窗口通常十分有限。故障发生后,临时修改的配置越多,恢复时间越难控制;业务依赖越复杂,人工排查带来的不确定性也越大。因此,客户真正希望保留的,并不是某一个 IP 地址,而是原有业务环境的网络身份和连接方式。
问题也随之发生变化:如何让计算、存储、网络和多个业务系统,按照正确方式在云端重新组成一套可运行的业务环境?
这也是很多混合云容灾项目容易被低估的地方。数据复制成功、虚拟机能够启动,只能证明基础设施具备恢复条件。对于复杂业务,数据库、身份认证、ERP、文件服务和应用系统还必须按照依赖关系恢复。
真正需要恢复的,不是一组虚拟机,而是一整套业务运行环境。
先设计恢复,再执行恢复
项目首先梳理每台 VMware 工作负载的恢复策略,包括:
·目标可用区和云主机规格;
·恢复磁盘和存储参数;
·VPC、子网和安全组;
·网络及原 IP 恢复策略;
·跨平台启动和驱动适配要求。
生产数据持续同步至华为云 OBS。平时无需为每台生产主机长期运行一台备用云主机。在主机恢复策略之上,项目进一步定义业务系统的恢复顺序。数据库、身份认证等基础服务优先恢复,ERP 和业务应用在前置服务可用后再启动;不存在依赖关系的系统,则并行恢复。
以上策略均可在 HyperBDR 工作台进行预配置,无需登录云平台。
这样,恢复当天需要执行的关键动作都被提前固化。故障发生后,运维团队不需要再临时判断“先恢复什么、后恢复什么”,也无需现场重新配置云端资源。
两层智能编排,让基础设施和业务一起恢复
恢复启动后,HyperBDR 执行两层自动化编排。
第一层是主机恢复编排。
HyperBDR 通过 Boot-in-Cloud 调用华为云原生 API,按预设策略创建或关联计算、存储和网络资源,将 OBS 中的数据恢复至云端磁盘,并完成 VMware 到华为云环境之间的驱动、启动方式和网络配置适配。原 IP 也在这一过程中自动应用。因此,Boot-in-Cloud 并不是简单地启动一台云主机,而是完成从数据副本到可运行云主机的完整恢复过程。
第二层是业务恢复编排。
主机恢复完成后,HyperBDR Orchestration 按照预设依赖关系继续调度业务恢复。数据库、身份认证等基础服务先启动,ERP 和业务应用随后恢复;无依赖系统则并行执行,以缩短整体恢复时间。两层能力解决的是两个不同问题:
Boot-in-Cloud 让主机在目标云正确运行,Orchestration 让多个系统按照正确关系恢复业务。
两者结合后,云资源准备、主机启动和业务恢复顺序被纳入同一条自动化链路。
通过演练,把恢复预案变成经过验证的能力
恢复策略能够配置,并不意味着真正发生灾难时一定可以成功执行。生产环境会持续变化。业务可能增加新的依赖,安全策略可能调整,应用启动方式也可能改变。因此,这家企业在正式投入运行前,通过隔离环境反复开展恢复演练。
每次演练都会完整执行主机恢复和业务恢复流程,验证云端资源能否正确创建、驱动和启动配置是否适配、原 IP 是否生效,以及数据库、认证和业务系统能否按顺序恢复。演练结束后,团队再根据结果调整资源规格、恢复顺序、网络策略和等待时间。
最终,企业得到的不再是一份写在文档里的恢复预案,而是一条已经被多次执行、验证和调优过的恢复路径。
最终降低的,是恢复的不确定性
通过 HyperBDR,该企业将约 10 台关键业务主机和 40 TB 数据纳入华为云混合云容灾保护。项目帮助关键业务实现 RTO 小于 10 分钟、RPO 小于 5 分钟。同时,通过对象存储保存灾备数据、恢复时按需创建计算资源,整体灾备成本降低 60% 以上。
但这组数字并不是项目最值得关注的部分。更重要的是,HyperBDR的自动化编排设计让恢复过程更可控:
·云端资源如何创建,提前定义;
·主机如何跨平台启动,自动完成;
·业务按照什么顺序恢复,提前编排;
·整条恢复路径能否工作,经过演练验证。
“恢复后原 IP 不能变”,最初只是一个具体要求。但它最终推动企业重新定义了混合云容灾的边界:真正可靠的容灾,不只是把数据复制到云端,也不只是让虚拟机重新启动,而是让基础设施、网络身份和业务依赖按照既定策略重新运行。
从策略设计,到自动执行,再到持续验证,HyperBDR 将复杂的混合云恢复过程转化为一套可执行、可验证、可持续优化的业务恢复能力。
























