本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
检测
请务必尽快了解您的工作负载并未实现应有的业务成果。通过这种方式,您可以快速宣布灾难并从事件中恢复。对于积极的恢复目标,这种响应时间加上适当的信息对于实现恢复目标至关重要。如果您的恢复时间目标为一小时,则需要检测事件,通知相关人员,参与上报流程,评估有关预计恢复时间的信息(如果有的话)(不执行灾难恢复计划),宣布灾难并在一小时内恢复。
注意
如果利益相关者决定不调用 DR,即使 RTO 会面临风险,请重新评估灾难恢复计划和目标。之所以决定不援引灾难恢复计划,可能是因为计划不够充分,或者对执行缺乏信心。
至关重要的是,要将事件检测、通知、上报、发现和申报纳入您的计划和目标,以提供具有商业价值的切合实际、可实现的目标。
AWS 在 Service Healt h Dashboard 上发布了我们最多的服务
AWS Health Dashboard
对于最严格的 RTO 要求,您可以根据运行状况检查实现自动故障转移。