View a markdown version of this page

検出 - でのワークロードのディザスタリカバリ AWS: クラウドでのリカバリ

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

検出

ワークロードが提供すべきビジネス成果を達成していないことをできるだけ早く知ることが重要です。これにより、災害を迅速に宣言し、インシデントから復旧できます。積極的な復旧目標の場合、復旧目標を達成するには、この応答時間と適切な情報を組み合わせることが重要です。目標復旧時間が 1 時間の場合は、インシデントの検出、適切な担当者への通知、エスカレーションプロセスの関与、予定復旧時間に関する情報の評価 (DR 計画を実行せずに)、災害の宣言、1 時間以内の復旧を行う必要があります。

注記

RTO がリスクにさらされているにもかかわらず、利害関係者が DR を呼び出さないことにした場合は、DR 計画と目標を再評価します。DR 計画を呼び出さない決定は、計画が不十分であるか、実行に自信がないためである可能性があります。

インシデントの検出、通知、エスカレーション、発見、宣言を計画と目標に組み込み、ビジネス価値を提供する現実的で達成可能な目標を提供することが重要です。

AWS は、サービスの可用性に関するup-to-the-minute Service Health Dashboard に公開します。いつでも をチェックして現在のステータス情報を取得するか、RSS フィードをサブスクライブして、個々のサービスの中断を通知します。Service Health Dashboard に表示されていないサービスのいずれかで、リアルタイムの運用上の問題が発生した場合は、サポートリクエストを作成できます。

AWS Health Dashboard は、アカウントに影響を与える可能性のある AWS Health イベントに関する情報を提供します。情報は 2 つの方法で表示されます。ダッシュボードには、最近のイベントおよび予定されているイベントがカテゴリ別に分類されて表示されます。詳細なイベントログには、過去 90 日間のすべてのイベントが表示されます。

最も厳しい RTO 要件については、ヘルスチェックに基づいて自動フェイルオーバーを実装できます。ユーザーエクスペリエンスを表し、主要パフォーマンス指標に基づいてヘルスチェックを設計します。ディープヘルスチェックは、ワークロードの主要な機能を実行し、浅いハートビートチェックを超えています。複数のシグナルに基づいてディープヘルスチェックを使用します。このアプローチでは、誤アラームをトリガーしないように注意してください。不要な場合にフェイルオーバーすると、可用性のリスクが生じるためです。