Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Unified Operations Erste Schritte: Integrieren Sie kritische Alarme für ein schnelles Vorfallmanagement
Damit Sie schnell über kritische Vorfälle informiert werden können, führen Sie die folgenden Schritte aus, um Ihre Alarme in AWS Incident Detection and Response zu integrieren
Definieren und konfigurieren Sie Ihre kritischen Alarme für ein schnelles Vorfallmanagement. Ausführliche Informationen finden Sie unter Definieren und Konfigurieren von Alarmen in Incident Detection and Response im Benutzerhandbuch zur Erkennung und Reaktion von Vorfällen.
-
Anweisungen zum Einrichten von Alarmen mit Amazon CloudWatch finden Sie unter Definieren und Konfigurieren von Alarmen in Incident Detection and Response im Benutzerhandbuch zur Erkennung und Reaktion von Vorfällen. AWS Empfehlungen zu verschiedenen AWS-Services Arten kritischer Alarme finden Sie unter Incident Detection and Response (IDR)
. Wenden Sie sich an Ihr AWS Unified Operations Team AWS , wenn Sie die Erstellung kritischer AWS Alarme für Ihre markierten AWS Ressourcen automatisieren möchten. -
Informationen zum Umleiten oder Aufnehmen kritischer Alarme von APM-Tools von Drittanbietern mit direkter EventBridge Amazon-Integration
, wie z. B. usw. DataDog NewRelic, finden Sie EventBridge im Benutzerhandbuch zur Erkennung und Reaktion von AWS Vorfällen unter Erfassung von Alarmen von APMs, die eine direkte Integration mit Amazon haben. Sie müssen eine Reihe von AWS Ressourcen (AWS Lambda und Amazon EventBridge Event Bus-Regeln) bereitstellen, um Ihren Alarm (Ereignis) umzuwandeln und an AWS Incident Detection and Response weiterzuleiten. Ihr AWS Unified Operations Team kann Ihnen bei der Bereitstellung der CloudFormation Vorlage für die Installation dieser Ressourcen behilflich sein. -
Leiten Sie kritische Alarme von Ihrem benutzerdefinierten Überwachungstool über ein APM-Tool eines Drittanbieters, das nicht direkt mit Amazon integriert ist, um oder nehmen Sie sie auf. EventBridge Weitere Informationen finden Sie unter Verwenden von Webhooks zur Erfassung von Alarmen von APMs ohne direkte Integration mit Amazon EventBridge im Benutzerhandbuch zur Erkennung und Reaktion von AWS Vorfällen. Sie müssen eine Reihe von AWS Ressourcen ( AWS Lambda API-Gateway-Funktionen und EventBridge Amazon-Event-Bus-Regeln) bereitstellen, um Ihren Alarm (Ereignis) zu transformieren und an AWS Incident Detection and Response weiterzuleiten. Ihr AWS Unified Operations Team kann Ihnen bei der Bereitstellung der CloudFormation Vorlage für die Installation dieser Ressourcen behilflich sein.
-
-
Geben Sie Einzelheiten zur Workload-Architektur, Kontaktinformationen und Runbook-Informationen zu Maßnahmen zur Schadensbegrenzung bei kritischen Alarmen an. Führen Sie dazu die folgenden Schritte aus:
Laden Sie für jeden kritischen Workload oder jede Anwendung den Fragebogen zur Erfassung und Behebung von Arbeitslasten bei AWS Vorfällen herunter und füllen Sie ihn aus. Füllen Sie auch den Fragebogen zur Erfassung von Alarmen für jeden einzelnen Workload herunter und füllen Sie ihn aus.
Die Informationen in diesen Fragebögen helfen dem AWS Team bei der Entwicklung eines Runbooks zur Behebung von Vorfällen. Dieses Runbook ermöglicht es, geeignete Maßnahmen zu ergreifen, um kritische Alarme schnell zu beheben und zu beheben, bevor sie zu Betriebsausfällen führen. Beispiele und Beispielinformationen finden Sie in den Fragebögen zum Workload-Onboarding und zur Erfassung von Alarmen in Incident Detection and Response. AWS
Bieten Sie Zugriff auf Ihre kritischen Alarme in Incident Detection and AWS Response
Nutzen Sie die
AWSServiceRoleForHealth_EventProcessorService-Linked Role (SLR) bei der AWS-Konto Ausführung der kritischen Workloads, die vom AWS Incident-Management-Team überwacht werden müssen. Weitere Informationen finden Sie unter Bereitstellen des Zugriffs für die Erfassung von Warnmeldungen auf AWS Incident Detection and Response.Anmerkung
Um Sie bei der Einführung großer Geräte zu unterstützen AWS-Konten, AWS kann ich Ihnen ein AWS Command Line Interface Skript zur Verfügung stellen, mit dem Sie die Bereitstellung dieser Spiegelreflexkamera beschleunigen können.
(Optional) Wenn sich Ihre Alarme in Amazon befinden CloudWatch, stellen Sie sicher, dass der AWS Identity and Access Management Benutzer oder die Rolle, die für die Alarmtests (vor der Inbetriebnahme) verwendet wird, über die
cloudwatch:SetAlarmStateIAM-Berechtigung in Ihrem Unternehmen verfügt AWS-Konto , das bzw. die die kritische Arbeitslast ausführt. Dies ist für Alarmtests (am Spieltag) nach dem Onboarding erforderlich. Weitere Informationen findest du unter Testen integrierter Workloads in AWS Incident Detection and Response.
Erstellen Sie einen AWS Support Fall, um einen Workload für ein schnelles Incident-Management zu abonnieren. Beachten Sie, dass Ihr AWS-Konto System automatisch für das schnelle Incident-Management bei eingehenden Anfragen aktiviert ist. Das bedeutet, dass Sie einen Fall über die Support Center-Konsole, das oder das AWS SDK in die Warteschlange für Unified Operations Incident Detection and Response stellen können AWS Command Line Interface, um schnell reagieren zu können. AWS Um Vorfälle mit einem ausgehenden AWS Support Fall proaktiv zu überwachen und zu erstellen, erstellen Sie einen AWS Support Fall für Ihre kritische Workload. Führen Sie dazu die folgenden Schritte aus:
Melden Sie sich bei der an AWS Support Center Console
, wählen Sie Fall erstellen und dann Technischer Support aus. Wählen Sie unter Service die Option Incident Detection and Response aus.
Wählen Sie als Kategorie die Option Neuen Workload einbinden aus.
Wählen Sie für Schweregrad die Option Allgemeine Hinweise aus.
Die Fragebögen zur Arbeitslast und zum Alarm, die Sie im vorherigen Schritt ausgefüllt haben, sind beigefügt.