View a markdown version of this page

Alarme werden aufgenommen CloudWatch - AWS-Benutzerhandbuch zur Erkennung und Reaktion von Vorfällen

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Alarme werden aufgenommen CloudWatch

AWS Incident Detection and Response kann CloudWatch Amazon-Alarme aufnehmen, um Ihre kritischen Workloads proaktiv zu überwachen. Durch die Aufnahme Ihrer CloudWatch Amazon-Alarme zur Überwachung kann AWS Incident Detection and Response:

  • Erkennt automatisch, wenn Ihre Alarme in den Status „Alarm“ übergehen.

  • Binden Sie Ihre Teams ein, um gemeinsam auf Vorfälle zu reagieren und diese zu lösen.

Um sicherzustellen, dass die Alarme, die Sie an Bord nehmen, wirksam sind, empfiehlt AWS Incident Detection and Response die folgenden bewährten Methoden:

  • Konfigurieren Sie Alarme mit metrischen mathematischen Ausdrücken, um sie bei regelmäßigen Wartungsarbeiten oder bei der Ausführung von Batch-Jobs zu unterdrücken und Fehlalarme zu vermeiden.

  • Stellen Sie die Behandlung fehlender Daten für Alarme auf der Grundlage der erwarteten Häufigkeit der Datenpunktübermittlung ein. Beispielsweise sollten Alarme zur Überwachung von Messwerten, die einen kontinuierlichen Strom von Datenpunkten generieren, fehlende Daten als „Sicherheitsverletzung“ (schlecht) behandeln, da fehlende Datenpunkte auf ein Problem mit der überwachten zugrunde liegenden Ressource hinweisen könnten. Umgekehrt sollten Alarme zur Überwachung von Metriken, die selten Datenpunkte melden, z. B. Alarme, die Metriken überwachen, die Datenpunkte nur aufzeichnen, wenn ein Ausfall oder ein Fehler auftritt, fehlende Daten als (gut) behandeln. NotBreaching

  • Definieren Sie Alarme, die in den Status „Alarm“ übergehen, wenn es kritische, anhaltende Auswirkungen auf Ihre Arbeitslast gibt. Konfigurieren Sie beispielsweise Alarme so, dass sie nach der erwarteten Zeit ausgelöst werden, die für den automatischen Austausch fehlerhafter Ressourcen erforderlich ist, und nicht erst nach der ersten Erkennung fehlerhafter Ressourcen.

  • Identifizieren und erstellen Sie Alarme für benutzerdefinierte Kennzahlen, die direkt das Kundenerlebnis in Bezug auf Ihre Arbeitslast widerspiegeln.

Eine Liste der empfohlenen CloudWatch Amazon-Alarme für allgemeine AWS-Services Zwecke finden Sie in den Best Practices für die Erkennung und Reaktion auf Alarme bei Vorfällen auf AWS re:POST.