View a markdown version of this page

Einen Test konfigurieren - AWS Resilience Hub

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Einen Test konfigurieren

Wenn Sie einen Test anhand einer Vorlage erstellen, konfigurieren Sie die folgenden Einstellungen. Die Einstellungen werden gespeichert und für zukünftige Testläufe wiederverwendet — Sie können sie jederzeit bearbeiten.

Dauer des Tests

Die Dauer der Ausführung der Testaktionen. Für Wiederherstellungstests (Availability Zone: Wiederherstellung und Multi-Region: Wiederherstellung) ist die Standarddauer Ihr RTO plus 30 Minuten, sodass Ihr Service Zeit hat, sich zu erholen und zu bestätigen, dass er aufrechterhalten wird. Bei Dauertests beträgt die Standardeinstellung 30 Minuten für die Überprüfung der Abhängigkeit oder 3 Stunden für Multi-Region: Isolierung. Diese Standardwerte gelten für die Konsole. Wenn Sie die API verwenden, geben Sie die Dauer explizit an.

Umfang des Fehlers

Definiert, wo Fehler auftreten — die Verfügbarkeitszone oder die Regionen, die beeinträchtigt werden sollen. Jeder Test hat seine eigenen Parameter. Details hierzu finden Sie unter Verfügbare Tests.

Aktionen testen

Read-only. Definiert durch die Testvorlage. Zeigt die Fehleraktionen und ihre Zielressourcentypen an. Wenn keine Ressourcen dem Zieltyp einer Aktion entsprechen, wird diese Aktion übersprungen.

Zu blockierende Abhängigkeiten

Abhängigkeiten, die während des Tests blockiert werden sollen. Wählen Sie eine der erkannten Abhängigkeiten aus (wenn die Abhängigkeitserkennung aktiviert ist) oder geben Sie Abhängigkeiten manuell anhand des DNS-Domänennamens ein. Für einige Tests erforderlich, für andere optional. Standardwerte und Anforderungen finden Sie unterVerfügbare Tests.

Alarme testen

Erfolgsalarme (erforderlich) — CloudWatch Alarme, die bestimmen, ob die Erfolgskriterien bestanden oder nicht bestanden wurden. Mindestens eine Option muss ausgewählt werden. Wenn Sie mehrere auswählen, müssen alle erfolgreich sein, damit der Test bestanden wird. Wählen Sie Alarme, die den allgemeinen Zustand Ihres Dienstes messen.

So besteht der Test:

  • Availability Zone: Recovery — alle Erfolgsmeldungen müssen wieder in den OK Status innerhalb Ihres Multi-AZ RTO zurückkehren und dort bleiben, bis die Testaktionen beendet sind.

  • Multi-Region: Wiederherstellung — alle Erfolgsalarme müssen in Ihren OK Multi-Region RTO-Status zurückkehren und dort bleiben, bis die Testaktionen beendet sind.

  • Überprüfung der Abhängigkeit — alle Erfolgsalarme bleiben in OK ihrem Status, bis die Testaktionen beendet sind.

  • Multi-Region: Isolierung — alle Erfolgsalarme bleiben in ihrem OK Status, bis die Testaktionen beendet sind.

Zusätzliche Alarme (optional) — Nur zur Beobachtbarkeit. Wird in den Ergebnissen und im Bericht angezeigt, hat aber keinen Einfluss auf das Ergebnis „Bestanden“ oder „Nicht bestanden“.

Plan für den Multi-Region Regionswechsel (nur Wiederherstellung, optional)

Wenn Sie einen Regions-Switch-Plan für AWS Application Recovery Controller (ARC) hinzufügen, kann die nächste Generation von Resilience Hub den Failover-Zeitplan in Ihre Testergebnisse und Ihren Bericht aufnehmen. Optional; lassen Sie das Feld leer, wenn Sie manuelles Failover oder eine benutzerdefinierte Automatisierung verwenden.

Zusätzliche Einstellungen (optional)
Bedingungen beenden

CloudWatch Alarme, die den Test automatisch beenden, wenn sie ihren Schwellenwert überschreiten. Verwenden Sie Stoppbedingungen als Leitplanken, um Ihre Workloads während des Tests zu schützen. Erstellen Sie beispielsweise einen CloudWatch Alarm für eine wichtige Geschäftsmetrik (wie Latenz oder Fehlerrate), der den Test stoppt, wenn er einen inakzeptablen Schwellenwert überschreitet. Alarme mit Abbruchbedingungen müssen sich in dem Konto befinden, in dem der Test ausgeführt wird, und in der Region, in der die Fehler gemeldet wurden. Weitere Informationen finden Sie unter Stoppbedingungen für AWS FIS.

Berichte

Nach jedem Testlauf wird automatisch ein Bericht generiert, wenn ein Berichtsziel (Amazon S3-Bucket) für Ihren Service konfiguriert ist. Die Berichte enthalten die Testkonfiguration, den Alarmstatus, den Zeitplan und die Ergebnisse, die bestanden oder nicht bestanden wurden. Testberichte sind ohne zusätzliche Kosten enthalten, wenn Sie die Resilienztests der nächsten Generation von Resilience Hub verwenden. Informationen zur Konfiguration eines Berichtsziels finden Sie in den Berichtseinstellungen Ihres Dienstes.

Protokolle

Senden Sie detaillierte Testprotokolle an Amazon S3, CloudWatch Logs oder beides. In den Protokollen werden Ereignisse mit Zeitstempel erfasst, einschließlich Start und Ende der Aktion, Problemlösung und Fehler. Verwenden Sie Protokolle, um fehlgeschlagene Tests zu debuggen oder um die Reihenfolge der Fehlerinjektion nachzuvollziehen. Für die Protokollierung sind zusätzliche Berechtigungen für Ihre Testausführungsrolle erforderlich. Weitere Informationen finden Sie unter Protokollierung von Experimenten für AWS FIS.

Berechtigungen testen

Eine IAM-Ausführungsrolle ist erforderlich. Die Berechtigungen variieren je nach Testtyp, Fehleraktionen und ausgewählten Optionen. Verwenden Sie für Tests mit mehreren Konten in jedem Konto dieselbe gleichnamige Rolle. Weitere Informationen finden Sie unter IAM-Ausführungsrollen für Resilienztests.