View a markdown version of this page

Operazioni unificate Guida introduttiva: Integra gli allarmi critici per una rapida gestione degli incidenti - Supporto AWS

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Operazioni unificate Guida introduttiva: Integra gli allarmi critici per una rapida gestione degli incidenti

Per aiutarvi a notificare rapidamente gli incidenti critici, completate i seguenti passaggi per inserire gli allarmi in Incident Detection and Response AWS

  1. Definisci e configura i tuoi allarmi critici per una rapida gestione degli incidenti. Per informazioni dettagliate, consulta Definizione e configurazione degli allarmi in Incident Detection and Response nella Guida per l'utente di Incident Detection and Response.

    1. Per i passaggi per configurare gli allarmi con Amazon CloudWatch, consulta Definire e configurare gli allarmi in Incident Detection and Response nella Incident Detection and Response User Guide. Per AWS consigli su vari tipi di allarmi critici Servizi AWS, consulta Incident Detection and Response (IDR). Contatta il tuo team AWS Unified Operations se desideri AWS automatizzare la creazione di AWS allarmi critici per le tue risorse contrassegnate. AWS

    2. Per reindirizzare o inserire allarmi critici da strumenti APM di terze parti con EventBridge integrazione diretta con Amazon, ad esempio, e così via, consulta Invest alarms from APM con integrazione diretta con Amazon nella Incident Detection and Response User Guide. DataDog NewRelic EventBridge AWS È necessario implementare una serie di AWS risorse (AWS Lambda e regole Amazon EventBridge Event Bus) per trasformare e reindirizzare l'allarme (evento) a Incident Detection and Response. AWS Il tuo team AWS Unified Operations può aiutarti a fornire il CloudFormation modello per installare queste risorse.

    3. Reindirizza o inserisci gli allarmi critici dal tuo strumento di monitoraggio personalizzato tramite uno strumento APM di terze parti che non è integrato direttamente con Amazon. EventBridge Per maggiori informazioni, consulta Utilizzare i webhook per inserire allarmi dagli APM senza integrazione diretta con Amazon EventBridge nella Incident Detection and Response User Guide. AWS È necessario distribuire una serie di AWS risorse ( AWS Lambda funzioni API Gateway e regole Amazon EventBridge event bus) per trasformare e reindirizzare l'allarme (evento) a Incident Detection and Response. AWS Il tuo team AWS Unified Operations può aiutarti a fornire il CloudFormation modello per installare queste risorse.

  2. Fornisci dettagli sull'architettura del carico di lavoro, informazioni sui punti di contatto e informazioni preliminari sulle azioni di mitigazione degli allarmi critici. Per farlo, completa le seguenti fasi.

    1. Scarica e completa il questionario di onboarding del carico di lavoro di rilevamento e risposta agli AWS incidenti per ogni carico di lavoro o applicazione critica e il questionario sull'inserimento degli allarmi relativo a ciascun carico di lavoro unico. https://docs.aws.amazon.com/IDR/latest/userguide/idr-gs-questionnaire.html

      Le informazioni contenute in questi questionari aiutano il team a sviluppare un runbook per la risoluzione degli incidenti. AWS Questo manuale consente di intraprendere le azioni appropriate per risolvere rapidamente i problemi e porre rimedio agli allarmi critici prima che causino interruzioni aziendali. Per esempi e informazioni di esempio, consulta i questionari sull'onboarding del carico di lavoro e sull'inserimento degli allarmi in Incident Detection and Response. AWS

  3. Fornisci l'accesso per integrare i tuoi allarmi critici in Incident Detection and Response AWS

    1. Implementa il ruolo AWSServiceRoleForHealth_EventProcessor collegato ai servizi (SLR) nella gestione del carico di lavoro critico per essere monitorato dal team di Account AWS gestione degli incidenti. AWS Per ulteriori informazioni, consulta Fornire l'accesso per l'inserimento degli avvisi a Incident Detection and Response. AWS

      Nota

      Per agevolare l'onboarding di grandi dimensioni Account AWS, AWS possiamo fornirti uno AWS Command Line Interface script per velocizzare il provisioning di questa reflex.

    2. (Facoltativo) Se i tuoi allarmi sono in Amazon CloudWatch, assicurati che AWS Identity and Access Management l'utente o il ruolo utilizzato per il test degli allarmi (prima del go-live) disponga dell'autorizzazione cloudwatch:SetAlarmState IAM Account AWS che esegue il carico di lavoro critico. Questa operazione è necessaria per il test degli allarmi (gameday) dopo l'onboarding. Per ulteriori informazioni, consulta Test dei carichi di lavoro integrati in Incident Detection and Response. AWS

  4. Crea un Supporto AWS caso per sottoscrivere un carico di lavoro per una gestione rapida degli incidenti. Tieni presente che la tua Account AWS è abilitata automaticamente alla gestione rapida degli incidenti in entrata, il che significa che puoi segnalare un caso alla coda di Unified Operations Incident Detection and Response tramite la console del Support Center, l'SDK o l' AWS SDK per AWS Command Line Interface intervenire rapidamente. Per AWS monitorare e creare incidenti in modo proattivo con un caso in uscita, crea un Supporto AWS caso per il tuo carico di lavoro critico. Supporto AWS Per farlo, completa le seguenti fasi.

    1. Accedi a AWS Support Center Console, seleziona Crea caso, quindi seleziona Supporto tecnico.

    2. Per Assistenza, seleziona Incident Detection and Response.

    3. Per Categoria, seleziona Inserisci un nuovo carico di lavoro.

    4. Per Severità, seleziona Guida generale.

    5. In allegato i questionari sul carico di lavoro e sugli allarmi che hai completato nel passaggio precedente.