View a markdown version of this page

Opérations unifiées Pour démarrer : intégrer des alarmes critiques à une gestion rapide des incidents - AWS Support

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Opérations unifiées Pour démarrer : intégrer des alarmes critiques à une gestion rapide des incidents

Pour vous informer rapidement des incidents critiques, suivez les étapes suivantes pour intégrer vos alarmes à la détection et à la réponse aux AWS incidents

  1. Définissez et configurez vos alarmes critiques pour une gestion rapide des incidents. Pour plus d'informations, consultez la section Définition et configuration des alarmes dans la section Détection et réponse aux incidents du Guide de l'utilisateur de la détection et de la réponse aux incidents.

    1. Pour savoir comment configurer des alarmes à l'aide d'Amazon CloudWatch, voir Définir et configurer des alarmes dans la section Détection et réponse aux incidents du Guide de l'utilisateur de la détection et de la réponse aux incidents. Pour obtenir AWS des recommandations sur les types d'alarmes critiques pour différents types Services AWS, consultez la section Détection et réponse aux incidents (IDR). Contactez votre équipe des opérations AWS unifiées si vous AWS souhaitez automatiser la création d' AWS alarmes critiques pour vos AWS ressources balisées.

    2. Pour rediriger ou EventBridge intégrer des alarmes critiques provenant d'outils APM tiers intégrés directement à Amazon, tels que,, etc. DataDog NewRelic, consultez la section Ingestion d'alarmes provenant d'APM directement intégrés à Amazon EventBridge dans le Guide de l'utilisateur de la détection et de la AWS réponse aux incidents. Vous devez déployer un ensemble de AWS ressources (AWS Lambda et des règles Amazon EventBridge Event Bus) pour transformer et rediriger votre alarme (événement) vers AWS Incident Detection and Response. Votre équipe des opérations AWS unifiées peut vous aider à fournir le CloudFormation modèle pour installer ces ressources.

    3. Redirigez ou ingérez les alarmes critiques depuis votre outil de surveillance personnalisé via un outil APM tiers qui n'est pas directement intégré à Amazon. EventBridge Pour plus d'informations, consultez la section Utiliser des webhooks pour ingérer des alarmes provenant d'APM sans intégration directe avec Amazon EventBridge dans le Guide de l'utilisateur de la détection et de la réponse aux AWS incidents. Vous devez déployer un ensemble de AWS ressources ( AWS Lambda fonctions API Gateway et règles de bus d' EventBridge événements Amazon) pour transformer et rediriger votre alarme (événement) vers AWS Incident Detection and Response. Votre équipe des opérations AWS unifiées peut vous aider à fournir le CloudFormation modèle pour installer ces ressources.

  2. Fournissez les détails de l'architecture de la charge de travail, les coordonnées des points de contact et les informations du manuel sur les mesures d'atténuation des alarmes critiques. Pour y arriver, exécutez les étapes suivantes.

    1. Téléchargez et remplissez le questionnaire d'intégration de la charge de travail de détection et de réponse aux AWS incidents pour chaque charge de travail ou application critique et le questionnaire d'ingestion d'alarmes lié à chaque charge de travail unique.

      Les informations contenues dans ces questionnaires aident l' AWS équipe à élaborer un manuel de résolution des incidents. Ce runbook permet de prendre les mesures appropriées pour dépanner et corriger rapidement les alarmes critiques avant qu'elles n'entraînent une interruption de l'activité. Pour des exemples et des exemples d'informations, voir Questionnaires d'intégration de la charge de travail et d'ingestion d'alarmes dans la section Détection et réponse aux AWS incidents.

  3. Donnez accès à vos alarmes critiques intégrées à la détection et à la réponse aux AWS incidents

    1. Déployez le rôle AWSServiceRoleForHealth_EventProcessor lié aux services (SLR) dans le cadre de l' Compte AWS exécution de la charge de travail critique à surveiller par l'équipe de gestion des AWS incidents. Pour plus d'informations, voir Fournir un accès pour l'ingestion d'alertes à la section Détection et réponse aux AWS incidents.

      Note

      Pour vous aider lors de l'intégration de grandes Comptes AWS entreprises, nous AWS pouvons vous fournir un AWS Command Line Interface script pour accélérer l'approvisionnement de ce reflex.

    2. (Facultatif) Si vos alarmes se trouvent sur Amazon CloudWatch, assurez-vous que l' Gestion des identités et des accès AWS utilisateur ou le rôle utilisé pour les tests d'alarme (avant la mise en service) dispose de l'autorisation cloudwatch:SetAlarmState IAM dans votre environnement Compte AWS qui exécute la charge de travail critique. Cela est nécessaire pour les tests d'alarme (jour de jeu) après l'intégration. Pour plus d'informations, voir Tester les charges de travail intégrées dans la section Détection et réponse aux AWS incidents.

  4. Créez un AWS Support dossier pour inscrire une charge de travail pour une gestion rapide des incidents. Notez que la gestion rapide des incidents entrants Compte AWS est automatiquement activée, ce qui signifie que vous pouvez signaler un cas à la file d'attente Unified Operations Incident Detection and Response via la console du centre de support AWS Command Line Interface, le SDK ou le AWS SDK pour une action rapide. AWS Pour surveiller et créer des incidents de manière proactive avec un AWS Support dossier sortant, créez un AWS Support dossier pour votre charge de travail critique. Pour y arriver, exécutez les étapes suivantes.

    1. Connectez-vous au AWS Support Center Console, sélectionnez Créer un dossier, puis sélectionnez Support technique.

    2. Pour Service, sélectionnez Détection et réponse aux incidents.

    3. Pour Catégorie, sélectionnez Intégrer une nouvelle charge de travail.

    4. Pour Sévérité, sélectionnez Directives générales.

    5. Vous trouverez ci-joint les questionnaires relatifs à la charge de travail et aux alarmes que vous avez remplis à l'étape précédente.