Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Cómo empezar con las operaciones unificadas: incorpore alarmas críticas para una gestión rápida de los incidentes
Para poder notificarle rápidamente los incidentes críticos, complete los siguientes pasos para integrar sus alarmas en la detección y respuesta a AWS incidentes
Defina y configure sus alarmas críticas para una gestión rápida de los incidentes. Para obtener información detallada, consulte Definir y configurar alarmas en la sección Detección y respuesta a incidentes de la Guía del usuario de detección y respuesta a incidentes.
-
Para ver los pasos para configurar las alarmas con Amazon CloudWatch, consulte Definir y configurar alarmas en la sección Detección y respuesta a incidentes de la Guía del usuario de detección y respuesta a incidentes. Para obtener AWS recomendaciones sobre los distintos tipos de alarmas críticas Servicios de AWS, consulte Detección y respuesta a incidentes (IDR)
. Póngase en contacto con su equipo de operaciones AWS unificadas si AWS desea automatizar la creación de AWS alarmas críticas para sus AWS recursos etiquetados. -
Para redirigir o incorporar alarmas críticas de herramientas de APM de terceros con EventBridge integración directa con Amazon, por ejemplo
, etc., consulte la NewRelic Guía del usuario sobre la incorporación de alarmas de APM que se integren directamente con Amazon EventBridge en la Guía del usuario de detección y respuesta a AWS incidentes. DataDog Debe implementar un conjunto de AWS recursos (AWS Lambda y las reglas del bus de EventBridge eventos de Amazon) para transformar y redirigir su alarma (evento) a la detección y respuesta a AWS incidentes. Su equipo de operaciones AWS unificadas puede ayudarlo a proporcionar la CloudFormation plantilla para instalar estos recursos. -
Redirija o incorpore las alarmas críticas de su herramienta de monitorización personalizada a través de una herramienta de APM de terceros que no esté integrada directamente con Amazon. EventBridge Para obtener más información, consulta la sección Cómo usar webhooks para recopilar alarmas de APM sin una integración directa con Amazon EventBridge en la Guía del usuario de detección y respuesta a AWS incidentes. Debe implementar un conjunto de AWS recursos ( AWS Lambda funciones de API Gateway y reglas del bus de EventBridge eventos de Amazon) para transformar y redirigir su alarma (evento) a la detección y respuesta a AWS incidentes. Su equipo de operaciones AWS unificadas puede ayudarlo a proporcionar la CloudFormation plantilla para instalar estos recursos.
-
-
Proporcione detalles sobre la arquitectura de la carga de trabajo, la información del punto de contacto y la información del manual de operaciones sobre las acciones de mitigación de las alarmas críticas. Para ello, siga los pasos que se describen a continuación:
Descargue y complete el cuestionario de incorporación de cargas de trabajo de detección y respuesta a AWS incidentes para cada carga de trabajo o aplicación crítica y el cuestionario de ingesta de alarmas relacionado con cada carga de trabajo única.
La información de estos cuestionarios ayuda al AWS equipo a elaborar un manual de gestión de incidentes. Este manual permite tomar las medidas adecuadas para solucionar rápidamente las alarmas críticas y solucionarlas antes de que provoquen un tiempo de inactividad empresarial. Para ver ejemplos e información de muestra, consulte los cuestionarios sobre la incorporación de cargas de trabajo y la administración de alarmas en Detección y respuesta a incidentes. AWS
Proporcione acceso a sus alarmas críticas integradas para la detección y la respuesta a AWS incidentes
Implemente la función
AWSServiceRoleForHealth_EventProcessorvinculada al servicio (SLR) Cuenta de AWS al ejecutar la carga de trabajo crítica para que la supervise el equipo de gestión de AWS incidentes. Para obtener más información, consulte Provisión del acceso para la incorporación de alertas a la detección y respuesta a AWS incidentes.nota
Para ayudarlo a incorporar a grandes empresas Cuentas de AWS, AWS podemos proporcionarle un AWS Command Line Interface script para acelerar el aprovisionamiento de esta cámara réflex.
(Opcional) Si tus alarmas están en Amazon CloudWatch, asegúrate de que el AWS Identity and Access Management usuario o el rol que utilices para realizar las pruebas de alarmas (antes de su puesta en funcionamiento) tenga el permiso de
cloudwatch:SetAlarmStateIAM en la Cuenta de AWS que estás ejecutando la carga de trabajo crítica. Esto es necesario para probar las alarmas (el día del juego) después de la incorporación. Para obtener más información, consulta Cómo probar las cargas de trabajo incorporadas en AWS Detección y respuesta a incidentes.
Cree un AWS Support caso para suscribir una carga de trabajo para una gestión rápida de los incidentes. Tenga en cuenta que la suya Cuenta de AWS se habilita automáticamente para la gestión rápida de incidentes entrantes, lo que significa que puede enviar un caso a la cola de detección y respuesta a incidentes de Unified Operations a través de la consola del centro de soporte AWS Command Line Interface, el SDK o el AWS SDK para tomar medidas rápidamente. AWS Para supervisar y crear incidentes de forma proactiva con un AWS Support caso saliente, cree un AWS Support caso para su carga de trabajo crítica. Para ello, siga los pasos que se describen a continuación:
Inicie sesión en AWS Support Center Console
, seleccione Crear caso y, a continuación, seleccione Soporte técnico. En Servicio, selecciona Detección y respuesta a incidentes.
En Categoría, seleccione Incorporar nueva carga de trabajo.
Para Gravedad, selecciona Guía general.
Adjuntamos los cuestionarios sobre cargas de trabajo y alarmas que rellenó en el paso anterior.