View a markdown version of this page

Configuración de una prueba - AWS Centro de resiliencia

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Configuración de una prueba

Al crear una prueba a partir de una plantilla, se configuran los siguientes ajustes. Los ajustes se guardan y se reutilizan para futuras ejecuciones; puede editarlos en cualquier momento.

Duración de la prueba

El tiempo durante el que se ejecutan las acciones de prueba. En el caso de las pruebas de recuperación (zona de disponibilidad Multi-Region: recuperación y: recuperación), la duración predeterminada es el RTO más 30 minutos, lo que da tiempo al servicio para recuperarse y confirmar que se mantiene. En el caso de las pruebas sostenidas, el valor predeterminado es de 30 minutos para la validación de dependencias o de 3 horas para el Multi-Region aislamiento. Estos valores predeterminados se aplican en la consola; al usar la API, se indica la duración de forma explícita.

Alcance de la falla

Define dónde se inyectan las fallas: la zona de disponibilidad o las regiones a las que se deben afectar. Cada prueba tiene sus propios parámetros. Para obtener más información, consulte Pruebas disponibles.

Acciones de prueba

Read-only. Definido por la plantilla de prueba. Muestra las acciones de error y sus tipos de recursos de destino. Si ningún recurso coincide con el tipo de objetivo de una acción, esa acción se omite.

Dependencias que se van a bloquear

Dependencias que se deben bloquear durante la prueba. Seleccione una de las dependencias descubiertas (si la detección de dependencias está habilitada) o introduzca las dependencias manualmente por nombre de dominio DNS. Obligatorio para algunas pruebas, opcional para otras. Para conocer los valores predeterminados y los requisitos, consultePruebas disponibles.

Alarmas de prueba

Alarmas de éxito (obligatorias): CloudWatch alarmas que determinan que los criterios de éxito se aprueben o no. Se necesita una como mínimo. Si seleccionas varias, todas deben pasar para que la prueba pase. Elige alarmas que midan el estado general de tu servicio.

Cómo pasa la prueba:

  • Zona de disponibilidad: recuperación: todas las alarmas de éxito deben volver a su OK estado dentro de su Multi-AZ RTO y permanecer allí hasta que finalicen las acciones de prueba.

  • Multi-Region: recuperación: todas las alarmas de éxito deben volver a su OK estado actual en su Multi-Region RTO y permanecer allí hasta que finalicen las acciones de prueba.

  • Validación de dependencias: todas las alarmas de éxito permanecen en OK estado hasta que finalicen las acciones de prueba.

  • Multi-Region: aislamiento: todas las alarmas de éxito permanecen en OK estado hasta que finalicen las acciones de prueba.

Alarmas adicionales (opcionales): solo para la observabilidad. Se muestran en los resultados y en el informe, pero no afectan al resultado aprobado o rechazado.

Plan de cambio de región (Multi-Regionsolo para recuperación, opcional)

Incluir un plan de cambio regional de AWS Application Recovery Controller (ARC) permite a la próxima generación de Resilience Hub incluir el cronograma de conmutación por error en los resultados y el informe de las pruebas. Opcional; déjelo vacío si utiliza la conmutación por error manual o una automatización personalizada.

Ajustes adicionales (opcional)
Condiciones de parada

CloudWatch alarmas que detienen automáticamente la prueba si superan su umbral. Utilice las condiciones de parada como barreras para proteger sus cargas de trabajo durante las pruebas. Por ejemplo, cree una CloudWatch alarma en una métrica empresarial crítica (como la latencia o la tasa de errores) que detenga la prueba si supera un umbral inaceptable. Las alarmas de estado de parada deben estar en la cuenta en la que se ejecuta la prueba y en la región en la que se inyectan las fallas. Para obtener más información, consulte Condiciones de parada para AWS FIS.

Informes

Se genera automáticamente un informe después de cada ejecución de prueba cuando se configura el destino del informe (el bucket de Amazon S3) en su servicio. Los informes incluyen la configuración de la prueba, el estado de la alarma, el cronograma y los resultados de aprobación o error. Los informes de prueba se incluyen sin costo adicional cuando se utiliza la próxima generación de pruebas de resiliencia de Resilience Hub. Para configurar el destino de un informe, consulta la configuración de informes de tu servicio.

Registros

Envíe registros de prueba detallados a Amazon S3, CloudWatch Logs o ambos. Los registros capturan los eventos con fecha y hora, incluidos el inicio y el final de la acción, la resolución de los objetivos y los errores. Utilice los registros para depurar las pruebas fallidas o para comprender la secuencia en la que se producen los errores. El registro requiere permisos adicionales en su función de ejecución de pruebas. Para obtener más información, consulte Registro de experimentos para AWS FIS.

Permisos de prueba

Se requiere una función de ejecución de IAM. Los permisos varían según el tipo de prueba, las acciones fallidas y las opciones seleccionadas. Para las pruebas con varias cuentas, usa el rol del mismo nombre en cada cuenta. Para obtener más información, consulte Funciones de ejecución de IAM para las pruebas de resiliencia.