As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
Configurando um teste
Ao criar um teste a partir de um modelo, você define as seguintes configurações. As configurações são salvas e reutilizadas para execuções futuras — você pode editá-las a qualquer momento.
- Duração do teste
-
O período de tempo em que as ações de teste são executadas. Para testes de recuperação (zona de disponibilidade: recuperação e Multi-Region: recuperação), a duração padrão é seu RTO mais 30 minutos, dando tempo ao serviço para se recuperar e confirmando que ele se sustenta. Para testes contínuos, o padrão é 30 minutos para validação de dependência ou 3 horas para Multi-Region: isolamento. Esses padrões se aplicam ao console; ao usar a API, você fornece a duração explicitamente.
- Escopo da falha
-
Define onde as falhas são injetadas — a zona de disponibilidade ou as regiões a serem afetadas. Cada teste tem seus próprios parâmetros. Para obter detalhes, consulte Testes disponíveis.
- Ações de teste
-
Read-only. Definido pelo modelo de teste. Mostra as ações de falha e seus tipos de recursos de destino. Se nenhum recurso corresponder ao tipo de alvo de uma ação, essa ação será ignorada.
- Dependências a serem bloqueadas
-
Dependências a serem bloqueadas durante o teste. Selecione entre as dependências descobertas (se a descoberta de dependências estiver ativada) ou insira as dependências manualmente pelo nome de domínio DNS. Obrigatório para alguns testes, opcional para outros. Para padrões e requisitos, consulte. Testes disponíveis
- Alarmes de teste
-
Alarmes de sucesso (obrigatórios) — CloudWatch alarmes que determinam a aprovação ou a falha dos critérios de sucesso. Pelo menos um é necessário. Se você selecionar vários, todos devem passar para que o teste seja aprovado. Escolha alarmes que meçam a integridade geral do seu serviço.
Como o teste é aprovado:
-
Zona de disponibilidade: recuperação — todos os alarmes de sucesso devem retornar ao
OKestado em seu Multi-AZ RTO e permanecer lá até que as ações de teste terminem. -
Multi-Region: recuperação — todos os alarmes de sucesso devem retornar ao
OKestado em seu Multi-Region RTO e permanecer lá até que as ações de teste terminem. -
Validação de dependência — todos os alarmes de sucesso permanecem no
OKestado até que as ações de teste terminem. -
Multi-Region: isolamento — todos os alarmes de sucesso permanecem no
OKestado até que as ações de teste terminem.
Alarmes adicionais (opcional) — Somente para observabilidade. Mostrado nos resultados e no relatório, mas não afeta o resultado de aprovação ou reprovação.
-
- Plano de mudança de região (Multi-Region: somente recuperação, opcional)
-
Anexar um plano de switch de região do AWS Application Recovery Controller (ARC) permite que a próxima geração do Resilience Hub inclua o cronograma de failover em seus resultados de teste e relatório. Opcional; deixe em branco se você usar o failover manual ou uma automação personalizada.
- Configurações adicionais (opcional)
-
- Condições de parada
-
CloudWatch alarmes que interrompem automaticamente o teste se eles ultrapassarem seu limite. Use as condições de parada como barreiras para proteger suas cargas de trabalho durante os testes. Por exemplo, crie um CloudWatch alarme em uma métrica comercial crítica (como latência ou taxa de erro) que interrompa o teste se ele exceder um limite inaceitável. Os alarmes de condição de parada devem estar na conta em que o teste é executado e na região onde as falhas são injetadas. Para obter mais informações, consulte Condições de parada para AWS FIS.
- Relatórios
-
Um relatório é gerado automaticamente após cada execução de teste quando um destino de relatório (bucket do Amazon S3) é configurado em seu serviço. Os relatórios incluem a configuração do teste, o status do alarme, o cronograma e os resultados de aprovação ou reprovação. Os relatórios de teste são incluídos sem custo adicional quando você usa a próxima geração de testes de resiliência do Resilience Hub. Para configurar um destino de relatório, consulte as configurações de relatórios do seu serviço.
- Logs
-
Envie registros de teste detalhados para o Amazon S3, CloudWatch Logs ou ambos. Os registros capturam eventos com data e hora, incluindo início e fim da ação, resolução alvo e erros. Use registros para depurar testes que falharam ou para entender a sequência da injeção de falhas. O registro exige permissões adicionais em sua função de execução de teste. Para obter mais informações, consulte Registro de experiências para AWS FIS.
- Permissões de teste
-
É necessária uma função de execução do IAM. As permissões variam com base no tipo de teste, nas ações de falha e nas opções selecionadas. Para testes com várias contas, use a função com o mesmo nome em cada conta. Para obter mais informações, consulte Funções de execução do IAM para testes de resiliência.