View a markdown version of this page

Procedure consigliate per la configurazione dello spostamento automatico zonale - Controller di ripristino delle applicazioni Amazon (ARC)

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Procedure consigliate per la configurazione dello spostamento automatico zonale

Tieni presente le seguenti best practice e considerazioni quando abiliti lo spostamento automatico zonale in Amazon Application Recovery Controller (ARC).

Lo spostamento automatico zonale include due tipi di turni di traffico: i turni automatici e i turni zonali eseguiti in modalità pratica.

  • Lo spostamento automatico AWS consente di ridurre i tempi di ripristino spostando il traffico delle risorse applicative da una zona di disponibilità durante gli eventi, per conto dell'utente.

  • Con le esercitazioni, ARC avvia un cambio zonale per tuo conto oppure tu inizi una prova pratica con turni zonali. L' AWS esercitazione di spostamento zonale sposta il traffico da una zona di disponibilità per una risorsa e viceversa, con cadenza settimanale. Le prove pratiche ti aiutano ad assicurarti di aver aumentato la capacità delle zone di disponibilità in una regione in modo che l'applicazione possa tollerare la perdita di una zona di disponibilità.

Esistono diverse best practice e considerazioni da tenere a mente per gli spostamenti automatici e le esecuzioni pratiche. Consulta i seguenti argomenti prima di abilitare il cambio automatico zonale o configurare le esercitazioni per una risorsa.

Argomenti

Limita il tempo in cui i clienti rimangono connessi ai tuoi endpoint

Quando Amazon Application Recovery Controller (ARC) allontana il traffico da un problema, ad esempio utilizzando lo zonal shift o lo zonal autoshift, il meccanismo utilizzato da ARC per spostare il traffico delle applicazioni è un aggiornamento DNS. Un aggiornamento DNS fa sì che tutte le nuove connessioni vengano indirizzate lontano dalla posizione compromessa. Tuttavia, i client con connessioni aperte preesistenti potrebbero continuare a fare richieste sulla posizione compromessa fino alla riconnessione dei client. Per garantire un ripristino rapido, ti consigliamo di limitare il periodo di tempo in cui i clienti rimangono connessi ai tuoi endpoint.

Se utilizzi un Application Load Balancer, puoi utilizzare l'keepaliveopzione per configurare la durata delle connessioni. Ti consigliamo di abbassare il keepalive valore in modo che sia in linea con l'obiettivo di tempo di ripristino per l'applicazione, ad esempio 300 secondi. Quando scegli un keepalive orario, considera che questo valore rappresenta un compromesso tra una riconnessione più frequente in generale, che può influire sulla latenza, e l'allontanamento più rapido di tutti i clienti da una AZ o da una regione compromessa.

Per ulteriori informazioni sull'impostazione dell'keepaliveopzione per Application Load Balancer, consultate la durata keepalive del client HTTP nella Guida per l'utente di Application Load Balancer.

Prescalate la capacità delle risorse e testate lo spostamento del traffico

Quando AWS sposta il traffico da una zona di disponibilità per uno spostamento zonale o un trasferimento automatico, è importante che le zone di disponibilità rimanenti siano in grado di soddisfare l'aumento dei tassi di richiesta per la risorsa. Questo modello è noto come stabilità statica. Per ulteriori informazioni, consulta il white paper sulla stabilità statica utilizzando le zone di disponibilità nella libreria di Amazon Builder.

Ad esempio, se la tua applicazione richiede 30 istanze per servire i suoi clienti, dovresti effettuare il provisioning di 15 istanze in tre zone di disponibilità, per un totale di 45 istanze. In questo modo, quando AWS sposta il traffico da una zona di disponibilità, con uno spostamento automatico o durante un'esecuzione pratica,AWS puoi comunque servire i client dell'applicazione con il totale rimanente di 30 istanze, in due zone di disponibilità.

La funzionalità di spostamento automatico zonale di ARC consente di ripristinare rapidamente AWS gli eventi in una zona di disponibilità quando si dispone di un'applicazione con risorse predimensionate per funzionare normalmente con la perdita di una zona di disponibilità. Prima di abilitare lo spostamento automatico zonale per una risorsa, scalate la capacità delle risorse in tutte le zone di disponibilità configurate in un. Regione AWS Quindi, avvia i turni zonali per la risorsa, per verificare che l'applicazione funzioni ancora normalmente quando il traffico viene spostato da una zona di disponibilità.

Dopo aver eseguito il test con i turni zonali, abilita lo spostamento automatico zonale e configura le esecuzioni pratiche per le risorse dell'applicazione. Esegui le tue prove pratiche su richiesta per assicurarti che la configurazione sia scalata correttamente. Le prove pratiche regolari con zonal autoshift ti aiutano ad assicurarti, su base continuativa, che la tua capacità sia ancora scalata in modo appropriato. Con una capacità sufficiente nelle zone di disponibilità, l'applicazione può continuare a servire i clienti, senza interruzioni, durante un passaggio automatico.

Per ulteriori informazioni sull'avvio di un passaggio zonale per una risorsa, vedere. Zonal shift in ARC

Fai attenzione ai tipi di risorse e alle restrizioni

Zonal autoshift supporta lo spostamento del traffico da una zona di disponibilità per tutte le risorse supportate dallo spostamento zonale. In alcuni scenari specifici delle risorse, lo spostamento automatico zonale non sposta il traffico da una zona di disponibilità per uno spostamento automatico.

Ad esempio, se i gruppi target del load balancer nelle zone di disponibilità non hanno istanze o se tutte le istanze non sono integre, allora il load balancer è in uno stato di fail-open. Se AWS avvia uno spostamento automatico per un load balancer in questo scenario, un autoshift non modifica le zone di disponibilità utilizzate dal load balancer perché il load balancer è già in uno stato di fail-open. Questo è il comportamento previsto. Lo spostamento automatico non può rendere non integra una zona di disponibilità e spostare il traffico verso le altre zone di disponibilità in una zona di disponibilità se tutte le zone di disponibilità non sono aperte (non integre). Regione AWS

Per visualizzare i dettagli sulle risorse supportate, inclusi tutti i requisiti e le eccezioni di cui essere a conoscenza, consulta. Risorse supportate

Specifica gli allarmi per le prove

È necessario configurare almeno un tipo di allarme (un allarme di esito) per le esercitazioni con cambio automatico zonale. Facoltativamente, è possibile configurare anche un secondo tipo di allarme (allarmi di blocco).

Considerando gli CloudWatch allarmi che configuri per le prove pratiche della tua risorsa, tieni presente quanto segue:

  • È necessario configurare almeno un allarme di esito per una configurazione di esercitazione. Per gli allarmi di esito, ti consigliamo di configurare gli CloudWatch allarmi in modo che entrino in uno ALARM stato in cui le metriche della risorsa o dell'applicazione indicano che lo spostamento del traffico dalla zona di disponibilità ha un impatto negativo sulle prestazioni. Ad esempio, puoi determinare una soglia per i tassi di richiesta per la tua risorsa e quindi configurare un allarme in modo che passi ALARM allo stato in cui la soglia viene superata. L'utente è responsabile della configurazione degli allarmi appropriati che causino la AWS fine dell'esercitazione e la restituzione di un risultato. FAILED

  • Ti consigliamo di seguire il AWS Well Architected Framework, che consiglia di implementare gli indicatori chiave di prestazione (KPI) come allarmi. CloudWatch In tal caso, è possibile utilizzare questi allarmi per creare un allarme composito da utilizzare come trigger di sicurezza, per evitare che le sessioni di prova inizino se potrebbero causare la perdita di un KPI nell'applicazione. Quando l'allarme non è più in uno ALARM stato, ARC avvia le esercitazioni la prossima volta che viene pianificata una corsa di prova per la risorsa.

  • Per quanto riguarda il blocco degli allarmi durante l'esercitazione, se si sceglie di configurarne uno (o più), è possibile scegliere di tenere traccia di metriche specifiche da utilizzare per indicare che non si desidera che una sessione di AWS pratica abbia inizio, ad esempio quando un allarme indica che è in corso un incidente.

  • Per gli allarmi con esecuzione pratica, devi specificare l'Amazon Resource Name (ARN) per ogni allarme, quindi devi prima configurare l'allarme in Amazon. CloudWatch Gli CloudWatch allarmi specificati possono essere allarmi compositi, per consentirti di includere diverse metriche e controlli per l'applicazione e la risorsa che possono attivare lo stato dell'allarme. ALARM In alternativa, è possibile configurare allarmi separati e quindi specificare più di un allarme di ogni tipo per la configurazione della corsa pratica. Per ulteriori informazioni, consulta Combinazione degli allarmi nella Amazon CloudWatch User Guide.

  • Assicurati che gli CloudWatch allarmi specificati per le esercitazioni si trovino nella stessa regione della risorsa per cui stai configurando una corsa di prova.

Valuta i risultati delle esercitazioni

ARC riporta un risultato per ogni sessione di pratica. Dopo una prova pratica, valuta il risultato e stabilisci se è necessario agire. Ad esempio, potrebbe essere necessario scalare la capacità o modificare la configurazione di un allarme.

Di seguito sono riportati i possibili esiti della prova pratica:

  • ESITO POSITIVO: nessun allarme relativo ai risultati è entrato in ALARM stato durante l'esercitazione e l'esercitazione ha completato l'intero periodo di prova di 30 minuti.

  • FALLITO: Almeno un allarme relativo ai risultati è entrato in uno ALARM stato durante l'esercitazione.

  • INTERROTTO: L'allenamento è terminato per un motivo diverso dall'entrata in ALARM uno stato dell'allarme di esito. Una corsa pratica può essere interrotta per una serie di motivi, tra cui:

    • La sessione di prove è stata AWS interrotta perché è iniziato un cambio automatico nella regione Regione AWS o c'era una condizione di allarme nella regione.

    • L'esercitazione è stata interrotta perché la configurazione dell'esercitazione è stata eliminata per la risorsa.

    • L'esercitazione è stata interrotta perché è stato avviato uno spostamento zonale avviato dal cliente per la risorsa nella zona di disponibilità da cui lo spostamento zonale dell'esercitazione stava allontanando il traffico.

    • L'esercitazione è stata interrotta perché non era più possibile accedere a un CloudWatch allarme specificato per la configurazione dell'esercitazione.

    • L'esercitazione è stata interrotta perché un allarme di blocco specificato per l'esercitazione è entrato in uno ALARM stato.

    • L'esercitazione è stata interrotta per un motivo sconosciuto.

    • L'esercitazione è stata interrotta perché è stato avviato un cambio automatico zonale con precedenza. Vedi Precedenza per i turni zonali. https://docs.aws.amazon.com/r53recovery/latest/dg/arc-zonal-autoshift.how-it-works.html#ZAShiftPrecedence

  • CAPACITY_CHECK_FAILED: la verifica della capacità bilanciata nelle zone di disponibilità per le risorse del gruppo di bilanciamento del carico e Auto Scaling non è riuscita.

  • IN SOSPESO: L'esercitazione è attiva (in corso). Non ci sono ancora esiti.