Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Praktik terbaik saat Anda mengonfigurasi autoshift zonal
Perhatikan praktik terbaik dan pertimbangan berikut saat mengaktifkan zonal autoshift di Amazon Application Recovery Controller (ARC).
Zonal autoshift mencakup dua jenis pergeseran lalu lintas: autoshift dan latihan menjalankan shift zonal.
Dengan auto shift, AWS membantu mengurangi waktu pemulihan Anda dengan mengalihkan lalu lintas sumber daya aplikasi dari Zona Ketersediaan selama acara, atas nama Anda.
Dengan latihan lari, ARC memulai pergeseran zona atas nama Anda atau Anda memulai latihan shift zonal. L AWS atihan menjalankan shift zonal menggeser lalu lintas menjauh dari Zona Ketersediaan untuk sumber daya, dan kembali lagi, pada irama mingguan. Latihan menjalankan membantu Anda memastikan bahwa Anda telah meningkatkan kapasitas yang cukup untuk Zona Ketersediaan di Wilayah agar aplikasi Anda dapat mentolerir hilangnya satu Zona Ketersediaan.
Ada beberapa praktik dan pertimbangan terbaik yang perlu diingat dengan autoshift dan latihan run. Tinjau topik berikut sebelum Anda mengaktifkan zonal autoshift atau mengonfigurasi proses latihan untuk sumber daya.
Topik
- Batasi waktu klien tetap terhubung ke titik akhir Anda
-
Ketika Amazon Application Recovery Controller (ARC) mengalihkan lalu lintas dari gangguan, misalnya, dengan menggunakan pergeseran zonal atau zonal autoshift, mekanisme yang digunakan ARC untuk memindahkan lalu lintas aplikasi Anda adalah pembaruan DNS. Pembaruan DNS menyebabkan semua koneksi baru diarahkan menjauh dari lokasi yang rusak. Namun, klien dengan koneksi terbuka yang sudah ada sebelumnya mungkin terus membuat permintaan terhadap lokasi yang rusak sampai klien terhubung kembali. Untuk memastikan pemulihan cepat, sebaiknya batasi jumlah waktu klien tetap terhubung ke titik akhir Anda.
Jika Anda menggunakan Application Load Balancer, Anda dapat menggunakan
keepaliveopsi untuk mengonfigurasi berapa lama koneksi berlanjut. Kami menyarankan Anda menurunkankeepalivenilai agar sejalan dengan tujuan waktu pemulihan untuk aplikasi Anda, misalnya, 300 detik. Ketika Anda memilihkeepalivewaktu, pertimbangkan bahwa nilai ini merupakan pertukaran antara menghubungkan kembali lebih sering secara umum, yang dapat memengaruhi latensi, dan lebih cepat memindahkan semua klien dari AZ atau Wilayah yang rusak.Untuk informasi selengkapnya tentang menyetel
keepaliveopsi untuk Application Load Balancer, lihat durasi keepalive klien HTTP di Panduan Pengguna Penyeimbang Beban Aplikasi. - Skala ulang kapasitas sumber daya Anda dan uji pergeseran lalu lintas
-
Saat AWS mengalihkan lalu lintas dari satu Zona Ketersediaan untuk shift zona atau autoshift, penting bahwa Zona Ketersediaan yang tersisa dapat melayani peningkatan tarif permintaan untuk sumber daya Anda. Pola ini dikenal sebagai stabilitas statis. Untuk informasi selengkapnya, lihat whitepaper stabilitas statis menggunakan Availability Zones
di Amazon Builder's Library. Misalnya, jika aplikasi Anda memerlukan 30 instans untuk melayani kliennya, Anda harus menyediakan 15 instans di tiga Zona Ketersediaan, dengan total 45 instans. Dengan melakukan ini, ketika mengal AWS ihkan lalu lintas dari satu Zona Ketersediaan — dengan autoshift atau selama proses praktek — masih AWS dapat melayani klien aplikasi Anda dengan total 30 instans yang tersisa, di dua Zona Ketersediaan.
Kemampuan autoshift zona di ARC membantu Anda pulih dengan cepat dari AWS peristiwa di Zona Ketersediaan saat Anda memiliki aplikasi dengan sumber daya yang telah diskalakan sebelumnya untuk bekerja secara normal dengan hilangnya satu Zona Ketersediaan. Sebelum Anda mengaktifkan zonal autoshift untuk sumber daya, skalakan kapasitas sumber daya Anda di semua Zona Ketersediaan yang dikonfigurasi dalam. Wilayah AWS Kemudian, mulai pergeseran zona untuk sumber daya, untuk menguji apakah aplikasi Anda masih berjalan normal saat lalu lintas dipindahkan dari Zona Ketersediaan.
Setelah Anda menguji dengan pergeseran zona, aktifkan zonal autoshift dan konfigurasikan proses latihan untuk sumber daya aplikasi. Jalankan latihan sesuai permintaan Anda sendiri untuk membantu memastikan bahwa konfigurasi Anda diskalakan dengan benar. Latihan rutin dengan zonal autoshift membantu Anda untuk memastik—secara berkelanjutan— bahwa kapasitas Anda masih diskalakan dengan tepat. Dengan kapasitas yang memadai di seluruh Availability Zone, aplikasi Anda dapat terus melayani klien, tanpa gangguan, selama autoshift.
Untuk informasi selengkapnya tentang memulai pergeseran zona untuk sumber daya, lihatPeralihan zona di ARC.
- Waspadai jenis dan batasan sumber daya
Zonal autoshift mendukung pergeseran lalu lintas keluar dari Zona Ketersediaan untuk semua sumber daya yang didukung oleh pergeseran zonal. Dalam beberapa skenario sumber daya tertentu, zonal autoshift tidak menggeser lalu lintas dari Zona Ketersediaan untuk autoshift.
Misalnya, jika grup target penyeimbang beban di Availability Zone tidak memiliki instance apa pun, atau jika semua instans tidak sehat, penyeimbang beban berada dalam status gagal terbuka. Jika AWS memulai autoshift untuk penyeimbang beban dalam skenario ini, autoshift tidak mengubah Zona Ketersediaan yang digunakan penyeimbang beban karena penyeimbang beban sudah dalam keadaan gagal terbuka. Ini adalah perilaku yang diharapkan. Autoshift tidak dapat menyebabkan satu Zona Ketersediaan menjadi tidak sehat dan mengalihkan lalu lintas ke Zona Ketersediaan lainnya Wilayah AWS jika semua Zona Ketersediaan gagal dibuka (tidak sehat).
Untuk melihat detail tentang sumber daya yang didukung, termasuk semua persyaratan dan pengecualian yang perlu diperhatikan, lihatSumber daya yang didukung.
- Tentukan alarm untuk latihan lari
-
Anda harus mengkonfigurasi setidaknya satu jenis alarm (alarm hasil) untuk latihan berjalan dengan zonal autoshift. Secara opsional, Anda juga dapat mengonfigurasi jenis alarm kedua (memblokir alarm).
Saat mempertimbangkan CloudWatch alarm yang Anda konfigurasikan untuk latihan berjalan untuk sumber daya Anda, ingatlah hal berikut:
Anda diharuskan mengonfigurasi setidaknya satu alarm hasil untuk konfigurasi latihan run. Untuk alarm hasil, sebaiknya Anda mengonfigurasi CloudWatch alarm agar masuk ke
ALARMstatus ketika metrik untuk sumber daya, atau aplikasi Anda, menunjukkan bahwa mengalihkan lalu lintas dari Zona Ketersediaan berdampak buruk pada kinerja. Misalnya, Anda dapat menentukan ambang batas untuk tarif permintaan untuk sumber daya Anda, lalu mengonfigurasi alarm agar masuk ke status ketika ambang batas terlampaui.ALARMAnda bertanggung jawab untuk mengonfigurasi alarm yang sesuai yang menyebabkan AWS mengakhiri latihan dan mengembalikanFAILEDhasil.Kami menyarankan Anda mengikuti W AWS ell Architected Framework, yang menyarankan Anda untuk menerapkan indikator kinerja utama (KPI) sebagai CloudWatch alarm. Jika Anda melakukannya, Anda dapat menggunakan alarm ini untuk membuat alarm komposit untuk digunakan sebagai pemicu keamanan, untuk mencegah proses latihan dimulai jika hal itu dapat menyebabkan aplikasi Anda melewatkan KPI. Ketika alarm tidak lagi dalam
ALARMkeadaan, ARC memulai latihan berjalan saat latihan berikutnya dijadwalkan untuk sumber daya.Untuk latihan menjalankan alarm pemblokiran, jika Anda memilih untuk mengonfigurasi satu (atau lebih), Anda dapat memilih untuk melacak metrik tertentu yang Anda gunakan untuk menunjukkan bahwa Anda tidak ingin AWS latihan dijalankan dimulai—misalnya, ketika alarm menunjukkan bahwa ada insiden yang sedang berlangsung.
Untuk latihan menjalankan alarm, Anda menentukan Amazon Resource Name (ARN) untuk setiap alarm, jadi Anda harus terlebih dahulu mengonfigurasi alarm di Amazon CloudWatch. CloudWatch Alarm yang Anda tentukan dapat berupa alarm gabungan, untuk memungkinkan Anda menyertakan beberapa metrik dan pemeriksaan untuk aplikasi dan sumber daya yang dapat memicu alarm untuk masuk ke
ALARMstatus. Atau, Anda dapat mengonfigurasi alarm terpisah, lalu menentukan lebih dari satu alarm dari setiap jenis untuk konfigurasi latihan run Anda. Untuk informasi selengkapnya, lihat Menggab ungkan alarm di Panduan CloudWatch Pengguna Amazon.Pastikan CloudWatch alarm yang Anda tentukan untuk latihan berjalan berada di Wilayah yang sama dengan sumber daya tempat Anda mengonfigurasi latihan run.
- Mengevaluasi hasil untuk latihan lari
ARC melaporkan hasil untuk setiap latihan yang dijalankan. Setelah latihan, evaluasi hasilnya, dan tentukan apakah Anda perlu mengambil tindakan. Misalnya, Anda mungkin perlu menskalakan kapasitas atau menyesuaikan konfigurasi untuk alarm.
Berikut ini adalah kemungkinan hasil uji coba:
BERHASIL: Tidak ada alarm hasil yang memasuki
ALARMkeadaan selama latihan berlangsung, dan proses latihan menyelesaikan periode tes 30 menit penuh.GAGAL: Se tidaknya satu alarm hasil memasuki
ALARMkeadaan selama latihan.TERPUT US: Latihan berakhir karena alasan yang bukan alarm hasil memasuki suatu
ALARMkeadaan. Latihan lari dapat terganggu karena berbagai alasan, termasuk yang berikut:Latihan lari berakhir karena AWS memulai autoshift di Wilayah AWS atau ada kondisi alarm di Wilayah.
Latihan run berakhir karena konfigurasi run latihan dihapus untuk sumber daya.
Proses latihan diakhiri karena pergeseran zonal yang diprakarsai pelanggan dimulai untuk sumber daya di Zona Ketersediaan tempat pergeseran zonal menjalankan praktik mengalihkan lalu lintas.
Latihan run diakhiri karena CloudWatch alarm yang ditentukan untuk konfigurasi run latihan tidak dapat lagi diakses.
Latihan lari diakhiri karena alarm pemblokiran yang ditentukan untuk latihan yang dijalankan memasuki
ALARMstatus.Latihan lari berakhir karena alasan yang tidak diketahui.
-
Latihan lari berakhir karena autoshift zonal dengan prioritas dimulai. Lihat Pri oritas untuk pergeseran zona.
CAPACITY_CHECK_FAILED: Pemeriksaan kapasitas seimbang di seluruh Zona Ketersediaan untuk penyeimbangan beban dan sumber daya grup Auto Scaling Anda gagal.
TERTUN DA: Latihan berjalan aktif (sedang berlangsung). Belum ada hasil yang dapat dilaporkan.