View a markdown version of this page

Mengganti node yang tidak sehat dengan Amazon EMR - Amazon EMR

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Mengganti node yang tidak sehat dengan Amazon EMR

Amazon EMR secara berkala menggunakan layanan pemeriksa NodeManager kesehatan di Apache Hadoop untuk memantau status node inti di Amazon EMR Anda di cluster Amazon EC2. Jika node tidak berfungsi secara optimal, node ditandai sebagai tidak sehat dan pemeriksa kesehatan melaporkan node tersebut ke pengontrol Amazon EMR. Pengontrol Amazon EMR menambahkan node ke daftar tolak, mencegah node menerima aplikasi YARN baru sampai status node membaik.

catatan

Alasan umum untuk node menjadi tidak sehat adalah karena ia kehabisan ruang disk. Untuk informasi lebih lanjut tentang kapan node inti hampir kehabisan ruang disk, artikel RE: Post Knowledge Center berikut ini sangat membantu: Mengapa node inti di cluster Amazon EMR saya kehabisan ruang disk?

catatan

Hadoop memang menyediakan kemampuan untuk menjalankan pemeriksaan kesehatan node yang disesuaikan. Hal ini dijelaskan secara lebih rinci dalam dokumentasi Apache Hadoop di NodeManager.

Anda dapat memilih apakah Amazon EMR harus menghentikan node yang tidak sehat atau menyimpannya di cluster. Jika Anda menonaktifkan penggantian node yang tidak sehat, mereka tetap berada di daftar tolak dan terus dihitung terhadap kapasitas cluster. Anda masih dapat terhubung ke instans inti Amazon EC2 untuk konfigurasi dan pemulihan, sehingga Anda dapat mengubah ukuran cluster jika ingin menambah kapasitas. Untuk informasi selengkapnya tentang cara kerja penggantian dan penghentian node, lihat Menggunakan perlindungan penghentian.

Jika penggantian node yang tidak sehat diaktifkan, Amazon EMR akan menghentikan node inti yang tidak sehat dan menyediakan instance baru, berdasarkan jumlah instans dalam grup instans, atau berdasarkan kapasitas target untuk armada contoh. Jika ada node yang tidak sehat selama lebih dari 45 menit, Amazon EMR akan dengan anggun mengganti node. Jika penonaktifan yang anggun untuk node tidak selesai dalam satu jam, node dihentikan secara paksa, kecuali jika penghentiannya membawa cluster di bawah faktor replikasi atau batasan kapasitas HDFS.

penting

Perhatikan bahwa waktu yang diperlukan sebelum node dinonaktifkan atau dihentikan dengan anggun dapat berubah.

Meskipun penggantian node yang tidak sehat secara signifikan mengurangi kemungkinan kehilangan data, itu tidak menghilangkan risiko sepenuhnya. Data HDFS dapat hilang secara permanen selama penggantian instans inti yang tidak sehat secara anggun. Kami menyarankan Anda selalu membuat cadangan data Anda.

Untuk informasi selengkapnya tentang mengidentifikasi node dan pemulihan yang tidak sehat, lihat Kes alahan sumber daya. Selain itu, untuk praktik terbaik lainnya yang dapat Anda ikuti untuk menjaga kesehatan cluster, lihat dokumentasi berikut untuk kesalahan sumber daya Cluster Amazon EMR berakhir dengan NO_SLAVE_LEFT dan node inti FAILED_BY_MASTER.

Amazon EMR menerbitkan Amazon CloudWatch Events untuk penggantian node yang tidak sehat, sehingga Anda dapat melacak apa yang terjadi dengan instans inti yang tidak sehat. Untuk informasi selengkapnya, lihat peristiwa penggantian simpul yang tidak sehat.

Penggantian simpul default dan pengaturan perlindungan penghentian

Penggantian node yang tidak sehat tersedia untuk semua rilis Amazon EMR, tetapi pengaturan default bergantung pada label rilis yang Anda pilih. Anda dapat mengubah salah satu pengaturan ini dengan mengonfigurasi penggantian node yang tidak sehat saat membuat cluster baru atau dengan membuka konfigurasi cluster kapan saja.

Jika Anda membuat cluster simpul tunggal atau cluster ketersediaan tinggi yang menjalankan Amazon EMR rilis 7.0 atau lebih rendah, pengaturan default penggantian node yang tidak sehat bergantung pada perlindungan penghentian:

  • Mengaktifkan perlindungan terminasi menonaktifkan penggantian node yang tidak sehat.

  • Menonaktifkan perlindungan penghentian memungkinkan penggantian node yang tidak sehat.

Mengkonfigurasi penggantian node yang tidak sehat saat Anda meluncurkan cluster

Anda dapat mengaktifkan atau menonaktifkan penggantian node yang tidak sehat saat meluncurkan cluster menggunakan konsol AWS CLI,, atau API.

Pengaturan default penggantian simpul tidak sehat tergantung pada cara Anda meluncurkan cluster:

  • Konsol Amazon EMR — penggantian simpul yang tidak sehat di aktifkan secara default.

  • AWS CLI aws emr create-cluster— penggantian simpul yang tidak sehat diaktifkan secara default kecuali Anda menentukan--no-unhealthy-node-replacement.

  • Perintah Amazon EMR RunJobFlow API — penggantian simpul yang tidak sehat di aktifkan secara default kecuali jika Anda menetapkan nilai UnhealthyNodeReplacement Boolean ke atau. True False

Console
Untuk mengaktifkan atau menonaktifkan penggantian node yang tidak sehat saat Anda membuat cluster dengan konsol
  1. Masuk ke Konsol Manajemen AWS, dan buka konsol Amazon EMR di https://console.aws.amazon.com/emr.

  2. Di bawah EMR di EC2 di panel navigasi kiri, pilih Clu ster, lalu pilih Buat cluster.

  3. Untuk versi rilis EMR, pilih label rilis Amazon EMR yang Anda inginkan.

  4. Di bawah Pengakhiran klaster dan penggantian simpul, pastikan penggantian simpul tidak sehat (disarankan) telah dipilih sebelumnya, atau hapus pilihan untuk mematikannya.

  5. Pilih opsi lain yang berlaku untuk cluster Anda.

  6. Untuk meluncurkan cluster Anda, pilih Buat cluster.

AWS CLI
Untuk mengaktifkan atau menonaktifkan penggantian node yang tidak sehat saat Anda membuat cluster menggunakan AWS CLI
  • Dengan AWS CLI, Anda dapat meluncurkan cluster dengan penggantian node yang tidak sehat diaktifkan dengan create-cluster perintah dengan --unhealthy-node-replacement parameter. Penggantian simpul yang tidak sehat aktif secara default.

    Contoh berikut membuat cluster dengan penggantian node yang tidak sehat diaktifkan:

    catatan

    Karakter lanjutan baris Linux (\) disertakan agar mudah dibaca Karakter ini bisa dihapus atau digunakan dalam perintah Linux. Untuk Windows, hapus atau ganti dengan tanda sisipan (^).

    aws emr create-cluster --name "SampleCluster" --release-label emr-7.13.0 \ --applications Name=Hadoop Name=Hive Name=Pig \ --use-default-roles --ec2-attributes KeyName=myKey --instance-type m5.xlarge \ --instance-count 3 --unhealthy-node-replacement

    Untuk informasi selengkapnya tentang menggunakan perintah Amazon EMR di AWS CLI, lihat perintah Amazon EMR AWS CLI .

Mengkonfigurasi penggantian node yang tidak sehat di cluster yang sedang berjalan

Anda dapat mengaktifkan atau menonaktifkan penggantian node yang tidak sehat untuk cluster yang sedang berjalan menggunakan konsol AWS CLI,, atau API.

Console
Untuk mengaktifkan atau menonaktifkan penggantian node yang tidak sehat untuk cluster yang sedang berjalan dengan konsol
  1. Masuk ke Konsol Manajemen AWS, dan buka konsol Amazon EMR di https://console.aws.amazon.com/emr.

  2. Di bawah EMR pada EC2 di panel navigasi kiri, pilih Clu ster, dan pilih cluster yang ingin Anda perbarui.

  3. Pada tab Properties pada halaman detail cluster, temukan Pengakhiran cluster dan penggantian simpul dan pilih Edit.

  4. Pilih atau kosongkan kotak centang penggantian simpul yang tidak sehat untuk mengaktifkan atau menonaktifkan fitur. Kemudian pilih S impan perubahan untuk mengonfirmasi.

AWS CLI
Untuk mengaktifkan atau menonaktifkan penggantian node yang tidak sehat untuk cluster yang sedang berjalan menggunakan AWS CLI
  • Untuk mengaktifkan penggantian node yang tidak sehat pada cluster yang sedang berjalan dengan AWS CLI, gunakan modify-cluster-attributes perintah dengan --unhealthy-node-replacement parameter. Untuk menonaktifkannya, gunakan parameter --no-unhealthy-node-replacement.

    Contoh berikut mengaktifkan penggantian node yang tidak sehat pada cluster dengan IDj-3KVTXXXXXX7UG:

    aws emr modify-cluster-attributes --cluster-id j-3KVTXXXXXX7UG --unhealthy-node-replacement

    Contoh berikut mematikan penggantian node yang tidak sehat pada cluster yang sama:

    aws emr modify-cluster-attributes --cluster-id j-3KVTXXXXXX7UG --no-unhealthy-node-replacement