Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Opsi penurunan skala cluster untuk cluster Amazon EMR
catatan
Scale-down opsi perilaku tidak lagi didukung sejak Amazon EMR rilis 5.10.0. Karena pengenalan penagihan per detik di Amazon EC2, perilaku menurunkan skala default untuk klaster Amazon EMR sekarang berakhir pada penyelesaian tugas.
Dengan rilis Amazon EMR 5.1.0 hingga 5.9.1, ada dua opsi untuk perilaku penurunan skala: berhenti pada batas jam instansi untuk penagihan Amazon EC2, atau hentikan saat tugas selesai. Dimulai dengan Amazon EMR rilis 5.10.0, pengaturan untuk penghentian pada batas jam instansi tidak digunakan lagi karena diperkenalkannya penagihan per detik di Amazon EC2. Kami tidak merekomendasikan menentukan pengakhiran batas jam instans dalam versi yang memiliki opsi tersebut.
Awas
Jika Anda menggunakan AWS CLI to issue a modify-instance-groups withEC2InstanceIdsToTerminate, instans ini akan segera dihentikan, tanpa mempertimbangkan pengaturan ini, dan terlepas dari status aplikasi yang berjalan di atasnya. Mengakhiri sebuah instans dengan cara ini berisiko kehilangan data dan perilaku klaster tak terduga.
Ketika diakhiri pada penyelesaian tugas ditentukan, Amazon EMR menolak daftar dan menguras tugas dari node sebelum menghentikan instans Amazon EC2. Dengan ditentukannya salah satu perilaku tersebut, Amazon EMR tidak mengakhiri instans Amazon EC2 dalam grup instans inti jika dapat menyebabkan kerusakan HDFS.
Akhiri pada penyelesaian tugas
Amazon EMR mengizinkan Anda untuk menurunkan skala klaster Anda tanpa mempengaruhi beban kerja Anda. Amazon EMR mencoba menonaktifkan YARN, HDFS, dan daemon lainnya dengan anggun pada node inti dan tugas selama operasi pengubahan ukuran tanpa kehilangan data atau mengganggu pekerjaan. Amazon EMR hanya mengurangi ukuran grup instans jika pekerjaan yang ditugaskan ke grup telah selesai dan mereka tidak aktif. Untuk YARN NodeManager Graceful Decommission, Anda dapat menyesuaikan waktu node menunggu penonaktifan secara manual.
catatan
Ketika penonaktifan anggun terjadi, mungkin ada kehilangan data. Pastikan untuk membuat cadangan data Anda.
penting
Ada kemungkinan bahwa data HDFS dapat hilang secara permanen selama penggantian instans inti yang tidak sehat secara anggun. Kami menyarankan Anda selalu membuat cadangan data Anda.
penting
Jika Anda menyetel yarn.resourcemanager.nodemanager-graceful-decommission-timeout-secs ke-1, Amazon EMR menonaktifkan batas waktu penonaktifan yang anggun dan menonaktifkan node segera tanpa menunggu tugas selesai. YARN Ini berbeda dari sumber terbukaYARN, yang -1 berarti menunggu tanpa batas untuk penghentian yang anggun. Untuk memberikan lebih banyak waktu untuk menyelesaikan tugas sebelum penonaktifan, tetapkan nilai batas waktu positif yang tinggi (misalnya, 86400 selama 24 jam).
Kali ini diatur menggunakan properti di klasifikasi konfigurasi YARN-site. Menggunakan Amazon EMR release 5.12.0 dan yang lebih tinggi, tentukan properti. YARN.resourcemanager.nodemanager-graceful-decommission-timeout-secs Menggunakan rilis Amazon EMR sebelumnya, tentukan YARN.resourcemanager.decommissioning.timeout properti.
Jika masih ada kontainer atau aplikasi YARN yang berjalan saat waktu penonaktifan habis, simpul dipaksa untuk dinonaktifkan dan YARN menjadwalkan ulang kontainer yang terpengaruh pada simpul lainnya. Nilai default adalah 3600 detik (satu jam). Anda dapat mengatur batas waktu ini menjadi nilai tinggi sewenang-wenang untuk memaksa pengurangan anggun menunggu lebih lama. Untuk informasi selengkapnya, lihat Graceful Decommission of YARN node
Grup simpul tugas
Amazon EMR secara cerdas memilih instans yang tidak memiliki tugas yang berjalan terhadap langkah atau aplikasi apa pun, dan menghapus instans tersebut dari cluster terlebih dahulu. Jika semua instans dalam cluster sedang digunakan, Amazon EMR menunggu tugas diselesaikan pada instance sebelum menghapusnya dari cluster. Waktu tunggu default adalah 1 jam. Nilai ini dapat diubah dengan YARN.resourcemanager.decommissioning.timeout pengaturan. Amazon EMR secara dinamis menggunakan pengaturan baru. Anda dapat mengatur ini ke jumlah yang besar secara sewenang-wenang untuk memastikan bahwa Amazon EMR tidak menghentikan tugas apa pun sambil mengurangi ukuran cluster.
Grup simpul inti
Pada node inti, DataNode daemon YARN NodeManager dan HDFS harus dinonaktifkan agar grup instance dapat dikurangi. Untuk YARN, pengurangan anggun memastikan bahwa node yang ditandai untuk dinonaktifkan hanya dialihkan ke DECOMMISSIONED status jika tidak ada wadah atau aplikasi yang tertunda atau tidak lengkap. Penonaktifan segera selesai jika tidak ada kontainer yang berjalan pada simpul di awal penonaktifan.
Untuk HDFS, pengurangan anggun memastikan bahwa kapasitas target HDFS cukup besar untuk memenuhi semua blok yang ada. Jika kapasitas target tidak cukup besar, hanya sebagian jumlah instans inti yang dinonaktifkan sehingga simpul yang tersisa dapat menangani data yang ada di HDFS. Anda harus memastikan kapasitas HDFS tambahan untuk memungkinkan penonaktifan lebih lanjut. Anda juga harus mencoba meminimalkan pen I/O ulisan sebelum mencoba mengurangi grup instance. Penulisan yang I/O berlebihan dapat menunda penyelesaian operasi pengubahan ukuran.
Batas lain adalah faktor replikasi default, dfs.replication di dalam /etc/hadoop/conf/hdfs-site. Saat membuat cluster, Amazon EMR mengonfigurasi nilai berdasarkan jumlah instance dalam cluster: 1 dengan 1-3 instance, 2 untuk cluster dengan 4-9 instans, dan 3 untuk cluster dengan 10+ instans.
Awas
-
Pengaturan
dfs.replicationke 1 pada cluster dengan kurang dari empat node dapat menyebabkan hilangnya data HDFS jika satu node turun. Sebaiknya gunakan cluster dengan setidaknya empat node inti untuk beban kerja produksi. -
Amazon EMR tidak akan mengizinkan cluster untuk menskalakan node inti di bawah ini
dfs.replication. Misalnya, jikadfs.replication = 2, jumlah minimum node inti adalah 2. -
Bila Anda menggunakan Managed Scaling Auto-scaling, atau memilih untuk mengubah ukuran cluster secara manual, sebaiknya setel
dfs.replicationke 2 atau lebih tinggi.
Pengurangan anggun tidak memungkinkan Anda mengurangi node inti di bawah faktor replikasi HDFS. Ini untuk memungkinkan HDFS menutup file karena replika tidak mencukupi. Untuk menghindari batas ini, turunkan faktor replikasi dan mulai ulang NameNode daemon.