Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Pemulihan instans otomatis
penting
Bagian ini menjelaskan cara mengkonfigurasi mekanisme pemulihan secara proaktif pada instance EC2. Mekanisme pemulihan ini dirancang untuk memulihkan ketersediaan instans saat AWS mendeteksi masalah perangkat keras atau perangkat lunak yang mendasari yang menyebabkan pemeriksaan status sistem gagal. Jika saat ini Anda mengalami masalah saat mengakses instans, lihat Memecahkan masalah inst ans EC2.
Jika AWS mendeteksi bahwa instance tidak tersedia karena masalah perangkat keras atau perangkat lunak yang mendasarinya, ada dua mekanisme yang dapat memulihkan ketersediaan instans secara otomatis — pemulihan otomatis yang disederhanakan dan pemulihan berbasis CloudWatch tindakan Amazon. Memulihkan ketersediaan instans juga dikenal sebagai pemulihan instans.
Selama proses pemulihan instans, AWS akan mencoba memindahkan instance Anda dari host dengan masalah perangkat keras atau perangkat lunak yang mendasarinya ke host lain. Jika berhasil, proses pemulihan instans akan muncul ke instance sebagai reboot yang tidak direncanakan. Anda dapat memverifikasi apakah pemulihan instans terjadi.
Jika proses pemulihan tidak berhasil, instance mungkin terus berjalan di host dengan masalah perangkat keras atau perangkat lunak yang mendasarinya. Dalam hal ini, diperlukan intervensi manual. Jika instans menjadi tidak dapat dijangkau atau pemeriksaan status sistem terus gagal, sebaiknya h entikan dan memulai instans secara manual. Ketika Anda memulai sebuah instance, biasanya dimigrasikan ke komputer host baru yang mendasarinya. Namun, tidak seperti pemulihan instans otomatis, di mana instance mempertahankan alamat IPv4 publiknya, instance yang dimulai ulang menerima alamat IPv4 publik baru kecuali memiliki alamat IP Elastic.
Untuk mendapatkan manfaat dari mekanisme pemulihan otomatis, mekanisme tersebut harus dikonfigurasi terlebih dahulu pada instance sebelum pemeriksaan status sistem gagal. Secara default, pemulihan otomatis yang disederhanakan diaktifkan selama peluncuran instance. Anda dapat secara opsional mengonfigurasi pemulihan berbasis CloudWatch tindakan Amazon setelah peluncuran. Memiliki salah satu mekanisme ini dikonfigurasi membuat instance Anda lebih tangguh.
Pemulihan otomatis yang disederhanakan dan pemulihan berbasis CloudWatch tindakan Amazon hanya tersedia pada instans yang didukung. Untuk informasi selengkapnya, lihat Persyaratan untuk mengaktifkan pemulihan otomatis yang disederhanakan dan Persyaratan untuk mengaktifkan pemulihan berbasis CloudWatch tindakan.
Awas
Saat AWS memulihkan instance Anda karena masalah perangkat keras atau perangkat lunak yang mendasarinya, perhatikan konsekuensi berikut: data yang disimpan dalam memori volatile (RAM) akan hilang dan waktu aktif sistem operasi akan dimulai dari nol. Selain itu, dengan pemulihan berbasis CloudWatch tindakan, data pada volume penyimpanan instance juga akan hilang. Untuk membantu melindungi dari kehilangan data, kami menyarankan Anda membuat cadangan data berharga secara teratur. Untuk informasi selengkapnya tentang praktik terbaik pencadangan dan pemulihan untuk instans EC2, lihat Prakti k terbaik untuk Amazon EC 2.
Mekanisme pemulihan instans otomatis dirancang untuk instance individual. Untuk panduan membangun sistem yang tangguh, lihatMembangun sistem yang tangguh.
Topik
Konsep kunci pemulihan instans otomatis
Pemulihan instans otomatis adalah fitur Amazon EC2 yang secara otomatis mengembalikan ketersediaan instans saat terjadi kegagalan perangkat keras atau perangkat lunak yang mendasarinya, meningkatkan ketahanan dan keandalan instans EC2 Anda.
Berikut ini adalah konsep kunci pemulihan instans otomatis:
- Opsi konfigurasi
-
Dua mekanisme dapat dikonfigurasi untuk mendukung pemulihan instans otomatis:
-
Pemulihan otomatis yang disederhanakan: Diaktifkan secara default pada instans yang didukung.
-
CloudWatch pemulihan berbasis tindakan: Memerlukan konfigurasi manual pada instans yang didukung.
-
- Pemeriksaan status sistem
-
Pemeriksaan status sistem secara otomatis memantau AWS infrastruktur tempat instans EC2 Anda berjalan.
-
Jika pemeriksaan status sistem gagal, AWS memulai pemulihan instans otomatis, yang mencoba memigrasikan instance yang terpengaruh ke perangkat keras yang berbeda.
-
Pemeriksaan status sistem yang gagal menunjukkan masalah dengan perangkat keras atau perangkat lunak host, dan bukan masalah dengan instance itu sendiri. Pemulihan instans otomatis dapat memulihkan instance yang gagal dalam pemeriksaan status sistem. Namun, pemulihan instans otomatis tidak beroperasi jika hanya pemeriksaan status instance yang gagal.
-
Untuk perbedaan antara pemeriksaan status instans dan sistem, lihat Jenis pemeriksaan status.
-
- Contoh masalah perangkat keras atau perangkat lunak yang mendasarinya
-
Masalah perangkat keras atau perangkat lunak yang dapat menyebabkan pemeriksaan status sistem gagal termasuk hilangnya konektivitas jaringan, hilangnya daya sistem, masalah perangkat lunak pada host fisik, dan masalah perangkat keras pada host fisik yang memengaruhi jangkauan jaringan.
- Karakteristik instance yang dipulihkan
-
Instance yang dipulihkan identik dengan instance asli, kecuali untuk elemen yang hilang.
Elemen yang diawetkan:
-
ID Instans
-
Alamat IP publik, pribadi, dan elastis
-
Metadata instans
-
Grup penempatan
-
Volume EBS terlampir
-
Zona Ketersediaan
Elemen yang hilang:
-
Data disimpan dalam memori volatile (RAM)
-
Data yang disimpan pada volume penyimpanan instans (hanya berlaku untuk pemulihan berbasis CloudWatch tindakan)
-
Uptime sistem operasi diatur ulang ke nol
-
- Pemeriksaan status sistem pemantauan dengan CloudWatch
-
Metrik StatusCheckFailed _System di CloudWatch menunjukkan apakah pemeriksaan status sistem lulus atau gagal.
Nilai metrik:
-
0 — Pemeriksaan status sistem lulus.
-
1 — Pemeriksaan status sistem gagal.
-
- Acara di Dasbor Health
-
Selama upaya pemulihan instans otomatis, AWS mengirimkan peristiwa ke Anda Dasbor Health berdasarkan mekanisme pemulihan yang dikonfigurasi dan hasilnya:
-
Pemulihan otomatis yang disederhanakan
-
Acara sukses:
AWS_EC2_SIMPLIFIED_AUTO_RECOVERY_SUCCESS -
Peristiwa kegagalan:
AWS_EC2_SIMPLIFIED_AUTO_RECOVERY_FAILURE
-
-
CloudWatch pemulihan berbasis tindakan
-
Acara sukses:
AWS_EC2_INSTANCE_AUTO_RECOVERY_SUCCESS -
Peristiwa kegagalan:
AWS_EC2_INSTANCE_AUTO_RECOVERY_FAILURE
-
-
Perbedaan antara pemulihan otomatis yang disederhanakan dan pemulihan berbasis CloudWatch tindakan
Tabel berikut membandingkan perbedaan utama antara pemulihan otomatis yang disederhanakan dan pemulihan berbasis CloudWatch tindakan.
| Titik perbandingan | Pemulihan otomatis yang disederhanakan | CloudWatch pemulihan berbasis tindakan |
|---|---|---|
| Konfigurasi | Diaktifkan secara default pada instans yang didukung | Membutuhkan konfigurasi CloudWatch alarm dan tindakan manual |
| Fleksibilitas | Perilaku pemulihan tetap dikelola oleh AWS | Tindakan dan kondisi yang dapat disesuaikan |
| Notifikasi | Pemberitahuan dasar melalui Dasbor Health | Pemberitahuan yang dapat disesuaikan melalui SNS |
| Ukuran contoh logam | Dikecualikan | Termasuk |
| Volume penyimpanan instans terpasang saat peluncuran | Tidak didukung untuk instans yang melampirkan volume penyimpanan instans saat diluncurkan | Didukung pada jenis instance yang dipilih. Perhatikan bahwa data pada volume penyimpanan instans hilang selama pemulihan instans. |
| Waktu pemulihan | Upaya pemulihan standar | Upaya pemulihan lebih cepat daripada pemulihan otomatis yang disederhanakan |
| Masalah host diselesaikan selama migrasi | Migrasi mungkin dibatalkan dan instans tetap berada di host asli | Migrasi mungkin dibatalkan dan instans tetap berada di host asli |
| Biaya | Tidak ada biaya tambahan | Mungkin dikenakan biaya CloudWatch |
Membangun sistem yang tangguh
Meskipun pemulihan otomatis yang disederhanakan dan pemulihan berbasis CloudWatch tindakan efektif untuk mempertahankan ketersediaan instans individual, AWS merekomendasikan penerapan arsitektur ketersediaan tinggi yang memungkinkan failover lalu lintas ke instans yang sehat.
Untuk mencapai hal ini, pertimbangkan untuk menggunakan AWS layanan seperti Elastic Load Balancing (yang mendistribusikan lalu lintas masuk ke beberapa instans EC2) dan Amazon EC2 Auto Scaling (yang secara otomatis menyesuaikan jumlah instans berdasarkan permintaan dan kesehatan).
Untuk informasi selengkapnya tentang membangun sistem yang tangguh dan toleran kesalahan dengan instans EC2, lihat sumber daya berikut:
-
Kembali ke Dasar: Merancang untuk Kegagalan dengan EC2
di saluran AWS YouTube -
Arsitektur Pemulihan Bencana (DR) AWS, Bagian I: Strategi Pemulihan di Cloud
di situs Blog AWS Arsitektur -
REL11-BP02 Gagal beralih ke sumber daya yang sehat dalam Ker AWS Well-Architected angka Pil ar Keandalan