Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Pemeriksaan status untuk instans Amazon EC2
Dengan pemeriksaan status, Anda dapat dengan cepat menentukan apakah ada masalah yang dapat mencegah instans menjalankan aplikasi Anda. Amazon EC2 menyediakan empat jenis pemeriksaan status: sistem, instance, EBS terlampir, dan aplikasi. Pemeriksaan status sistem, instans, dan EBS terlampir dikelola oleh Amazon EC2 dan dijalankan secara otomatis di setiap instans. Pemeriksaan status aplikasi bersifat opt-in dan memantau respons HTTP atau HTTPS dari aplikasi yang berjalan di instans Anda. Anda dapat melihat hasil semua pemeriksaan status di konsol Amazon EC2 AWS CLI, atau AWS SDK.
Pemeriksaan status dilakukan setiap menit dan menghasilkan status lulus atau gagal. Jika semua pemeriksaan lulus, status keseluruhan instans adalah OK. Jika satu atau beberapa pemeriksaan gagal, status keseluruhannya adalah terganggu. Pemeriksaan status sistem, instans, dan EBS terlampir dikelola oleh Amazon EC2 dan tidak dapat dinonaktifkan atau dihapus. Pemeriksaan status aplikasi bersifat opt-in; Anda membuat, mengaitkan, dan mengelolanya sendiri.
Ketika pemeriksaan status gagal, CloudWatch metrik yang sesuai untuk pemeriksaan status bertambah. Untuk informasi selengkapnya, lihat Metrik pemeriksaan status. Anda dapat menggunakan metrik ini untuk membuat alarm CloudWatch yang dipicu berdasarkan hasil pemeriksaan status. Misalnya, Anda dapat membuat alarm untuk memperingatkan Anda jika pemeriksaan status gagal pada instans tertentu. Untuk informasi selengkapnya, lihat Buat CloudWatch alarm untuk instans Amazon EC2 yang gagal dalam pemeriksaan status.
Anda juga dapat membuat CloudWatch alarm Amazon yang memantau instans Amazon EC2 dan secara otomatis memulihkan instans jika menjadi rusak karena masalah yang mendasarinya. Untuk informasi selengkapnya, lihat Pemulihan instans otomatis.
Daftar Isi
Tipe pemeriksaan status
Ada empat jenis pemeriksaan status.
Pemeriksaan status sistem
Pemeriksaan status AWS sistem memantau sistem tempat instance Anda berjalan. Pemeriksaan ini mendeteksi masalah yang mendasari instans, yang memerlukan keterlibatan AWS untuk diperbaiki. Ketika pemeriksaan status sistem gagal, Anda dapat memilih untuk menunggu AWS untuk memperbaiki masalah, atau Anda dapat menyelesaikannya sendiri. Untuk instans yang didukung oleh Amazon EBS, Anda dapat menghentikan dan memulai instans sendiri, yang pada sebagian besar kasus akan membuat instans dimigrasikan ke host baru. Untuk instans yang didukung oleh penyimpanan instance (hanya didukung untuk instans Linux), Anda dapat menghentikan dan mengganti instance. Perhatikan bahwa volume penyimpanan instans bersifat sementara dan semua data akan hilang saat instans dihentikan.
Berikut adalah contoh masalah yang dapat menyebabkan kegagalan pemeriksaan status sistem:
-
Hilangnya konektivitas jaringan
-
Kehilangan daya sistem
-
Masalah perangkat lunak pada host fisik
-
Masalah perangkat keras pada hosting fisik yang memengaruhi jangkauan jaringan
Jika pemeriksaan status sistem gagal, kami menambah metrik StatusCheckFailed _System.
Instans bare metal
Jika Anda melakukan restart pada instans bare metal, pemeriksaan status sistem mungkin untuk sementara mengembalikan status gagal. Ketika instans tersedia, pemeriksaan status sistem seharusnya kembali ke status lulus.
Pemeriksaan status instans
Pemeriksaan status instans memantau perangkat lunak dan konektivitas jaringan dari masing-masing instance Anda. Amazon EC2 memeriksa kondisi instans dengan mengirimkan permintaan protokol resolusi alamat (ARP) ke antarmuka jaringan (NIC). Pemeriksaan ini mendeteksi masalah yang memerlukan keterlibatan Anda untuk memperbaikinya. Jika pemeriksaan status instans gagal, Anda biasanya harus mengatasi sendiri masalah tersebut (misalnya, dengan melakukan boot ulang instans atau membuat perubahan konfigurasi instans).
catatan
Distribusi Linux terbaru yang digunakan systemd-networkd untuk konfigurasi jaringan mungkin melaporkan pemeriksaan kesehatan secara berbeda dari distribusi sebelumnya. Selama proses boot, jenis jaringan ini dapat dimulai lebih awal dan berpotensi selesai sebelum tugas startup lain yang juga dapat memengaruhi kesehatan instans. Pemeriksaan status yang bergantung pada ketersediaan jaringan dapat melaporkan status sehat sebelum tugas lain selesai.
Berikut adalah contoh masalah yang dapat menyebabkan kegagalan pemeriksaan status instans:
-
Pemeriksaan status sistem gagal
-
Konfigurasi jaringan atau pemulaian salah
-
Memori habis
-
Sistem file rusak
-
Kernel tidak kompatibel
-
Selama reboot, pemeriksaan status instance melaporkan kegagalan sampai instance tersedia lagi.
Jika pemeriksaan status instance gagal, kami menambah metrik StatusCheckFailed _Instance.
Instans bare metal
Jika Anda melakukan restart pada instans bare metal, pemeriksaan status instance mungkin untuk sementara mengembalikan status gagal. Ketika instans tersedia, pemeriksaan status instans seharusnya kembali ke status lulus.
Pemeriksaan status EBS terlampir
Pemeriksaan status EBS terlampir memantau apakah volume Amazon EBS yang dilampirkan ke instans dapat dijangkau dan dapat menyelesaikan operasi. I/O StatusCheckFailed_AttachedEBSMetrik adalah nilai biner yang menunjukkan penurunan nilai jika satu atau lebih volume EBS yang dilampirkan ke instans tidak dapat menyelesaikan I/O operasi. Pemeriksaan status ini mendeteksi masalah yang mendasari komputasi atau infrastruktur Amazon EBS. Ketika metrik pemeriksaan status EBS yang dilampirkan gagal, Anda dapat menunggu AWS untuk menyelesaikan masalah, atau Anda dapat mengambil tindakan, seperti mengganti volume yang terpengaruh atau menghentikan dan memulai ulang instance.
Berikut adalah contoh masalah yang dapat menyebabkan kegagalan pemeriksaan status EBS terlampir:
-
Masalah perangkat keras atau perangkat lunak pada subsistem penyimpanan yang mendasari volume EBS
-
Masalah perangkat keras pada host fisik yang memengaruhi jangkauan volume EBS
-
Masalah konektivitas antara instans dan volume EBS
Anda dapat menggunakan metrik StatusCheckFailed_AttachedEBS untuk membantu meningkatkan ketahanan beban kerja Anda. Anda dapat menggunakan metrik ini untuk membuat CloudWatch alarm Amazon yang dipicu berdasarkan hasil pemeriksaan status. Misalnya, Anda dapat melakukan failover ke instans sekunder atau Zona Ketersediaan saat mendeteksi adanya dampak yang berkepanjangan. Atau, Anda dapat memantau I/O kinerja setiap volume yang dilampirkan menggunakan CloudWatch metrik EBS untuk mendeteksi dan mengganti volume yang rusak. Jika pemeriksaan status EBS menunjukkan adanya gangguan dan beban kerja Anda tidak mengarah I/O ke volume EBS terlampir, hentikan dan mulai instans untuk memindahkannya ke host baru. Ini dapat menyelesaikan masalah host mendasar yang berdampak pada jangkauan volume EBS. Untuk informasi selengkapnya, lihat CloudWatch Metrik Amazon untuk Amazon EBS.
Anda juga dapat mengonfigurasi grup Amazon EC2 Auto Scaling untuk mendeteksi kegagalan pemeriksaan status EBS yang terlampir, lalu mengganti instans yang terpengaruh dengan yang baru. Untuk informasi selengkapnya, lihat Mem antau dan mengganti instans Auto Scaling dengan volume Amazon EBS yang rusak di Panduan Pengguna Penskalaan Otomatis Amazon EC2.
catatan
Metrik pemeriksaan status EBS yang terlampir hanya tersedia untuk instans Nitro.
Pemeriksaan status aplikasi
Gunakan pemeriksaan status aplikasi untuk memantau jangkauan jaringan dan ketersediaan aplikasi yang berjalan di instans Amazon EC2 Anda. Dengan pemeriksaan status aplikasi, Anda dapat memantau respons HTTP dan HTTPS di tingkat aplikasi. Pemeriksaan status aplikasi hanya berjalan pada instans yang Anda kaitkan dengannya.
Anda mengonfigurasi setiap pemeriksaan status aplikasi untuk meminta jalur HTTP pada titik akhir aplikasi Anda dan menentukan kode respons yang menunjukkan respons yang sehat.
Anda dapat menekan pemeriksaan status aplikasi selama restart atau penerapan aplikasi untuk menghindari kegagalan positif palsu selama waktu henti yang diharapkan. Untuk informasi selengkapnya, lihat Menangani penerapan, tambalan di tempat, dan penggantian.
Berikut ini adalah contoh masalah yang dapat menyebabkan pemeriksaan status aplikasi gagal:
-
Proses aplikasi macet atau berhenti merespons
-
Aplikasi mengembalikan kode respons HTTP yang menunjukkan kesalahan layanan aplikasi internal atau masalah lainnya
-
Port aplikasi tidak dapat dijangkau
-
Masalah perangkat lunak atau perangkat keras yang mendasarinya telah menyebabkan instans Anda gagal dan menjadi tidak responsif
Jika pemeriksaan status aplikasi gagal, kami menambah met StatusCheckFailed_Application rik.
Untuk informasi tentang mengkonfigurasi pemeriksaan status aplikasi, lihatPemeriksaan status aplikasi.