Manajer Insiden AWS Systems Manager Tidak lagi terbuka untuk pelanggan baru. Pelanggan yang sudah ada dapat terus menggunakan layanan ini seperti biasa. Untuk informasi selengkapnya, lihat perubahan Manajer Insiden AWS Systems Manager ketersediaan.
Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Mempersiapkan insiden di Incident Manager
Perencanaan untuk insiden dimulai jauh sebelum siklus hidup insiden. Seperti yang ditunjukkan oleh ilustrasi berikut, sebelum mulai merespons insiden, Anda bersiaplah dengan menyiapkan saluran obrolan, membuat rencana eskalasi, menentukan kontak, dan menentukan runbook Otomasi untuk digunakan dalam respons insiden. Kemudian, gunakan rencana respons yang menentukan bagaimana pemantauan terjadi dan apakah respons dilakukan secara otomatis. Setelah remediasi selesai, Anda dapat menganalisis insiden dan respons insiden untuk lebih menyempurnakan rencana respons Anda untuk insiden di masa mendatang.
Topik
Mengkonfigurasi set replikasi dan Temuan di Incident Manager
Mengelola rotasi responden dengan jadwal panggilan di Manajer Insiden
Membuat rencana eskalasi untuk keterlibatan responden di Manajer Insiden
Membuat dan mengintegrasikan saluran obrolan untuk responden di Manajer Insiden
Mengintegrasikan runbook Otomasi Manajer Sistem di Manajer Insiden untuk remediasi insiden
Membuat dan mengonfigurasi rencana respons di Incident Manager
Mengidentifikasi potensi penyebab insiden dari layanan lain sebagai “temuan” di Manajer Insiden
Memantau
Memantau kesehatan aplikasi AWS yang dihosting adalah kunci untuk memastikan waktu aktif dan kinerja aplikasi. Saat menentukan solusi pemantauan, pertimbangkan hal berikut:
-
Kekritisan fitur — Jika sistem gagal, seberapa kritis dampaknya terhadap pengguna hilir.
-
Kesamaan kegagalan — Seberapa sering suatu sistem gagal; sistem yang membutuhkan intervensi yang sering harus dipantau secara ketat.
-
Peningkatan latensi — Berapa banyak waktu untuk menyelesaikan tugas telah meningkat atau berkurang.
-
Client-side versus metrik sisi server — Jika ada perbedaan antara metrik terkait pada klien dan server.
-
Kegagalan ketergantungan — Kegagalan yang dapat dan harus dipersiapkan tim Anda.
Setelah membuat rencana respons, Anda dapat menggunakan solusi pemantauan Anda untuk melacak insiden secara otomatis saat terjadi di lingkungan Anda. Untuk informasi selengkapnya tentang pelacakan dan pembuatan insiden, lihatMelihat detail insiden di konsol Manajer Insiden.
Untuk informasi selengkapnya tentang merancang aplikasi dan beban kerja infrastruktur yang aman, berkinerja tinggi, tangguh, dan efisien, lihat. AWS Well-Architected