View a markdown version of this page

Tujuan tingkat layanan (SLO) - Amazon CloudWatch

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Tujuan tingkat layanan (SLO)

Anda dapat menggunakan Sinyal Aplikasi untuk membuat tujuan tingkat layanan untuk operasi bisnis penting atau dependensi Anda. Dengan membuat SLO pada layanan ini, Anda akan dapat melacaknya di dasbor SLO, sehingga memberi pandangan sekilas tentang operasi yang paling penting bagi Anda.

Selain membuat tampilan cepat yang dapat digunakan operator Anda untuk melihat status operasi kritis saat ini, Anda dapat menggunakan SLOs untuk melacak kinerja jangka panjang layanan Anda, untuk memastikan bahwa mereka memenuhi harapan Anda. Jika Anda memiliki perjanjian tingkat layanan dengan pelanggan, SLOs adalah alat yang hebat untuk memastikannya terpenuhi.

Menilai kondisi kesehatan layanan Anda dengan SLO dimulai dengan menetapkan tujuan yang jelas dan terukur berdasarkan metrik-metrik performa utama— indikator tingkat layanan (SLI). SLO melacak performa SLI terhadap ambang batas dan sasaran yang Anda tetapkan, dan melaporkan seberapa jauh atau seberapa dekat performa aplikasi Anda dengan ambang batas.

Sinyal Aplikasi membantu Anda mengatur SLO pada metrik performa utama Anda. Sinyal Aplikasi secara otomatis mengumpulkan metrik Latency dan Availability untuk setiap layanan dan operasi yang ditemukannya, dan metrik-metrik ini seringkali ideal untuk digunakan sebagai SLI. Dengan pemandu pembuatan SLO, Anda dapat menggunakan metrik ini untuk SLO Anda. Anda kemudian dapat melacak status semua SLO Anda dengan menggunakan dasbor Sinyal Aplikasi.

Anda dapat mengatur SLOs pada operasi atau dependensi tertentu yang dipanggil atau digunakan layanan Anda. Anda dapat menggunakan ekspresi CloudWatch metrik atau metrik apa pun sebagai SLI, selain menggunakan Availability metrik Latency dan.

Membuat SLOs sangat penting untuk mendapatkan manfaat maksimal dari Sinyal CloudWatch Aplikasi. Setelah membuat SLO, Anda dapat melihat statusnya di konsol Sinyal Aplikasi untuk melihat layanan dan operasi penting Anda yang berperforma baik dan mana yang tidak sehat dengan cepat. Memiliki SLO untuk dilacak akan memberikan manfaat-manfaat utama berikut:

  • Lebih mudah bagi para operator layanan Anda untuk melihat kondisi kesehatan operasional saat ini dari layanan kritis yang diukur berdasarkan SLI. Kemudian mereka dapat dengan cepat melakukan penilaian awal dan mengidentifikasi layanan dan operasi yang sedang dalam kondisi tidak sehat.

  • Anda dapat melacak performa layanan Anda terhadap sasaran bisnis yang terukur dalam jangka waktu yang lebih lama.

Dengan memilih apa yang akan diatur SLO, Anda dapat memprioritaskan hal apa saja yang penting bagi Anda. Dasbor Sinyal Aplikasi secara otomatis akan menyajikan informasi mengenai apa yang telah Anda prioritaskan.

Saat Anda membuat SLO, Anda juga dapat memilih untuk membuat CloudWatch alarm pada saat yang sama untuk memantau SLOs. Anda dapat mengatur alarm yang memantau terjadinya pelanggaran ambang batas, dan juga alarm untuk tingkat-tingkat peringatan. Alarm-alarm ini dapat secara otomatis memberikan notifikasi kepada Anda jika metrik-metrik SLO melanggar ambang batas yang Anda tetapkan, atau jika mendekati ambang peringatan. Misalnya, SLO yang mendekati ambang peringatannya dapat memberi tahu Anda bahwa tim Anda mungkin perlu memperlambat churn dalam aplikasi untuk memastikan bahwa tujuan performa jangka panjang terpenuhi.

Konsep-konsep SLO

Suatu SLO mencakup komponen-komponen berikut:

  • Indikator tingkat layanan (SLI), yang merupakan sebuah metrik performa utama yang Anda tentukan. Ini mewakili tingkat performa yang diinginkan untuk aplikasi Anda. Sinyal Aplikasi secara otomatis mengumpulkan metrik kunci Latency dan Availability untuk setiap layanan dan operasi yang ditemukannya, dan metrik-metrik kunci ini seringkali menjadi metrik yang ideal untuk mengatur SLO.

    Anda memilih ambang batas yang akan Anda gunakan untuk SLI Anda. Seperti, 200 ms untuk latensi.

  • Tujuan atau tujuan pencapaian, yang merupakan persentase waktu atau permintaan yang diharapkan SLI memenuhi ambang batas selama setiap interval waktu. Interval waktu tersebut bisa dalam hitungan jam atau selama setahun.

    Interval dapat berupa interval kalender atau interval bergulir.

    • Interval kalender selaras dengan kalender, seperti SLO yang dilacak per bulan. CloudWatch secara otomatis menyesuaikan angka kesehatan, anggaran, dan pencapaian berdasarkan jumlah hari dalam sebulan. Interval kalender lebih cocok untuk tujuan-tujuan bisnis yang diukur berdasarkan kalender yang sudah diselaraskan.

    • Interval bergulir dihitung secara bergulir. Interval bergulir lebih cocok untuk melakukan pelacakan terhadap pengalaman pengguna terbaru dari aplikasi Anda.

  • Periode adalah jangka waktu yang lebih pendek, dan banyak periode membentuk interval. Performa aplikasi dibandingkan dengan SLI selama masing-masing periode dalam interval. Untuk setiap periode, aplikasi ditentukan telah mencapai atau tidak mencapai performa yang diperlukan.

Sebagai contoh, tujuan 99% dengan interval kalender satu hari dan periode 1 menit berarti bahwa aplikasi harus memenuhi atau mencapai ambang keberhasilan selama 99% dari periode 1 menit di siang hari. Jika ya, artinya SLO terpenuhi untuk hari itu. Hari berikutnya adalah interval evaluasi baru. Aplikasi harus memenuhi atau mencapai ambang keberhasilan selama 99% dari periode 1 menit selama hari kedua untuk memenuhi SLO untuk hari kedua itu.

SLI dapat didasarkan pada salah satu metrik aplikasi standar baru yang dikumpulkan Sinyal Aplikasi. Atau, itu bisa berupa ekspresi CloudWatch metrik atau metrik apa pun. Metrik aplikasi standar yang dapat Anda gunakan untuk SLI adalah Latency dan Availability. Availability mewakili respons yang berhasil dibagi dengan total permintaan. Ini dihitung sebagai (1 - Tingkat Kegagalan)*100, di mana respons Kegagalan adalah kesalahan 5xx. Respons keberhasilan adalah respons tanpa kesalahan 5XX. Respons 4XX dianggap berhasil.

Selain membuat SLOs pada satu operasi atau pada semua operasi layanan, Anda dapat membuat SLOs komposit yang memantau subset operasi untuk layanan. SLOs komposit menggabungkan Availability metrik di beberapa operasi, memberi Anda tampilan terpadu keandalan untuk sekelompok operasi terkait. Anda dapat memilih antara 2 dan 20 operasi untuk dimasukkan dalam SLO komposit. Untuk informasi selengkapnya, lihat Buat SLO komposit pada beberapa operasi.

Hitung anggaran kesalahan dan pencapaian untuk SLOs berbasis periode

Ketika Anda melihat informasi tentang SLO, Anda melihat status kesehatan saat ini dan anggaran kesalahannya. Anggaran kesalahan adalah jumlah waktu dalam interval yang dapat menembus ambang batas tetapi tetap membiarkan SLO dipenuhi. Anggaran kesalahan total adalah jumlah total waktu pelanggaran yang dapat ditoleransi di seluruh interval. Sisa anggaran kesalahan adalah sisa jumlah waktu pelanggaran yang dapat ditoleransi selama interval saat ini. Ini setelah jumlah waktu pelanggaran yang telah terjadi telah dikurangi total anggaran kesalahan.

Gambar berikut menggambarkan konsep anggaran pencapaian dan kesalahan untuk suatu tujuan dengan interval 30 hari, periode 1 menit, dan tujuan pencapaian 99%. 30 hari mencakup 43.200 periode 1 menit. 99% dari 43.200 adalah 42.768, jadi 42.768 menit selama sebulan harus sehat agar SLO terpenuhi. Sejauh ini dalam interval saat ini, 130 dari periode 1 menit berada kondisi tidak sehat.

Bagan batang yang menunjukkan total periode dalam interval SLO dengan angka anggaran pencapaian dan kesalahan.

Menentukan keberhasilan dalam masing-masing periode

Dalam masing-masing periode, data SLI akan dikumpulkan menjadi satu titik data berdasarkan statistik yang digunakan untuk SLI. Titik data ini mewakili durasi periode seluruhnya. Titik data tunggal itu dibandingkan dengan ambang batas SLI untuk menentukan apakah periode tersebut dalam kondisi sehat, atau tidak. Melihat periode yang tidak sehat selama rentang waktu saat ini di dasbor dapat mengingatkan para operator layanan Anda bahwa layanan perlu diprioritaskan.

Jika periode ditentukan tidak sehat, seluruh panjang periode dihitung sebagai gagal terhadap anggaran kesalahan. Melacak anggaran kesalahan memungkinkan Anda mengetahui apakah layanan mencapai performa yang Anda inginkan dalam jangka waktu yang lebih lama.

Pengecualian jendela waktu

Pengecualian jendela waktu adalah blok waktu dengan tanggal mulai dan akhir yang ditentukan. Periode waktu ini dikecualikan dari metrik kinerja SLO dan Anda dapat menjadwalkan jendela pengecualian waktu satu kali atau berulang. Misalnya, pemeliharaan terjadwal.

catatan
  • Untuk SLOs berbasis periode, data SLI di jendela pengecualian dianggap sebagai non-pelanggaran.

  • Untuk SLOs berbasis permintaan, semua permintaan baik dan buruk di jendela pengecualian dikecualikan.

  • Ketika interval untuk SLO berbasis permintaan sepenuhnya dikecualikan, metrik tingkat pencapaian default 100% diterbitkan.

  • Anda hanya dapat menentukan jendela waktu dengan tanggal mulai di masa mendatang.

Hitung anggaran kesalahan dan pencapaian untuk SLOs berbasis permintaan

Setelah Anda membuat SLO, Anda dapat mengambil laporan anggaran kesalahan untuk itu. Anggaran kesalahan adalah jumlah permintaan bahwa aplikasi Anda dapat tidak sesuai dengan tujuan SLO, dan aplikasi Anda masih memenuhi tujuan. Untuk SLO berbasis permintaan, anggaran kesalahan yang tersisa bersifat dinamis dan dapat meningkat atau berkurang, tergantung pada rasio permintaan yang baik terhadap total permintaan

Tabel berikut menggambarkan perhitungan untuk SLO berbasis permintaan dengan interval 5 hari dan tujuan pencapaian 85%. Dalam contoh ini, asumsikan tidak ada lalu lintas sebelum Hari 1. SLO tidak memenuhi tujuan pada Hari ke-10.

catatan

Untuk SLOs berbasis permintaan, TotalRequestCountPerMinute dan BadRequestCountPerMinute dipancarkan sebagai metrik tambahan dibandingkan dengan metrik SLO berbasis periode. Metrik ini disediakan untuk tujuan pengamatan dan tidak digunakan sebagai input untuk perhitungan tingkat pencapaian.

Karena metrik ini dihasilkan dari data metrik yang dievaluasi secara berkala, nilainya terkadang berbeda dari jumlah permintaan yang diharapkan karena waktu atau penundaan publikasi metrik. Perbedaan tersebut tidak memengaruhi perhitungan pencapaian SLO, yang dihitung secara independen dari metrik per menit yang dipancarkan ini.

Waktu Jumlah permintaan Permintaan buruk Jumlah permintaan akumulatif dalam 5 hari terakhir Jumlah permintaan bagus akumulatif dalam 5 hari terakhir Request-based pencapaian Total permintaan anggaran Permintaan anggaran yang tersisa

Hari 1

10 1

10

9

9/10 = 90%

1.5

0.5

Hari 2

5

1

15

13

13/15= 86%

2.3

0.3

Hari 3

1

1

16

13

13/16= 81%

2.4

-0.6

Hari 4

24

0

40

37

37/40= 92%

6.0

3.0

Hari 5

20

5

60

52

52/60= 87%

9.0

1.0

Hari 6

6

2

56

47

47/56= 84%

8.4

-0.6

Hari 7

10

3

61

50

50/61= 82%

9.2

-1.8

Hari 8

15

6

75

59

59/75= 79%

11.3

-4.7
Hari 9

12

1

63

46

46/63= 73%

9.5

-7.5

Hari 10

5

57

40

40/57= 70%

8.5

-8.5

Pencapaian akhir selama 5 hari terakhir

70%

Hitung laju pembakaran dan secara opsional mengatur alarm laju pembakaran

Anda dapat menggunakan Sinyal Aplikasi untuk menghitung tingkat pembakaran untuk tujuan tingkat layanan Anda. Tingkat pembakaran adalah metrik yang menunjukkan seberapa cepat layanan menghabiskan anggaran kesalahan, relatif terhadap tujuan pencapaian SLO. Ini dinyatakan sebagai faktor ganda dari tingkat kesalahan dasar.

Tingkat pembakaran dihitung sesuai dengan tingkat kesalahan dasar, yang tergantung pada tujuan pencapaian. Tujuan pencapaian adalah persentase periode waktu yang sehat atau permintaan yang berhasil yang harus dicapai untuk memenuhi tujuan SLO. Tingkat kesalahan dasar adalah (100% - persentase tujuan pencapaian), dan angka ini akan menggunakan anggaran kesalahan lengkap yang tepat pada akhir interval waktu SLO. Jadi SLO dengan tujuan pencapaian 99% akan memiliki tingkat kesalahan dasar 1%.

Memantau tingkat pembakaran memberi tahu kami seberapa jauh Anda dari tingkat kesalahan dasar. Sekali lagi mengambil contoh tujuan pencapaian 99%, berikut ini benar:

  • Tingkat pembakaran = 1: Jika laju pembakaran tetap tepat pada tingkat kesalahan dasar sepanjang waktu, Anda memenuhi tujuan SLO dengan tepat.

  • Tingkat pembakaran < 1: Jika laju pembakaran lebih rendah dari tingkat kesalahan dasar, Anda berada di jalur untuk melebihi target SLO.

  • Tingkat pembakaran > 1: Jika tingkat pembakaran lebih tinggi dari tingkat kesalahan dasar, Anda memiliki peluang untuk gagal mencapai tujuan SLO.

Saat Anda membuat laju pembakaran untuk SLOs Anda, Anda juga dapat memilih untuk membuat CloudWatch alarm pada saat yang sama untuk memantau laju pembakaran. Anda dapat menetapkan ambang batas untuk tingkat pembakaran dan alarm dapat secara otomatis memberi tahu Anda jika metrik laju pembakaran melanggar ambang batas yang Anda tetapkan. Misalnya, tingkat pembakaran mendekati ambang batas dapat memberi tahu Anda bahwa SLO membakar anggaran kesalahan lebih cepat daripada yang dapat ditoleransi tim Anda dan tim Anda mungkin perlu memperlambat churn dalam aplikasi untuk memastikan bahwa tujuan kinerja jangka panjang terpenuhi.

Membuat alarm akan menimbulkan biaya. Untuk informasi selengkapnya tentang CloudWatch harga, lihat CloudWatch Harga Amazon.

Hitung laju pembakaran

Untuk menghitung laju pembakaran, Anda harus menentukan jendela tampilan kembali. Jendela look-back adalah durasi waktu untuk mengukur tingkat kesalahan.

burn rate = error rate over the look-back window / (100% - attainment goal)

catatan

Ketika tidak ada data untuk periode laju pembakaran, Sinyal Aplikasi menghitung laju pembakaran berdasarkan pencapaian.

Tingkat kesalahan dihitung sebagai rasio jumlah peristiwa buruk atas jumlah total peristiwa selama jendela laju pembakaran:

  • Untuk SLOs berbasis periode, tingkat kesalahan dihitung sebagai periode buruk dibagi dengan total periode. Total periode mewakili keseluruhan periode selama jendela tampilan kembali.

  • Untuk SLOs berbasis permintaan, ini adalah ukuran permintaan buruk dibagi dengan total permintaan. Jumlah total permintaan adalah jumlah permintaan selama jendela look-back.

Jendela lihat kembali harus kelipatan dari waktu periode SLO, dan harus kurang dari interval SLO.

Tentukan ambang batas yang sesuai untuk alarm tingkat pembakaran

Saat Anda mengonfigurasi alarm laju pembakaran, Anda harus memilih nilai untuk laju pembakaran sebagai ambang alarm. Nilai ambang batas ini tergantung pada panjang interval SLO dan jendela tampilan kembali, dan tergantung pada metode atau model mental yang ingin diadopsi tim Anda. Ada dua metode utama yang tersedia untuk menentukan ambang batas.

Metode 1: Tentukan persentase perkiraan total anggaran kesalahan yang ingin dibakar tim Anda di jendela tampilan kembali.

Jika Anda ingin khawatir ketika X% dari perkiraan anggaran kesalahan dihabiskan dalam jam melihat kembali tingkat pembakaran terakhir, ambang batas tingkat pembakaran adalah sebagai berikut:

burn rate threshold = X% * SLO interval length / look-back window size

Misalnya, 5% dari anggaran kesalahan 30 hari (720 jam) yang dihabiskan lebih dari satu jam membutuhkan tingkat pembakaran. 5% * 720 / 1 = 36 Oleh karena itu, jika jendela tampilan kembali laju pembakaran adalah1 jam, Anda menetapkan ambang batas laju pembakaran menjadi 36.

Anda dapat menggunakan CloudWatch konsol untuk membuat alarm laju pembakaran menggunakan metode ini. Anda dapat menentukan angka X, dan ambang batas ditentukan menggunakan rumus di atas.

Panjang interval SLO ditentukan berdasarkan jenis interval SLO:

  • Untuk SLOs dengan interval bergulir, ini adalah panjang interval dalam jam.

  • Untuk SLOs dengan interval berbasis kalender:

    • Jika unitnya adalah hari atau minggu, itu adalah panjang interval dalam jam.

    • Jika unitnya sebulan, 30 hari diambil sebagai perkiraan panjang dan mengubahnya menjadi jam.

Metode 2: Tentukan waktu kehabisan anggaran unit untuk interval berikutnya

Agar alarm memberi tahu Anda ketika tingkat kesalahan saat ini di jendela tampilan kembali terbaru menunjukkan bahwa waktu hingga kehabisan anggaran kurang dari X jam lagi (dengan asumsi anggaran yang tersisa saat ini 100%), Anda dapat menggunakan rumus berikut untuk menentukan ambang batas tingkat pembakaran.

burn rate threshold = SLO interval length / X

Perhatikan bahwa waktu hingga kehabisan anggaran (X) dalam rumus di atas mengasumsikan bahwa total anggaran yang tersisa saat ini 100%, dan oleh karena itu tidak memperhitungkan jumlah anggaran yang telah dibakar dalam interval ini. Anda juga dapat menganggapnya sebagai waktu sampai habis anggaran untuk interval berikutnya.

Panduan untuk alarm tingkat pembakaran

Sebagai contoh, mari kita ambil SLO dengan interval rolling 28 hari. Menyetel alarm laju pembakaran untuk SLO ini melibatkan dua langkah:

  1. Atur laju pembakaran dan jendela tampilan kembali.

  2. Kreta CloudWatch alarm yang memantau tingkat pembakaran.

Untuk memulai, tentukan berapa banyak dari total anggaran kesalahan yang bersedia dilakukan layanan dalam jangka waktu tertentu. Dengan kata lain, tetapkan tujuan Anda dengan menggunakan kalimat ini: “Saya ingin mendapat peringatan ketika X% dari total anggaran kesalahan saya dikonsumsi dalam M menit.”

Misalnya, Anda mungkin ingin menetapkan tujuan untuk diperingatkan ketika 2% dari total anggaran kesalahan dikonsumsi dalam waktu 60 menit.

Untuk mengatur laju pembakaran, pertama-tama Anda menentukan jendela look-back. Jendela tampilan kembali adalah M, yang dalam contoh ini adalah 60 menit.

Selanjutnya, Anda membuat CloudWatch alarm. Ketika Anda melakukannya, Anda harus menentukan ambang batas untuk laju pembakaran. Jika tingkat pembakaran melebihi ambang ini, alarm akan memberi tahu Anda. Untuk menemukan ambang batas, gunakan rumus berikut:

burn rate threshold = X% * SLO interval length/ look-back window size

Dalam contoh ini, X adalah 2 karena Anda ingin diperingatkan jika 2% dari anggaran kesalahan dikonsumsi dalam waktu 60 menit. Panjang intervalnya adalah 40.320 menit (28 hari), dan 60 menit adalah jendela melihat kembali, jadi jawabannya adalah:

burn rate threshold = 2% * 40,320 / 60 = 13.44.

Dalam contoh ini, Anda akan menetapkan 13,44 sebagai ambang alarm.

Beberapa alarm dengan jendela yang berbeda

Dengan mengatur alarm pada beberapa jendela look-back, Anda dapat dengan cepat mendeteksi peningkatan tingkat kesalahan yang tajam dengan jendela pendek dan pada saat yang sama mendeteksi peningkatan tingkat kesalahan yang lebih kecil yang akhirnya menghabiskan anggaran kesalahan jika tidak diperhatikan.

Selain itu, Anda dapat mengatur alarm kom posit pada laju pembakaran dengan jendela panjang dan pada laju pembakaran dengan jendela pendek (1/12th dari jendela panjang), dan diberitahu hanya ketika kedua tingkat pembakaran menembus ambang batas. Dengan cara ini, Anda dapat memastikan bahwa Anda diperingatkan hanya untuk situasi yang masih terjadi. Untuk informasi selengkapnya tentang alarm komposit di CloudWatch, lihatMembuat sebuah alarm gabungan.

catatan

Anda dapat mengatur alarm metrik pada laju pembakaran saat Anda membuat laju pembakaran. Untuk mengatur alarm compoaite pada beberapa alarm laju pembakaran, Anda harus menggunakan instruksi di. Membuat sebuah alarm gabungan

Satu strategi alarm komposit yang direkomendasikan dalam buku kerja Rekayasa Keandalan Situs Google mencakup tiga alarm komposit:

  • Satu alarm komposit yang menonton sepasang alarm, satu dengan jendela satu jam dan satu dengan jendela lima menit.

  • Alarm komposit kedua yang menonton sepasang alarm, satu dengan jendela enam jam dan satu dengan jendela 30 menit.

  • Alarm komposit ketiga yang menonton sepasang alarm, satu dengan jendela tiga hari dan satu dengan jendela enam jam.

Langkah-langkah untuk melakukan pengaturan ini adalah sebagai berikut:

  1. Buat lima tingkat pembakaran, dengan jendela lima menit, 30 menit, satu jam, enam jam, dan tiga hari.

  2. Buat tiga pasang CloudWatch alarm berikut. Setiap pasangan menyertakan satu jendela panjang dan satu jendela pendek 1/12th yang merupakan jendela panjang, dan ambang batas ditentukan dengan menggunakan langkah-langkah di dalamTentukan ambang batas yang sesuai untuk alarm tingkat pembakaran. Saat Anda menghitung ambang batas untuk setiap alarm dalam pasangan, gunakan jendela look-back yang lebih panjang dari pasangan dalam perhitungan Anda.

    • Alarm pada tingkat pembakaran 1 jam dan 5 menit (ambang batas ditentukan oleh 2% dari total anggaran)

    • Alarm pada tingkat pembakaran 6 jam dan 30 menit (ambang batas ditentukan oleh 5% dari total anggaran)

    • Alarm pada tingkat pembakaran 3 hari dan 6 jam (ambang batas ditentukan oleh 10% dari total anggaran)

  3. Untuk masing-masing pasangan ini, buat alarm komposit untuk mendapatkan peringatan ketika kedua alarm individu masuk ke status ALARM. Untuk informasi selengkapnya tentang membuat alarm komposit, lihatMembuat sebuah alarm gabungan.

    Misalnya, jika alarm Anda untuk pasangan pertama (jendela satu jam dan jendela lima menit) diberi nama OneHourBurnRate danFiveMinuteBurnRate, aturan alarm kom CloudWatch posit akan menjadi ALARM(OneHourBurnRate) AND ALARM(FiveMinuteBurnRate)

Strategi sebelumnya hanya mungkin untuk SLOs dengan panjang interval setidaknya tiga jam. Untuk SLOs dengan panjang interval yang lebih pendek, sar CloudWatch ankan Anda memulai dengan satu pasang alarm laju pembakaran di mana satu alarm memiliki jendela lihat kembali yang merupakan jendela tampilan kembali 1/12th dari alarm lainnya. Kemudian atur alarm komposit pada pasangan ini.

Membuat SLO

Kami menyarankan Anda untuk mengatur SLO latensi dan ketersediaan pada aplikasi penting Anda. Metrik yang dikumpulkan Sinyal Aplikasi ini selaras dengan tujuan bisnis bersama.

Anda juga dapat mengatur SLOs pada CloudWatch metrik atau ekspresi matematika metrik apa pun yang menghasilkan satu deret waktu.

Pertama kali Anda membuat SLO di akun Anda, CloudWatch secara otomatis membuat peran AWSServiceRoleForCloudWatchApplicationSignals terkait layanan di akun Anda, jika itu belum ada. Peran terkait layanan ini memungkinkan CloudWatch untuk mengumpulkan data CloudWatch Log, X-Ray melacak data, data CloudWatch metrik, dan menandai data dari aplikasi di akun Anda. Untuk informasi selengkapnya tentang CloudWatch peran terkait layanan, lihat. Menggunakan peran terkait layanan untuk CloudWatch

Saat Anda membuat SLO, Anda menentukan apakah itu SLO berbasis periode atau SLO berbasis permintaan. Setiap jenis SLO memiliki cara berbeda untuk mengevaluasi kinerja aplikasi Anda terhadap tujuan pencapaiannya.

  • SLO berbasis periode menggunakan periode waktu yang ditentukan dalam interval waktu total yang ditentukan. Untuk setiap periode waktu, Sinyal Aplikasi menentukan apakah aplikasi memenuhi tujuannya. Tingkat pencapaian dihitung sebagai. number of good periods/number of total periods

    Misalnya, untuk SLO berbasis periode, memenuhi tujuan pencapaian 99,9% berarti bahwa dalam interval Anda, aplikasi Anda harus memenuhi tujuan kinerjanya setidaknya selama 99,9% periode waktu.

  • SLO berbasis permintaan tidak menggunakan periode waktu yang telah ditentukan sebelumnya. Sebaliknya, SLO mengukur number of good requests/number of total requests selama interval. Kapan saja, Anda dapat menemukan rasio permintaan yang baik terhadap total permintaan untuk interval hingga stempel waktu yang Anda tentukan, dan mengukur rasio itu terhadap tujuan yang ditetapkan di SLO Anda.

Buat SLO berbasis periode

Gunakan prosedur berikut untuk membuat SLO berbasis periode.

Untuk membuat SLO berbasis periode
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih Buat SLO.

  4. Untuk Mengatur Indikator Tingkat Layanan(SLI), lakukan salah satu hal berikut:

    • Untuk mengatur SLO pada operasi layanan, semua operasi, atau ketergantungan layanan, menggunakan salah satu metrik aplikasi standar Latency atauAvailability:

      1. Untuk Jenis, pilih Layanan.

      2. Pilih akun yang akan dipantau oleh SLO ini.

      3. Pilih layanan yang akan dipantau oleh SLO ini.

      4. Untuk Jenis, pilih salah satu dari berikut ini:

        • Operasi Layanan — untuk membuat SLO pada operasi layanan, semua operasi, atau subset operasi.

        • Service De pendency — untuk membuat SLO pada ketergantungan layanan.

      5. Jika Anda memilih Oper asi Layanan, pilih operasi yang akan dipantau oleh SLO ini. Untuk membuat SLO tingkat layanan yang memantau kesehatan keseluruhan layanan Anda di semua operasi, pilih Semua Operasi. Jika tidak, pilih operasi tertentu untuk dipantau.

        Untuk membuat SLO yang memantau subset operasi, lihatBuat SLO komposit pada beberapa operasi.

      6. Jika Anda memilih Service Dependency, lakukan hal berikut:

        1. Di bawah Pilih operasi, pilih satu operasi tertentu atau pilih Semua operasi untuk menggunakan metrik dari semua operasi layanan ini yang memanggil dependensi.

        2. Di bawah Pilih ketergantungan, cari dan pilih dependensi yang diperlukan yang ingin Anda ukur keandalannya.

          Setelah Anda memilih ketergantungan, Anda dapat melihat grafik yang diperbarui dan data historis berdasarkan ketergantungan.

      7. Untuk Pilih metode perhitungan, pilih Periode.

        Drop-down Pilih Layanan dan Pilih operasi diisi oleh layanan dan operasi yang telah aktif dalam 24 jam terakhir.

      8. Pilih Ketersediaan atau Latensi dan kemudian atur ambang batas.

    • Untuk mengatur SLO pada CloudWatch metrik atau ekspresi matematika CloudWatch metrik apa pun:

      1. Untuk Jenis, pilih CloudWatch Metrik.

      2. Pilih Pilih CloudWatch metrik.

        Layar Pilih metrik muncul. Gunakan tab Jelajahi atau Kueri untuk menemukan metrik yang Anda inginkan, atau membuat ekspresi matematika metrik.

        Setelah Anda memilih metrik yang Anda inginkan, pilih tab Metrik bergrafik dan pilih Statistik dan Periode yang akan digunakan untuk SLO. Kemudian pilih Pilih metrik.

        Untuk informasi selengkapnya tentang metrik ini, silakan lihat Membuat sebuah grafik metrik dan Menambahkan ekspresi matematika ke CloudWatch grafik.

      3. Untuk Pilih metode perhitungan, pilih Periode.

      4. Untuk Atur kondisi, pilih operator perbandingan dan ambang batas untuk SLO yang akan digunakan sebagai indikator keberhasilan.

  5. Jika Anda memilih Layanan pada langkah 4, tetapkan panjang periode untuk SLO ini.

  6. Masukkan nama untuk SLO. Menyertakan nama layanan atau operasi, bersama kata kunci yang sesuai seperti latensi atau ketersediaan, akan membantu Anda mengidentifikasi apa yang ditunjukkan status SLO selama triase dengan cepat.

  7. Atur interval dan tujuan pencapaian untuk SLO. Untuk informasi selengkapnya tentang interval dan pencapaian tujuan dan bagaimana keduanya bekerja sama, silakan lihat Konsep-konsep SLO.

  8. (Opsional) Untuk Set SLO burn rate lakukan hal berikut:

    • Atur panjang (dalam menit) jendela look-back untuk laju pembakaran. Untuk informasi tentang cara memilih panjang ini, lihatPanduan untuk alarm tingkat pembakaran.

    • Untuk membuat lebih banyak laju pembakaran untuk SLO ini, pilih Tambahkan lebih banyak laju pembakaran dan atur jendela look-back untuk tingkat pembakaran tambahan.

  9. (Opsional) Buat alarm laju pembakaran dengan melakukan hal berikut:

    • Di bawah Setel alarm tingkat pembakaran, pilih kotak centang untuk setiap tingkat pembakaran yang ingin Anda buat alarmnya. Untuk masing-masing alarm ini, lakukan hal berikut:

      • Tentukan topik Amazon SNS yang akan digunakan untuk pemberitahuan saat alarm masuk ke status ALARM.

      • Tetapkan ambang batas tingkat pembakaran atau tentukan persentase perkiraan total anggaran yang dibakar di jendela tampilan kembali terakhir yang ingin Anda pertahankan di bawahnya. Jika Anda menetapkan persentase perkiraan total anggaran yang dibakar, ambang batas tingkat pembakaran dihitung untuk Anda dan digunakan dalam alarm. Untuk memutuskan ambang batas yang akan ditetapkan atau untuk memahami bagaimana opsi ini digunakan untuk menghitung ambang batas laju pembakaran, lihatTentukan ambang batas yang sesuai untuk alarm tingkat pembakaran.

  10. (Opsional) Tetapkan satu atau lebih CloudWatch alarm atau ambang peringatan untuk SLO.

    1. CloudWatch alarm dapat menggunakan Amazon SNS untuk secara proaktif memberi tahu Anda jika aplikasi tidak sehat berdasarkan kinerja SLI-nya.

      Untuk membuat alarm, pilih salah satu kotak centang alarm dan masukkan atau buat topik Amazon SNS yang akan digunakan untuk notifikasi saat alarm masuk ke status ALARM. Untuk informasi selengkapnya tentang CloudWatch alarm, lihatMenggunakan CloudWatch alarm Amazon. Membuat alarm akan menimbulkan biaya. Untuk informasi selengkapnya tentang CloudWatch harga, lihat CloudWatch Harga Amazon.

    2. Jika Anda mengatur ambang batas peringatan, peringatan ini muncul di layar Sinyal Aplikasi untuk membantu Anda mengidentifikasi SLO yang berisiko tidak terpenuhi, bahkan jika saat ini sehat.

      Untuk mengatur ambang batas peringatan, masukkan nilai ambang batas di Ambang batas peringatan. Ketika anggaran kesalahan SLO lebih rendah dari ambang batas peringatan, SLO ditandai dengan Peringatan di beberapa layar Sinyal Aplikasi. Ambang batas peringatan juga muncul pada grafik anggaran kesalahan. Anda juga dapat membuat alarm peringatan SLO yang didasarkan pada ambang batas peringatan.

  11. (Opsional) Untuk Mengatur pengecualian jendela waktu SLO, lakukan hal berikut:

    • Di bawah Kecualikan jendela waktu, atur jendela waktu yang akan dikecualikan dari metrik kinerja SLO.

      Anda dapat memilih Atur jendela waktu dan masuk ke jendela Mulai untuk setiap jam atau bulan atau Anda dapat memilih A tur jendela waktu dengan CRON dan masukkan ekspresi CRON.

    • Di bawah Ulangi, atur apakah pengecualian jendela waktu ini berulang atau tidak.

    • (Opsional) Di bawah Tambah alasan, Anda dapat memilih untuk memasukkan alasan pengecualian jendela waktu. Misalnya, pemeliharaan terjadwal.

    • Pilih Tambahkan jendela waktu untuk menambahkan hingga 10 jendela pengecualian waktu.

  12. Untuk menambahkan tanda ke SLO ini, silakan pilih tab Tanda dan kemudian pilih Tambahkan tanda baru. Tanda dapat membantu Anda mengelola, mengidentifikasi, mengatur, dan memfilter sumber daya. Untuk informasi selengkapnya tentang penandaan, silakan lihat Menandai sumber daya AWS Anda.

    catatan

    Jika aplikasi yang terkait dengan SLO ini terdaftar AWS Service Catalog AppRegistry, Anda dapat menggunakan awsApplication tag untuk mengaitkan SLO ini dengan aplikasi itu di AppRegistry. Untuk informasi lebih lanjut, lihat Apa itu AppRegistry?

  13. Pilih Buat SLO. Jika Anda juga memilih untuk membuat satu atau beberapa alarm, nama tombol berubah sehingga mencerminkan hal ini.

Buat SLO berbasis permintaan

Gunakan prosedur berikut untuk membuat SLO berbasis permintaan.

Untuk membuat SLO berbasis permintaan
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih Buat SLO.

  4. Untuk Mengatur Indikator Tingkat Layanan(SLI), lakukan salah satu hal berikut:

    • Untuk mengatur SLO pada operasi layanan, semua operasi, atau ketergantungan layanan, menggunakan salah satu metrik aplikasi standar Latency atauAvailability:

      1. Untuk Jenis, pilih Layanan.

      2. Pilih layanan yang akan dipantau oleh SLO ini.

      3. Untuk Jenis, pilih salah satu dari berikut ini:

        • Operasi Layanan — untuk membuat SLO pada operasi layanan, semua operasi, atau subset operasi.

        • Service De pendency — untuk membuat SLO pada ketergantungan layanan.

      4. Jika Anda memilih Oper asi Layanan, pilih operasi yang akan dipantau oleh SLO ini. Untuk membuat SLO tingkat layanan yang memantau kesehatan keseluruhan layanan Anda di semua operasi, pilih Semua Operasi. Jika tidak, pilih operasi tertentu untuk dipantau.

        Untuk membuat SLO yang memantau subset operasi, lihatBuat SLO komposit pada beberapa operasi.

      5. Jika Anda memilih Service Dependency, lakukan hal berikut:

        1. Di bawah Pilih operasi, pilih satu operasi tertentu atau pilih Semua operasi untuk menggunakan metrik dari semua operasi layanan ini yang memanggil dependensi.

        2. Di bawah Pilih ketergantungan, cari dan pilih dependensi yang diperlukan yang ingin Anda ukur keandalannya.

          Setelah Anda memilih ketergantungan, Anda dapat melihat grafik yang diperbarui dan data historis berdasarkan ketergantungan.

      6. Untuk Pilih metode perhitungan, pilih Per mintaan.

      7. Drop-down Pilih Layanan dan Pilih operasi diisi oleh layanan dan operasi yang telah aktif dalam 24 jam terakhir.

      8. Pilih Keter sediaan atau Latensi. Jika Anda memilih Latensi, tetapkan ambang batas.

    • Untuk mengatur SLO pada CloudWatch metrik atau ekspresi matematika CloudWatch metrik apa pun:

      1. Untuk Jenis, pilih CloudWatch Metrik.

      2. Untuk Tentukan permintaan target, lakukan hal berikut:

        1. Pilih apakah Anda ingin mengukur Permintaan Baik atau Permintaan Buruk.

        2. Pilih Pilih CloudWatch metrik. Metrik ini akan menjadi pembilang rasio permintaan target terhadap total permintaan. Jika Anda menggunakan metrik latensi, gunakan statistik Trimming count (TC). Jika ambang batas adalah 9 ms dan Anda menggunakan operator perbandingan kurang dari (<), maka gunakan ambang TC (:ambang batas - 1). Untuk informasi lebih lanjut tentang TC, lihatSintaks.

          Layar Pilih metrik muncul. Gunakan tab Jelajahi atau Kueri untuk menemukan metrik yang Anda inginkan, atau membuat ekspresi matematika metrik.

      3. Untuk Tentukan total permintaan, pilih CloudWatch metrik yang ingin Anda gunakan untuk sumber. Metrik ini akan menjadi penyebut rasio permintaan target terhadap total permintaan.

        Layar Pilih metrik muncul. Gunakan tab Jelajahi atau Kueri untuk menemukan metrik yang Anda inginkan, atau membuat ekspresi matematika metrik.

        Setelah Anda memilih metrik yang Anda inginkan, pilih tab Metrik bergrafik dan pilih Statistik dan Periode yang akan digunakan untuk SLO. Kemudian pilih Pilih metrik.

        Jika Anda menggunakan metrik latensi yang memancarkan satu titik data per permintaan, gunakan Statistik jumlah sampel untuk menghitung jumlah permintaan total.

        Untuk informasi selengkapnya tentang metrik ini, silakan lihat Membuat sebuah grafik metrik dan Menambahkan ekspresi matematika ke CloudWatch grafik.

  5. Masukkan nama untuk SLO. Menyertakan nama layanan atau operasi, bersama kata kunci yang sesuai seperti latensi atau ketersediaan, akan membantu Anda mengidentifikasi apa yang ditunjukkan status SLO selama triase dengan cepat.

  6. Atur interval dan tujuan pencapaian untuk SLO. Untuk informasi selengkapnya tentang interval dan pencapaian tujuan dan bagaimana keduanya bekerja sama, silakan lihat Konsep-konsep SLO.

  7. (Opsional) Untuk Set SLO burn rate lakukan hal berikut:

    • Atur panjang (dalam menit) jendela look-back untuk laju pembakaran. Untuk informasi tentang cara memilih panjang ini, lihatPanduan untuk alarm tingkat pembakaran.

    • Untuk membuat lebih banyak laju pembakaran untuk SLO ini, pilih Tambahkan lebih banyak laju pembakaran dan atur jendela look-back untuk tingkat pembakaran tambahan.

  8. (Opsional) Buat alarm laju pembakaran dengan melakukan hal berikut:

    • Di bawah Setel alarm tingkat pembakaran, pilih kotak centang untuk setiap tingkat pembakaran yang ingin Anda buat alarmnya. Untuk masing-masing alarm ini, lakukan hal berikut:

      • Tentukan topik Amazon SNS yang akan digunakan untuk pemberitahuan saat alarm masuk ke status ALARM.

      • Tetapkan ambang batas tingkat pembakaran atau tentukan persentase perkiraan total anggaran yang dibakar di jendela tampilan kembali terakhir yang ingin Anda pertahankan di bawahnya. Jika Anda menetapkan persentase perkiraan total anggaran yang dibakar, ambang batas tingkat pembakaran dihitung untuk Anda dan digunakan dalam alarm. Untuk memutuskan ambang batas yang akan ditetapkan atau untuk memahami bagaimana opsi ini digunakan untuk menghitung ambang batas laju pembakaran, lihatTentukan ambang batas yang sesuai untuk alarm tingkat pembakaran.

  9. (Opsional) Tetapkan satu atau lebih CloudWatch alarm atau ambang peringatan untuk SLO.

    1. CloudWatch alarm dapat menggunakan Amazon SNS untuk secara proaktif memberi tahu Anda jika aplikasi tidak sehat berdasarkan kinerja SLI-nya.

      Untuk membuat alarm, pilih salah satu kotak centang alarm dan masukkan atau buat topik Amazon SNS yang akan digunakan untuk notifikasi saat alarm masuk ke status ALARM. Untuk informasi selengkapnya tentang CloudWatch alarm, lihatMenggunakan CloudWatch alarm Amazon. Membuat alarm akan menimbulkan biaya. Untuk informasi selengkapnya tentang CloudWatch harga, lihat CloudWatch Harga Amazon.

    2. Jika Anda mengatur ambang batas peringatan, peringatan ini muncul di layar Sinyal Aplikasi untuk membantu Anda mengidentifikasi SLO yang berisiko tidak terpenuhi, bahkan jika saat ini sehat.

      Untuk mengatur ambang batas peringatan, masukkan nilai ambang batas di Ambang batas peringatan. Ketika anggaran kesalahan SLO lebih rendah dari ambang batas peringatan, SLO ditandai dengan Peringatan di beberapa layar Sinyal Aplikasi. Ambang batas peringatan juga muncul pada grafik anggaran kesalahan. Anda juga dapat membuat alarm peringatan SLO yang didasarkan pada ambang batas peringatan.

  10. (Opsional) Untuk Mengatur pengecualian jendela waktu SLO, lakukan hal berikut:

    • Di bawah Kecualikan jendela waktu, atur jendela waktu yang akan dikecualikan dari metrik kinerja SLO.

      Anda dapat memilih Atur jendela waktu dan masuk ke jendela Mulai untuk setiap jam atau bulan atau Anda dapat memilih A tur jendela waktu dengan CRON dan masukkan ekspresi CRON.

    • Di bawah Ulangi, atur apakah pengecualian jendela waktu ini berulang atau tidak.

    • (Opsional) Di bawah Tambah alasan, Anda dapat memilih untuk memasukkan alasan pengecualian jendela waktu. Misalnya, pemeliharaan terjadwal.

    • Pilih Tambahkan jendela waktu untuk menambahkan hingga 10 jendela pengecualian waktu.

  11. Untuk menambahkan tanda ke SLO ini, silakan pilih tab Tanda dan kemudian pilih Tambahkan tanda baru. Tanda dapat membantu Anda mengelola, mengidentifikasi, mengatur, dan memfilter sumber daya. Untuk informasi selengkapnya tentang penandaan, silakan lihat Menandai sumber daya AWS Anda.

    catatan

    Jika aplikasi yang terkait dengan SLO ini terdaftar AWS Service Catalog AppRegistry, Anda dapat menggunakan awsApplication tag untuk mengaitkan SLO ini dengan aplikasi itu di AppRegistry. Untuk informasi lebih lanjut, lihat Apa itu AppRegistry?

  12. Pilih Buat SLO. Jika Anda juga memilih untuk membuat satu atau beberapa alarm, nama tombol berubah sehingga mencerminkan hal ini.

Buat SLO di monitor aplikasi

Anda dapat membuat SLOs untuk memantau kinerja monitor aplikasi CloudWatch RUM Anda. Ini memungkinkan Anda untuk melacak metrik pengalaman pengguna nyata dan memastikan aplikasi web dan seluler Anda memenuhi tujuan kinerja. SLOs pada monitor aplikasi menggunakan evaluasi berbasis permintaan, yang mengukur rasio permintaan yang baik terhadap total permintaan.

Untuk membuat SLO pada monitor aplikasi
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih Buat SLO.

  4. Untuk Set Service Level Indicator (SLI), pilih RUM AppMonitor.

  5. Pilih monitor aplikasi yang akan dipantau SLO ini dari daftar dropdown. Daftar ini menampilkan nama monitor aplikasi bersama dengan platform yang didukung (Web, iOS, atau Android).

  6. (Opsional) Pilih halaman atau layar tertentu untuk dipantau. Jika Anda tidak memilih halaman, SLO akan memantau semua halaman untuk monitor aplikasi.

  7. Untuk Pilih metrik, pilih metrik yang akan digunakan untuk SLI. Metrik yang tersedia tergantung pada platform:

    • Untuk aplikasi web:PerformanceNavigationDuration,JSErrorCount,Http4xxCount, dan Http5xxCount

    • Untuk aplikasi seluler (iOS dan Android):ScreenLoadTime,CrashCount,Http4xxCount, dan Http5xxCount

  8. Untuk Atur kondisi, pilih operator perbandingan dan ambang batas untuk SLO yang akan digunakan sebagai indikator keberhasilan.

  9. Masukkan nama untuk SLO. Menyertakan nama monitor aplikasi dan kata kunci yang sesuai akan membantu Anda dengan cepat mengidentifikasi apa yang ditunjukkan oleh status SLO selama triase.

  10. Atur interval dan tujuan pencapaian untuk SLO. Untuk informasi selengkapnya, lihat Konsep-konsep SLO.

  11. (Opsional) Konfigurasikan laju pembakaran dan alarm sesuai kebutuhan. Untuk informasi selengkapnya, lihat Hitung laju pembakaran dan secara opsional mengatur alarm laju pembakaran.

  12. (Opsional) Tetapkan pengecualian jendela waktu jika diperlukan.

  13. (Opsional) Tambahkan tag untuk membantu mengatur dan mengidentifikasi SLO ini.

  14. Pilih Buat SLO.

Buat SLO di kenari

Anda dapat membuat SLOs untuk memantau kinerja kenari CloudWatch Synthetics Anda. Ini memungkinkan Anda melacak hasil pemantauan sintetis dan memastikan titik akhir dan API memenuhi ketersediaan dan tujuan kinerja. SLOs pada burung kenari menggunakan evaluasi berbasis periode, di mana setiap lari kenari diperlakukan sebagai periode evaluasi diskrit.

Untuk membuat SLO pada kenari
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih Buat SLO.

  4. Untuk Set Service Level Indicator (SLI), pilih Synthetics Canary.

  5. Pilih kenari yang akan dipantau SLO ini dari daftar dropdown.

  6. Untuk Pilih metrik, pilih salah satu SuccessPercent atauDuration:

    • SuccessPercentmengukur persentase lari kenari yang berhasil

    • Durationmengukur berapa lama waktu yang dibutuhkan setiap lari kenari untuk menyelesaikannya

  7. Untuk Atur kondisi, pilih operator perbandingan dan ambang batas untuk SLO yang akan digunakan sebagai indikator keberhasilan.

  8. Masukkan nama untuk SLO. Memasukkan nama kenari dan kata kunci yang sesuai akan membantu Anda dengan cepat mengidentifikasi apa yang ditunjukkan oleh status SLO selama triase.

  9. Atur interval dan tujuan pencapaian untuk SLO. Untuk informasi selengkapnya, lihat Konsep-konsep SLO.

  10. (Opsional) Konfigurasikan laju pembakaran dan alarm sesuai kebutuhan. Untuk informasi selengkapnya, lihat Hitung laju pembakaran dan secara opsional mengatur alarm laju pembakaran.

  11. (Opsional) Tetapkan pengecualian jendela waktu jika diperlukan.

  12. (Opsional) Tambahkan tag untuk membantu mengatur dan mengidentifikasi SLO ini.

  13. Pilih Buat SLO.

Buat SLO komposit pada beberapa operasi

Anda dapat membuat SLO komposit yang memantau Availability metrik di seluruh subset operasi untuk layanan. Ini berguna ketika Anda ingin melacak keandalan sekelompok operasi terkait bersama-sama, daripada memantau operasi tunggal atau semua operasi.

SLOs komposit mendukung evaluasi berbasis periode dan berbasis permintaan. Anda dapat memilih antara 2 dan 20 operasi untuk disertakan. Ada dua cara untuk memilih operasi:

  • Pilihan eksplisit — Pilih operasi individual secara manual dari dropdown.

  • Pencocokan pola — Gunakan awalan atau ekspresi reguler untuk mencocokkan operasi secara otomatis berdasarkan nama.

catatan

SLOs komposit hanya mendukung Availability metrik. Met Latency rik tidak tersedia untuk SLOs komposit.

Untuk membuat SLO komposit
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih Buat SLO.

  4. Untuk Set Service Level Indicator (SLI), untuk Jenis, pilih Layanan.

  5. Pilih layanan yang akan dipantau oleh SLO ini.

  6. Untuk Jenis, pilih Oper asi Layanan.

  7. Pilih operasi yang akan disertakan dalam SLO komposit ini. Lakukan salah satu tindakan berikut:

    • Untuk memilih operasi secara manual, pilih beberapa operasi dari dropdown Operasi. Anda dapat memilih antara 2 dan 20 operasi.

      Operasi yang dipilih muncul sebagai token di bawah dropdown. Anda dapat menghapus operasi dengan memilih ikon singkirkan pada tokennya.

    • Untuk memilih operasi berdasarkan pola, pilih kotak centang Gunakan pencocokan pola. Kemudian, lakukan hal berikut:

      1. Untuk Ti pe pola, pilih Awalan atau Eksp resi Reguler.

        • A walan cocok dengan semua operasi yang namanya dimulai dengan teks yang Anda masukkan. Misalnya, memasukkan operasi Invoke pertandingan bernamaInvokeFunction,InvokeAsync, dan seterusnya.

        • Ekspresi regul er cocok dengan semua operasi yang namanya cocok dengan pola regex yang Anda masukkan. Misalnya, memasukkan ^Invoke.* cocok dengan operasi yang sama dengan contoh awalan.

      2. Masukkan pola di bidang Pola. Konsol menampilkan operasi yang cocok sebagai token di bawah bidang sehingga Anda dapat memverifikasi hasilnya.

    Setelah Anda memilih operasi, metrik secara otomatis disetel ke Keter sediaan.

  8. Untuk Pilih metode perhitungan, pilih Periode atau Per mintaan.

  9. Jika Anda memilih Periode, tetapkan panjang periode dan ambang ketersediaan untuk SLO ini.

  10. Masukkan nama untuk SLO, atau gunakan nama yang dibuat secara otomatis. Nama yang dibuat secara otomatis menyertakan nama layanan dan kata “komposit” untuk membantu Anda mengidentifikasinya.

  11. Atur interval dan tujuan pencapaian untuk SLO. Untuk informasi selengkapnya tentang interval dan pencapaian tujuan dan bagaimana keduanya bekerja sama, silakan lihat Konsep-konsep SLO.

  12. (Opsional) Konfigurasikan laju pembakaran dan alarm sesuai kebutuhan. Untuk informasi selengkapnya, lihat Hitung laju pembakaran dan secara opsional mengatur alarm laju pembakaran.

  13. (Opsional) Tetapkan satu atau lebih CloudWatch alarm atau ambang peringatan untuk SLO.

  14. (Opsional) Tetapkan pengecualian jendela waktu jika diperlukan.

  15. (Opsional) Tambahkan tag untuk membantu mengatur dan mengidentifikasi SLO ini.

  16. Pilih Buat SLO.

Gunakan rekomendasi SLO

Sinyal Aplikasi dapat memberikan rekomendasi untuk konfigurasi SLO Anda berdasarkan data metrik historis dari 30 hari terakhir. Saat Anda memberikan informasi dasar tentang layanan dan jenis SLO yang ingin Anda buat, Sinyal Aplikasi menganalisis data metrik Anda dan menyarankan nilai optimal untuk ambang metrik, sasaran SLO, dan jendela laju pembakaran.

Untuk menerima rekomendasi SLO, Anda harus memberikan informasi berikut:

  • Pilih Operasi Layanan atau Ketergantungan Layanan:

    • Untuk Operasi Layanan, tentukan layanan dan operasi

    • Untuk Ketergantungan Layanan, tentukan layanan, operasi (atau semua operasi), dan ketergantungan

  • Jenis evaluasi SLO: baik berbasis periode atau berbasis permintaan

  • Jenis metrik aplikasi standar: salah satu Latency atau Availability

Berdasarkan informasi ini dan data kinerja historis layanan Anda, Sinyal Aplikasi merekomendasikan parameter konfigurasi SLO berikut:

  • Ambang batas metrik - Ambang kinerja untuk SLI Anda, dihitung berdasarkan kinerja aktual layanan Anda selama 30 hari terakhir.

  • Tujuan SLO - Persentase tujuan pencapaian yang disarankan yang selaras dengan keandalan historis layanan Anda.

  • Jendela tingkat pem bakaran - Durasi jendela lihat kembali yang disarankan untuk memantau seberapa cepat layanan Anda menghabiskan anggaran kesalahannya.

Anda dapat menerima nilai yang direkomendasikan atau menyesuaikannya berdasarkan kebutuhan bisnis spesifik Anda. Rekomendasi memberikan titik awal berbasis data untuk mengonfigurasi SLOs yang mencerminkan karakteristik kinerja aktual layanan Anda.

Menampilkan dan melakukan penilaian awal pada status SLO

Anda dapat dengan cepat melihat kesehatan SLOs menggunakan Tujuan Tingkat Layanan atau opsi Layanan di CloudWatch konsol. Tampilan Layanan memberikan pandangan sekilas tentang rasio layanan yang tidak sehat, yang dihitung berdasarkan SLO yang telah Anda atur. Untuk informasi selengkapnya tentang penggunaan opsi Layanan, silakan lihat Memantau kondisi kesehatan operasional aplikasi Anda dengan Sinyal Aplikasi.

Tampilan Tujuan Tingkat Layanan memberikan sebuah tampilan makro organisasi Anda. Anda dapat melihat SLO yang terpenuhi dan tidak terpenuhi secara keseluruhan. Ini memberi Anda gambaran tentang berapa banyak layanan dan operasi Anda yang berperforma sesuai harapan Anda selama periode waktu yang lebih lama, sesuai dengan SLI yang Anda pilih.

Cara melihat semua SLO Anda dengan menggunakan tampilan Tujuan Tingkat Layanan
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

    Daftar Tujuan Tingkat Layanan (SLO) ditampilkan.

    Anda dapat dengan cepat melihat status dari SLO Anda saat ini di kolom status SLI. Untuk mengurutkan SLO sehingga semua yang kondisinya tidak sehat berada di bagian atas daftar, pilih kolom status SLI sampai semua SLO yang sedang dalam kondisi tidak sehat berada di atas.

    Tabel SLO memiliki kolom-kolom default berikut. Anda dapat menyesuaikan kolom-kolom mana saja yang ditampilkan dengan memilih ikon roda gigi yang ada di atas daftar. Untuk informasi selengkapnya tentang tujuan, SLI, pencapaian, dan interval, silakan lihat Konsep-konsep SLO.

    • Nama SLO.

    • Kolom Tujuan menampilkan persentase periode selama setiap interval yang harus berhasil memenuhi ambang batas SLI agar tujuan SLO terpenuhi. Ini juga menampilkan panjang interval untuk SLO tersebut.

    • Status SLI akan menampilkan apakah status operasional aplikasi saat ini sedang dalam kondisi yang sehat atau tidak sehat. Jika ada periode selama rentang waktu yang dipilih saat ini tidak sehat untuk SLO, status SLI menampilkan Tidak Sehat.

    • Jika SLO ini dikonfigurasi untuk memantau ketergantungan, kolom Keter gantungan dan Operasi Jarak Jauh akan menampilkan detail tentang hubungan ketergantungan itu.

    • Pencapaian akhir adalah tingkat pencapaian yang dicapai pada akhir rentang waktu yang dipilih. Urutkan berdasarkan kolom ini untuk melihat SLO yang paling berisiko tidak terpenuhi.

    • Delta pencapaian adalah perbedaan tingkat pencapaian antara awal dan akhir rentang waktu yang dipilih. Delta negatif berarti bahwa metrik kecenderungannya sedang ke arah bawah. Urutkan berdasarkan kolom ini untuk melihat kecenderungan-kecenderungan terbaru SLO.

    • Anggaran kesalahan akhir (%) adalah persentase dari total waktu dalam periode yang dapat memiliki periode tidak sehat dan masih memiliki SLO yang berhasil dicapai. Jika Anda mengatur ini menjadi 5%, dan SLI sedang dalam kondisi tidak sehat dalam 5% atau kurang dari periode yang tersisa dalam interval, maka SLO masih berhasil dicapai.

    • Delta anggaran kesalahan adalah perbedaan anggaran kesalahan antara awal dan akhir rentang waktu yang dipilih. Delta negatif berarti bahwa metrik sedang mengarah ke arah yang gagal.

    • Anggaran kesalahan akhir (waktu) adalah jumlah waktu aktual dalam interval yang bisa tidak sehat dan masih memiliki SLO yang berhasil dicapai. Sebagai contoh, jika ini 14 menit, maka jika SLI tidak sehat selama kurang dari 14 menit selama interval yang tersisa, SLO akan tetap berhasil tercapai.

    • Ang garan kesalahan akhir (permintaan) adalah jumlah permintaan dalam interval yang mungkin tidak sehat dan SLO masih berhasil dicapai. Untuk SLOs berbasis permintaan, nilai ini dinamis dan dapat berfluktuasi karena jumlah total permintaan kumulatif berubah dari waktu ke waktu.

    • Kolom Layanan, Operasi, dan Tipe menampilkan informasi tentang layanan dan operasi apa yang diatur SLO ini.

  3. Untuk melihat grafik pencapaian dan kesalahan untuk SLO, pilih tombol radio di samping nama SLO.

    Grafik di bagian atas halaman menampilkan pencapaian SLO dan status Anggaran kesalahan. Sebuah grafik tentang metrik SLI yang dikaitkan dengan SLO ini juga ditampilkan.

  4. Untuk mengurutkan SLO lebih lanjut yang tidak memenuhi tujuannya, pilih nama layanan, nama operasi, atau nama ketergantungan yang terkait dengan SLO tersebut. Anda dibawa ke halaman detail di mana Anda dapat melakukan penilaian awal lebih lanjut. Untuk informasi selengkapnya, lihat Lihat detail aktivitas layanan dan kesehatan operasional dengan halaman detail layanan.

  5. Untuk mengubah rentang waktu grafik dan tabel pada halaman tersebut, pilih rentang waktu baru di dekat bagian atas layar.

Sunting SLO yang ada

Ikuti langkah-langkah ini untuk menyunting SLO yang ada. Saat Anda menyunting SLO, Anda hanya dapat mengubah ambang batas, interval, tujuan pencapaian, dan tag. Untuk mengubah aspek lain seperti layanan, operasi, atau metrik, buat SLO baru alih-alih menyunting yang sudah ada.

Mengubah bagian dari konfigurasi inti SLO, seperti periode atau ambang batas, membatalkan semua titik data sebelumnya dan penilaian tentang pencapaian dan kondisi kesehatan. Ini secara efektif menghapus dan membuat kembali SLO.

catatan

Jika Anda menyunting SLO, alarm yang terkait dengan SLO tersebut tidak diperbarui secara otomatis. Anda mungkin perlu memperbarui alarm-alarm tersebut agar tetap sinkron dengan SLO.

Cara menyunting SLO yang ada
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih tombol radio yang ada di samping SLO yang ingin Anda sunting, dan pilih Tindakan, Sunting SLO.

  4. Buat perubahan, lalu pilih Simpan perubahan.

Menghapus SLO

Ikuti langkah-langkah ini untuk menghapus SLO yang ada.

catatan

Saat Anda menghapus sebuah SLO, alarm yang terkait dengan SLO tersebut tidak akan dihapus secara otomatis. Anda harus menghapusnya sendiri. Untuk informasi selengkapnya, lihat Mengelola alarm.

Cara menghapus SLO
  1. Buka CloudWatch konsol di https://console.aws.amazon.com/cloudwatch/.

  2. Pada panel navigasi, silakan pilih Tujuan Tingkat Layanan (SLO).

  3. Pilih tombol radio di samping SLO yang ingin Anda sunting, dan pilih Tindakan, Hapus SLO.

  4. Pilih Konfirmasi.