Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Évaluation des alarmes
États d'alerte de métrique
Une alerte de métrique peut avoir les états suivants :
-
OK– La métrique ou l'expression se trouve dans le seuil défini. -
ALARM– La métrique ou l'expression se trouve à l'extérieur du seuil défini. -
INSUFFICIENT_DATA– L'alerte vient de commencer, la métrique n'est pas disponible, ou la quantité de données n'est pas suffisante pour permettre à la métrique de déterminer le statut de l'alerte.
État d'évaluation de l'alarme
Outre l'état d'alarme, chaque alarme possède un état d'évaluation qui fournit des informations sur le processus d'évaluation de l'alarme. Les états suivants peuvent se produire :
-
PARTIAL_DATA— Indique que toutes les données disponibles n'ont pas pu être récupérées en raison des limites de quotas. Pour de plus amples informations, veuillez consulter Comment les données partielles sont traitées. -
EVALUATION_ERROR— Indique les erreurs de configuration lors de la configuration des alarmes qui nécessitent une révision et une correction. Reportez-vous au StateReason champ de l'alarme pour plus de détails. -
EVALUATION_FAILURE— Indique des CloudWatch problèmes temporaires. Nous recommandons une surveillance manuelle jusqu'à ce que le problème soit résolu
Vous pouvez consulter l'état de l'évaluation dans les détails de l'alarme dans la console, ou à l'aide de la commande describe-alarms CLI ou de DescribeAlarms l'API.
Paramètres d'évaluation des alarmes
Lorsque vous créez une alarme, vous spécifiez 3 paramètres afin de déterminer CloudWatch à quel moment modifier l'état de l'alarme :
-
La Période est la durée nécessaire pour évaluer la métrique ou l'expression afin de créer chaque point de données pour une alerte. Elle est exprimée en secondes.
-
Evaluation Periods (Périodes d'évaluation) est le nombre de périodes, ou de points de données, les plus récents à évaluer pour déterminer l'état de l'alerte.
-
Datapoints to Alarm (Points de données avant l'alerte) est le nombre de points de données pendant les périodes d'évaluation qui doit être dépassé pour que l'alerte passe à l'état
ALARM. Les points de données au-delà du seuil n'ont pas besoin d'être consécutifs, mais ils doivent simplement tous correspondre au dernier nombre de points de données correspondant à la valeur Evaluation Period (Période d'évaluation).
Pour toute période d'une minute ou plus, une alerte est évaluée toutes les minutes et l'évaluation est basée sur la fenêtre de temps définie par la Période et les Périodes d'évaluation. Par exemple, si la Période est de 5 minutes (300 secondes) et que les Périodes d'évaluation sont de 1, alors à la fin de la cinquième minute, l'alerte est évaluée en fonction des données des minutes 1 à 5. Ensuite, à la fin de la minute 6, l'alerte est évaluée en fonction des données des minutes 2 à 6.
Si la période de l’alarme est de 10 secondes, 20 secondes ou 30 secondes, l’alarme est évaluée toutes les 10 secondes. Pour de plus amples informations, veuillez consulter High-resolution alarmes.
Si le nombre de périodes d’évaluation multiplié par la durée de chaque période d’évaluation dépasse un jour, l’alarme est évaluée une fois par heure. Pour plus de détails sur la façon dont ces alarmes de plusieurs jours sont évaluées, consultezExemple d’évaluation d’une alarme sur plusieurs jours.
Dans la figure suivante, le seuil d'alarme pour une alarme métrique est réglé sur 3 unités. Evaluation Period (Période d'évaluation) et Datapoints to Alarm (Points de données à l'alerte)sont définis sur 3. En d'autres termes, lorsque tous les points de données existants au cours des 3 dernières périodes consécutives sont supérieurs au seuil, l'alarme passe à ALARM l'état. Dans le schéma, cela se produit entre la troisième et la cinquième période. À la sixième période, la valeur repasse sous le seuil. L'une des périodes évaluées n'est donc pas en dépassement et l'état de l'alerte revient à l'état OK. Au cours de la neuvième période, le seuil est à nouveau dépassé, mais pour une seule période. Par conséquent, le statut de l'alerte reste OK.
Lorsque vous configurez différentes valeurs pour Evaluation Periods (Périodes d'évaluation) et Datapoints to Alarm (Points de données avant l'alerte), vous définissez une alerte « M sur N ». Les points de données vers l'alarme sont (« M ») et les périodes d'évaluation sont (« N »). L'intervalle d'évaluation est le nombre de périodes d'évaluation multiplié par la durée de la période. Par exemple, si vous configurez 4 points de données sur 5 avec une période de 1 minute, l'intervalle d'évaluation est de 5 minutes. Si vous configurez 3 points de données sur 3 avec une période de 10 minutes, l'intervalle d'évaluation est de 30 minutes.
Note
Si des points de données sont manquants peu de temps après la création d'une alarme et que la métrique était signalée CloudWatch avant que vous ne créiez l'alarme, CloudWatch récupère les points de données les plus récents datant d'avant la création de l'alarme lors de l'évaluation de l'alarme.
Par défaut, CloudWatch utilise une fenêtre coulissante pour l'évaluation des alarmes. Chaque fois que l'alarme est évaluée, la fenêtre avance d'une minute et ses limites ne sont pas alignées sur celles de l'horloge murale. Vous pouvez plutôt aligner la fenêtre d'évaluation sur les limites de l'horloge murale et les fuseaux horaires. Pour de plus amples informations, veuillez consulter Fenêtre d'évaluation des alarmes.
High-resolution alarmes
Si vous définissez une alarme sur une métrique haute résolution, vous pouvez spécifier une alarme haute résolution d'une durée de 10 secondes, 20 secondes ou 30 secondes. Les frais engendrés par des alertes haute résolution sont plus élevés. Pour plus d'informations sur les métriques haute résolution, consultez Publier des métriques personnalisées (PutMetricData /EMF).
Exemple d’évaluation d’une alarme sur plusieurs jours
Une alarme est une alarme de plusieurs jours si le nombre de périodes d'évaluation multiplié par la durée de chaque période d'évaluation dépasse un jour. Multi-day les alarmes sont évaluées une fois par heure. Lorsque des alarmes de plusieurs jours sont évaluées, ne CloudWatch prend en compte que les mesures jusqu'à l'heure en cours à la minute :00 lors de l'évaluation. Ce comportement haut de gamme, ainsi que l'exemple suivant, s'appliquent aux alarmes qui utilisent une fenêtre d'évaluation coulissante, qui est la fenêtre par défaut.
Prenons l’exemple d’une alarme qui surveille une tâche s’exécutant tous les 3 jours à 10 h 00.
-
À 10 h 02, la tâche échoue
-
À 10 h 03, l’alarme s’évalue et reste dans son état
OK, car l’évaluation ne prend en compte que les données jusqu’à 10 h 00. -
À 11 h 03, l’alarme prend en compte les données jusqu’à 11 h 00 et passe dans l’état
ALARM. -
À 11 h 43, vous corrigez l’erreur et la tâche s’exécute désormais correctement.
-
À 12 h 03, l’alarme s’évalue de nouveau, détecte que la tâche s’est exécutée avec succès et revient à l’état
OK.
Si l'alarme utilise plutôt une fenêtre d'évaluation de l'horloge murale, CloudWatch aligne la fenêtre d'évaluation sur la limite de l'horloge murale qui correspond à la période du fuseau horaire sélectionné pour l'alarme, plutôt que de la fixer en haut de chaque heure. Par exemple, une alarme de plusieurs jours avec une période d'un jour évalue les jours civils complets qui se terminent à minuit dans le fuseau horaire sélectionné, et une alarme avec une période d'une semaine évalue des semaines civiles complètes. La fenêtre avance d'une période complète lorsque chaque limite est atteinte, de sorte que l'alarme considère une période calendaire nouvellement terminée uniquement après la fin de cette période. Pour de plus amples informations, veuillez consulter Fenêtre d'évaluation des alarmes.