Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Contrôles du statut des instances Amazon EC2
Grâce aux vérifications de statut, vous pouvez rapidement déterminer s'il existe des problèmes susceptibles d'empêcher vos instances d'exécuter vos applications. Amazon EC2 propose quatre types de contrôles d'état : système, instance, EBS attaché et application. Les contrôles d'état du système, de l'instance et des fichiers EBS associés sont gérés par Amazon EC2 et s'exécutent automatiquement sur chaque instance. Les vérifications de l'état des applications sont facultatives et surveillent les réponses HTTP ou HTTPS des applications exécutées sur vos instances. Vous pouvez consulter les résultats de toutes les vérifications d'état dans la console Amazon EC2, les kits de développement logiciel (SDK) ou les AWS CLI kits de AWS développement logiciel (SDK).
Les contrôles de statut sont exécutés toutes les minutes et chacun d’entre eux renvoie un statut de réussite ou d’échec. Si tous les contrôles réussissent, le statut global de l’instance est OK. Si un ou plusieurs contrôles échouent, le statut global de l’instance est dégradé. Les contrôles de statut EBS du système, de l'instance et des pièces jointes sont gérés par Amazon EC2 et ne peuvent être ni désactivés ni supprimés. Les vérifications de l'état des applications sont facultatives ; vous les créez, les associez et les gérez vous-même.
Lorsqu'un contrôle de statut échoue, la CloudWatch métrique correspondante pour les contrôles d'état est incrémentée. Pour de plus amples informations, veuillez consulter Métriques de contrôle de statut. Vous pouvez utiliser ces métriques pour créer des alarmes CloudWatch qui sont déclenchées en fonction du résultat des contrôles de statut. Par exemple, vous pouvez créer une alarme pour vous avertir si des contrôles de statut échouent sur une instance spécifique. Pour de plus amples informations, veuillez consulter Créez des CloudWatch alarmes pour les instances Amazon EC2 qui échouent aux contrôles de statut.
Vous pouvez également créer une CloudWatch alarme Amazon qui surveille une instance Amazon EC2 et la restaure automatiquement si elle est altérée en raison d'un problème sous-jacent. Pour de plus amples informations, veuillez consulter Récupération automatique des instances.
Sommaire
Types de contrôles de statut
Il existe quatre types de contrôles de statut.
Contrôles de statut de système
Les vérifications de l'état du système surveillent les AWS systèmes sur lesquels votre instance s'exécute. Ces contrôles détectent les problèmes sous-jacents liés à votre instance qui nécessitent une intervention de résolution d’ AWS . Lorsqu'une vérification de l'état du système échoue, vous pouvez choisir AWS d'attendre que le problème soit résolu ou de le résoudre vous-même. Pour les instances basées sur Amazon EBS, vous pouvez arrêter et démarrer l’instance vous-même, ce qui, dans la plupart des cas, entraîne la migration de l’instance vers un nouvel hôte. Pour les instances Linux basées sur le stockage d’instance, vous pouvez résilier l’instance et la remplacer. Notez que les volumes de stockage d’instance sont éphémères et que toutes les données sont perdues lorsque l’instance est arrêtée.
Voici des exemples de problèmes pouvant entraîner l’échec des contrôles de statut :
-
Perte de connectivité réseau
-
Perte d’alimentation système
-
Problèmes logiciels sur un hôte physique
-
Problèmes matériels sur un hôte physique ayant un impact sur l’accessibilité du réseau
Si une vérification de l'état du système échoue, nous incrémentons la métrique StatusCheckFailed _System.
Instances nues
Si vous redémarrez une instance bare metal, la vérification de l'état du système peut renvoyer temporairement un état d'échec. Lorsque l’instance devient disponible, la vérification de l’état du système doit renvoyer un état de succès.
Contrôles de statut des instances
Les contrôles de statut des instances surveillent le logiciel et la connectivité du réseau de votre instance individuelle. Amazon EC2 vérifie l’état de l’instance en envoyant une demande de protocole de résolution d’adresse (ARP) à l’interface réseau (NIC). Ces contrôles détectent les problèmes nécessitant votre intervention pour les résoudre. Lorsqu’un contrôle de statut d’instance échoue, vous devez généralement résoudre le problème vous-même (par exemple, en redémarrant l’instance ou en effectuant des changements de configuration sur l’instance).
Note
Les distributions Linux récentes utilisant systemd-networkd la configuration du réseau peuvent rendre compte des contrôles de santé différemment des distributions antérieures. Au cours du processus de démarrage, ce type de réseau peut démarrer plus tôt et éventuellement se terminer avant d'autres tâches de démarrage qui peuvent également affecter l'état de l'instance. Les contrôles de statut qui dépendent de la disponibilité du réseau peuvent signaler un statut sain avant que d'autres tâches ne soient terminées.
Voici des exemples de problèmes pouvant entraîner l’échec des contrôles d’instance :
-
Échec de contrôles de statut de système
-
Configuration de mise en réseau ou de démarrage incorrecte
-
Mémoire épuisée
-
Système de fichiers corrompu
-
Noyau incompatible
-
Lors d’un redémarrage, un contrôle de statut des instances signale une défaillance jusqu’à ce que l’instance redevienne disponible.
Si la vérification de l'état d'une instance échoue, nous incrémentons la métrique StatusCheckFailed _Instance.
Instances nues
Si vous redémarrez une instance bare metal, la vérification de l'état de l'instance peut renvoyer temporairement un état d'échec. Lorsque l’instance devient disponible, la vérification de l’état de l’instance doit renvoyer un état de succès.
Contrôles de statut de l’EBS attaché
Les contrôles d'état EBS attachés permettent de vérifier si les volumes Amazon EBS attachés à une instance sont accessibles et capables d'effectuer I/O des opérations. La StatusCheckFailed_AttachedEBS métrique est une valeur binaire qui indique une altération si un ou plusieurs volumes EBS attachés à l'instance ne peuvent pas terminer les I/O opérations. Ces vérifications de statut détectent les problèmes sous-jacents liés au calcul ou à l’infrastructure Amazon EBS. Lorsque la métrique de contrôle d'état EBS jointe échoue, vous pouvez soit AWS attendre que le problème soit résolu, soit prendre des mesures, telles que remplacer les volumes concernés ou arrêter et redémarrer l'instance.
Vous trouverez ci-dessous des exemples de problèmes pouvant entraîner l’échec des contrôles de statut de l’EBS attaché :
-
Problèmes matériels ou logiciels sur les sous-systèmes de stockage sous-jacents aux volumes EBS
-
Problèmes matériels sur l’hôte physique ayant un impact sur l’accessibilité des volumes EBS
-
Problèmes de connectivité entre l’instance et les volumes EBS
Vous pouvez utiliser la métrique StatusCheckFailed_AttachedEBS pour améliorer la résilience de votre charge de travail. Vous pouvez utiliser cette métrique pour créer des CloudWatch alarmes Amazon qui sont déclenchées en fonction du résultat de la vérification de statut. Par exemple, vous pouvez basculer vers une instance secondaire ou une zone de disponibilité lorsque vous détectez un impact prolongé. Vous pouvez également surveiller les I/O performances de chaque volume connecté à l'aide de CloudWatch métriques EBS pour détecter et remplacer le volume endommagé. Si la vérification de l'état d'EBS indique un dysfonctionnement et que votre charge de travail n'est pas dirigée I/O vers les volumes EBS attachés, arrêtez et démarrez l'instance pour la déplacer vers un nouvel hôte. Cela peut résoudre les problèmes d’hôte sous-jacents qui ont un impact sur l’accessibilité des volumes EBS. Pour plus d'informations, consultez la section CloudWatch Statistiques Amazon pour Amazon EBS.
Vous pouvez également configurer vos groupes Amazon EC2 Auto Scaling pour détecter les échecs de contrôle de statut EBS associés, puis remplacer l'instance affectée par une nouvelle instance. Pour de plus d'informations, veuillez consulter Surveiller et remplacer les instances AutoScaling par des volumes Amazon EBS altérés dans le Guide de l'utilisateur Amazon EC2 Auto Scaling.
Note
La métrique de contrôle de statut de l’EBS attaché n’est disponible que pour les instances Nitro.
Vérifications de l'état des demandes
Utilisez les vérifications de l'état des applications pour surveiller l'accessibilité du réseau et la disponibilité des applications exécutées sur vos instances Amazon EC2. Grâce aux vérifications de l'état des applications, vous pouvez surveiller les réponses HTTP et HTTPS au niveau de l'application. Les vérifications de l'état des applications s'exécutent uniquement sur les instances auxquelles vous les associez.
Vous configurez chaque vérification de l'état de l'application pour demander un chemin HTTP sur le point de terminaison de votre application et définissez les codes de réponse qui indiquent une réponse saine.
Vous pouvez supprimer les vérifications de l'état des applications lors des redémarrages ou des déploiements des applications afin d'éviter les échecs faussement positifs lors des interruptions de service prévues. Pour de plus amples informations, veuillez consulter Gestion du déploiement, de l'application des correctifs sur place et des remplacements.
Voici des exemples de problèmes susceptibles d'entraîner l'échec de la vérification de l'état des applications :
-
Le processus d'application s'est bloqué ou a cessé de répondre
-
L'application a renvoyé un code de réponse HTTP indiquant une erreur de service interne de l'application ou un autre problème
-
Le port de l'application n'est pas accessible
-
Un problème logiciel ou matériel sous-jacent a provoqué l'échec de votre instance et l'a empêchée de répondre
Si la vérification de l'état d'une demande échoue, nous incrémentons la StatusCheckFailed_Application métrique.
Pour plus d'informations sur la configuration des contrôles d'état des applications, consultezVérifications de l'état des demandes.