Comprobaciones de estado de las instancias de Amazon EC2
Con las comprobaciones de estado, puede determinar rápidamente si hay problemas que pudieran impedir a las instancias ejecutar sus aplicaciones. Amazon EC2 ofrece cuatro tipos de comprobaciones de estado: sistema, instancia, EBS asociado y aplicación. Amazon EC2 administra las comprobaciones de estado del sistema, la instancia y el EBS asociado, y se ejecutan automáticamente en todas las instancias. Las comprobaciones del estado de las aplicaciones son opcionales y supervisan las respuestas HTTP o HTTPS de las aplicaciones que se ejecutan en sus instancias. Puede ver los resultados de todas las comprobaciones de estado en la consola de Amazon EC2, en AWS CLI o en los AWS SDK.
Las comprobaciones de estado se realizan cada minuto y devuelven un estado de aprobación o error. Si se superan todas las comprobaciones, el estado general de la instancia es OK (CORRECTO). Si no se supera una o varias comprobaciones, el estado general es impaired (deteriorado). Amazon EC2 administra las comprobaciones de estado del sistema, la instancia y el EBS asociado, y no se pueden deshabilitar ni eliminar. Las comprobaciones del estado de las aplicaciones son opcionales; usted mismo las crea, asocia y administra.
Cuando no se supera una comprobación de estado, la métrica de CloudWatch correspondiente a las comprobaciones de estado aumenta. Para obtener más información, consulte Métricas de comprobación de estado. Puede utilizar estas métricas para crear alarmas de CloudWatch que se activen en función del resultado de las comprobaciones de estado. Por ejemplo, puede crear una alarma que le advierta si las comprobaciones de estado fallan en una instancia específica. Para obtener más información, consulte Cree alarmas de CloudWatch para las instancias de Amazon EC2 que no superen las comprobaciones de estado..
También puede crear una alarma de Amazon CloudWatch que monitorice una instancia Amazon EC2 y recupere automáticamente la instancia si su estado se deteriora debido a un problema subyacente. Para obtener más información, consulte Recuperación automática de instancia.
Contenido
Tipos de comprobaciones de estado
Hay cuatro tipos de comprobaciones de estado.
Comprobaciones de estado de sistemas
Las comprobaciones de estado del sistema monitorean los sistemas de AWS en los que se ejecuta la instancia. Estas comprobaciones detectan problemas subyacentes con la instancia que requieren la intervención de AWS para su reparación. Cuando una comprobación de estado de sistemas falla, puede elegir esperar a que AWS repare el problema o puede resolverlo por su cuenta. En el caso de las instancias respaldadas por Amazon EBS, puede detener e iniciar la instancia usted mismo, lo que en la mayoría de los escenarios hace que la instancia migre a un nuevo host. Para instancias respaldadas por un almacén de instancias (compatibles solo con instancias de Linux), puede terminar y reemplazar la instancia. Tenga en cuenta que los volúmenes del almacén de instancias son efímeros y que todos los datos se pierden cuando se detiene la instancia.
A continuación se muestran ejemplos de problemas que pueden provocar errores en las comprobaciones de estado del sistema:
-
Pérdida de conectividad de red
-
Pérdida de potencia del sistema
-
Problemas de software en el host físico
-
Problemas de hardware en el host físico que afectan a la accesibilidad a la red
Si se produce un error en la comprobación del estado de un sistema, aumentamos la métrica StatusCheckFailed_System.
instancias Bare Metal
Si realiza un reinicio en una instancia de Bare Metal, la comprobación del estado del sistema podría devolver temporalmente un estado de error. Cuando la instancia esté disponible, la comprobación de estado del sistema debería devolver un estado de aprobado.
Comprobaciones de estado de instancias
Comprobaciones de estado de instancias: supervise la conectividad de la red y el software de la instancia individual. Amazon EC2 verifica el estado de la instancia mediante el envío de una solicitud del protocolo de resolución de direcciones (ARP) a la interfaz de red (NIC). Estas comprobaciones detectan problemas que requieren su implicación para la reparación. Cuando una comprobación de estado de instancias falla, debe resolver el problema por sí mismo (por ejemplo, reiniciando la instancia o realizando cambios en la configuración de la instancia).
nota
Las distribuciones de Linux recientes que utilizan systemd-networkd para la configuración de red pueden informar sobre las comprobaciones de estado de forma diferente a las distribuciones anteriores. Durante el proceso de arranque, este tipo de red puede iniciarse antes y, posiblemente, terminar antes que otras tareas de inicio, lo que también puede afectar al estado de la instancia. Las comprobaciones de estado que dependen de la disponibilidad de la red pueden informar un estado correcto antes de que se completen otras tareas.
A continuación se muestran ejemplos de problemas que pueden provocar errores en las comprobaciones de estado de la instancia:
-
Error de las comprobaciones de estado del sistema
-
Configuración de red o de inicio incorrecta
-
Memoria agotada
-
Sistema de archivos dañado
-
Kernel incompatible
-
Durante el reinicio, una comprobación de estado de la instancia informa de un fallo hasta que la instancia vuelva a estar disponible.
Si se produce un error en la comprobación del estado de una instancia, incrementamos la métrica StatusCheckFailed_Instance.
instancias Bare Metal
Si realiza un reinicio en una instancia de Bare Metal, la comprobación del estado de la instancia podría devolver temporalmente un estado de error. Cuando la instancia esté disponible, la comprobación de estado de la instancia debería devolver un estado de aprobado.
Comprobaciones de estado de EBS adjuntas
Las comprobaciones de estado de EBS adjuntas supervisan si se puede acceder a los volúmenes de Amazon EBS adjuntos a una instancia y completar operaciones de E/S. La métrica StatusCheckFailed_AttachedEBS es un valor binario que indica que hay problemas si uno o varios de los volúmenes de EBS adjuntos a la instancia no pueden completar las operaciones de E/S. Estas comprobaciones de estado detectan problemas subyacentes en la computación o la infraestructura de Amazon EBS. Si la métrica de comprobación de estado de EBS adjunta falla, puede esperar a que AWS resuelva el problema o tomar medidas, como reemplazar los volúmenes afectados o detener y reiniciar la instancia.
A continuación se muestran ejemplos de problemas que pueden provocar errores en las comprobaciones de estado de EBS adjuntas:
-
Problemas de hardware o software en los subsistemas de almacenamiento subyacentes a los volúmenes de EBS
-
Problemas de hardware en el host físico que afectan a la accesibilidad de los volúmenes de EBS
-
Problemas de conectividad entre la instancia y los volúmenes de EBS
Puede usar la métrica StatusCheckFailed_AttachedEBS para ayudar a mejorar la resiliencia de su carga de trabajo. Puede utilizar esta métrica para crear alarmas de Amazon CloudWatch que se activen en función del resultado de la comprobación de estado. Por ejemplo, puede realizar una conmutación por error en una instancia secundaria o una zona de disponibilidad si detecta un impacto prolongado. Como alternativa, puede supervisar el rendimiento de E/S de cada volumen adjunto mediante las métricas de EBS de CloudWatch para detectar y reemplazar el volumen dañado. Si la comprobación del estado de EBS indica un deterioro y su carga de trabajo no está conduciendo E/S a ningún volumen EBS adjunto a su instancia, puede detener e iniciar la instancia para moverla a un nuevo host. Esto puede resolver los problemas subyacentes del host que afectan a la accesibilidad de los volúmenes de EBS. Para obtener más información, consulte Métricas de Amazon CloudWatch para Amazon EBS.
También puede configurar sus grupos de Amazon EC2 Auto Scaling para detectar errores de comprobación de estado de EBS adjunto y, a continuación, sustituir la instancia afectada por una nueva. Para obtener más información, consulte el tema Monitor and replace Auto Scaling instances with impaired Amazon EBS volumes en la Guía del usuario de Amazon EC2 Auto Scaling.
nota
La métrica de comprobación de estado de EBS adjunta solo está disponible para las instancias Nitro.
Comprobaciones de estado de la aplicación
Utilice las comprobaciones de estado de las aplicaciones para supervisar la accesibilidad de la red y la disponibilidad de las aplicaciones que se ejecutan en sus instancias de Amazon EC2. Con las comprobaciones del estado de las aplicaciones, puede supervisar las respuestas HTTP y HTTPS a nivel de la aplicación. Las comprobaciones del estado de las aplicaciones se ejecutan solo en las instancias a las que las asocie.
Configure cada comprobación de estado de la aplicación para solicitar una ruta HTTP en el punto de conexión de la aplicación y definir los códigos de respuesta que indican una respuesta correcta.
Puede suprimir las comprobaciones de estado de las aplicaciones durante los reinicios o implementaciones para evitar errores de falsos positivos durante el tiempo de inactividad previsto. Para obtener más información, consulte Gestión de la implementación, la aplicación de parches in situ y las sustituciones.
A continuación se muestran ejemplos de problemas que pueden provocar errores en las comprobaciones de estado de la aplicación:
-
El proceso de la aplicación se bloqueó o dejó de responder
-
La aplicación devolvió un código de respuesta HTTP que indica un error interno del servicio de la aplicación u otro problema
-
No se puede acceder al puerto de la aplicación
-
Un problema de software o hardware subyacente ha provocado que la instancia falle y deje de responder
Si se produce un error en la comprobación de estado de una aplicación, aumentamos la métrica StatusCheckFailed_Application.
Para obtener información sobre la configuración de las comprobaciones de estado de las aplicaciones, consulte Comprobaciones de estado de la aplicación.