View a markdown version of this page

Supervisión de la solución - Programador de instancias de AWS

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Supervisión de la solución

Registro y notificaciones

Instance Scheduler utiliza un registro estructurado optimizado para las consultas de Logs Insights. CloudWatch Esta solución registra información de procesamiento para cada instancia etiquetada, los resultados de la evaluación de períodos para la instancia, el estado deseado de la instancia durante ese período, la acción aplicada y mensajes de depuración.

Los registros se escriben en Amazon CloudWatch Logs en dos grupos de registros:

{stackName}-{namespace}-administrative-logs

Registros para el registro y la cancelación del registro de recursos, las operaciones de recursos personalizadas, las solicitudes de CLI y otras actividades administrativas.

{stackName}-{namespace}-scheduling-logs

Registros para programar las operaciones, incluida la orquestación y la ejecución del controlador de solicitudes.

Los registros de advertencias y errores también se reenvían a un tema de Amazon SNS creado por una solución, que se puede configurar para enviar mensajes a una dirección de correo electrónico suscrita. Encontrará el nombre del tema de Amazon SNS en la pestaña Salidas de la pila de soluciones.

Etiquetas informativas

Cuando el etiquetado informativo está habilitado (opción predeterminada), Instance Scheduler escribe las etiquetas directamente en los recursos administrados para ofrecer una visibilidad rápida de la actividad de programación de la solución. Estas etiquetas se aplican mediante la API de etiquetado de grupos de recursos de AWS y se actualizan cada vez que el programador procesa un recurso.

Puede habilitar o deshabilitar esta función mediante el parámetro Habilitar el etiquetado informativo del hub stack. Para obtener más información, consulte Actualizar los ajustes de configuración global.

Teclas de etiquetas informativas

Las siguientes etiquetas se escriben en los recursos administrados:

Clave de etiqueta Description (Descripción)

IS-ManagedBy

El ARN de la pila central del programador de instancias que administra este recurso. Se aplica cuando un recurso se registra por primera vez para su programación y en cada acción de programación posterior.

IS-LastAction

La última acción de programación realizada en el recurso, junto con una marca de hora UTC. Por ejemplo: Started 2025-06-15 09:00:00 UTC o Stopped 2025-06-15 17:00:00 UTC. Esta etiqueta solo se actualiza cuando el programador inicia o detiene un recurso de forma activa (no cuando evalúa un recurso y determina que no es necesaria ninguna acción).

IS-Error

Si el planificador detecta un error al procesar un recurso, esta etiqueta contiene el código de error y una marca de hora UTC. Por ejemplo: StartFailed 2025-06-15 09:00:05 UTC. Esta etiqueta se borra automáticamente la siguiente acción de programación exitosa.

IS-ErrorMessage

Una descripción del error legible por humanos. Esta etiqueta solo está presente cuando también IS-Error está presente y se borra junto a ella.

Códigos de error

En la IS-Error etiqueta pueden aparecer los siguientes códigos de error:

Código de error Description (Descripción)

UnknownSchedule

El nombre de la programación especificado en la etiqueta de programación del recurso no coincide con ninguna programación definida en la tabla de configuración.

UnsupportedResource

El tipo de recurso no se admite para la programación (por ejemplo, una réplica leída de otra instancia de RDS).

IncompatibleSchedule

La programación asignada al recurso no es compatible con el tipo de recurso (por ejemplo, una programación de ASG que usa expresiones cron no compatibles).

StartFailed

El planificador intentó iniciar el recurso, pero la operación falló.

StopFailed

El planificador intentó detener el recurso, pero la operación falló.

ConfigurationFailed

El planificador intentó configurar las reglas de escalado programadas en un grupo de Auto Scaling, pero la operación falló.

UnknownError

Se produjo un error inesperado al procesar el recurso.

Comportamiento de etiquetas

  • Cuando un recurso se registra por primera vez para su programación, la IS-ManagedBy etiqueta se aplica inmediatamente.

  • Cuando se cancela el registro de un recurso (se elimina la etiqueta de programación), todas las etiquetas informativas (IS-ManagedBy,IS-LastAction,IS-Error,IS-ErrorMessage) se eliminan del recurso.

  • Las etiquetas de error no se vuelven a escribir en cada intervalo de programación si el mismo error persiste y la etiqueta existente sigue presente en el recurso. Solo se actualizan cuando cambia el código de error.

  • Todos los valores de las etiquetas se truncan a 256 caracteres para cumplir con los límites de etiquetado de AWS.

Consideraciones de gobernanza de las etiquetas

importante

Instance Scheduler crea y actualiza las etiquetas enumeradas anteriormente en los recursos administrados como parte del funcionamiento normal. Si su organización impone la gobernanza de las etiquetas mediante las reglas de AWS Config, las políticas de etiquetas, las políticas de control de servicios o la corrección automática, asegúrese de que sus controles de administración de cambios estén configurados para permitir las siguientes claves de etiqueta:

  • IS-ManagedBy

  • IS-LastAction

  • IS-Error

  • IS-ErrorMessage

  • IS-PreferredInstanceTypes(si utiliza tipos de instancias alternativos)

  • IS-MinDesiredMax(si se programan grupos de Auto Scaling)

Si no puedes incluir estas etiquetas en tus políticas de gobierno, desactiva el etiquetado informativo configurando el parámetro Habilitar el etiquetado informativo No en el hub stack. Ten en cuenta que esto también deshabilitará la IS-ManagedBy etiqueta que se usa para confirmar el registro de los recursos.

Etiquetas de control

Además de las etiquetas informativas, el Programador de instancias usa las siguientes etiquetas de control para funciones específicas:

Clave de etiqueta Description (Descripción)

IS-PreferredInstanceTypes

La lista separada por comas de los tipos de instancias EC2 alternativos que se pueden probar al iniciar una instancia produce un error debido a la capacidad insuficiente. Para obtener más información, consulte Cómo gestionar los errores de capacidad insuficiente de EC2.

IS-MinDesiredMax

Los valores de capacidad mínima, deseada y máxima para un grupo de Auto Scaling en este formatomin-desired-max. Para obtener más información, consulte la programación de grupos de EC2 Auto Scaling.

Capacidad de etiquetas

importante

Los recursos de AWS suelen tener un límite de 50 etiquetas por recurso. Instance Scheduler puede usar hasta 6 etiquetas en un recurso (4 etiquetas informativas y hasta 2 etiquetas de control). Asegúrese de que sus recursos tengan suficiente capacidad de etiquetado para incluir las etiquetas de Instance Scheduler junto con su estrategia de etiquetado actual.

Si un recurso está en o cerca del límite de 50 etiquetas, es posible que no se escriban etiquetas informativas. El programador registra estos errores pero continúa programando las operaciones. Compruebe CloudWatch los registros si sospecha que hay problemas con el etiquetado.

CloudWatch Registra las consultas de Insights

El formato de registro estructurado de Instance Scheduler permite realizar consultas eficientes con CloudWatch Logs Insights. Puede usar Logs Insights para buscar, analizar y visualizar los datos de registro a fin de solucionar problemas operativos y supervisar la actividad de programación.

Instance Scheduler proporciona consultas de registro preformateadas a las que puedes acceder desde la sección Consultas guardadas de la consola de registros: CloudWatch

SchedulingHistory

Las acciones de programación de consultas realizadas en los recursos, incluidas las operaciones de inicio y parada.

RegistrationEvents

Consulte los eventos de registro y cancelación del registro de recursos.

Errors

Consulte los registros de errores para solucionar problemas relacionados con la solución.

Para obtener más información sobre CloudWatch Logs Insights, consulte Análisis de datos de registro con CloudWatch Logs Insights en la guía del usuario de Amazon CloudWatch Logs.

Panel de información operativa

El panel Operational Insights permite ver el rendimiento de la solución y los ahorros de costes derivados de la administración programada de instancias.

Para acceder al panel de control, asegúrese de que la supervisión operativa esté configurada como «habilitada» en los parámetros del hub stack. Navegue CloudWatch y seleccione «Paneles» en el menú de navegación. El nombre del panel es * {stack-name} - *. Operational-Insights-Dashboard

El panel muestra los recuentos de instancias administradas, las horas de ejecución guardadas y las métricas de rendimiento de las funciones de Lambda.

Descripción general del panel de información operativa

OpsDashboardOverview
nota

La información de estos gráficos depende del intervalo de programación configurado en la pila central de la solución. Al actualizar el intervalo de programación de la solución, en el panel solo se mostrarán métricas de programación posteriores a la actualización más reciente del intervalo de programación.

Supervise los tiempos de ejecución de Lambda para garantizar un rendimiento óptimo (consulte las cuotas). Si los tiempos de ejecución se acercan constantemente al límite de tiempo de espera, considera la posibilidad de aumentar la propiedad de tamaño de Lambda o implementar Instance Scheduler en una región con una latencia más baja en las regiones administradas.

Métricas de Lambda que muestran la duración y el recuento de errores

OpsDashboardLambdaMetrics

Costos adicionales asociados a esta característica

Este panel operativo se basa en CloudWatch métricas personalizadas recopiladas por la solución, que generarán un costo adicional. Para desactivar esta característica, deshabilite “Supervisión operativa” en la pila central de la solución. Esta función cuesta 3 dólares adicionales. 00/month más costos de escalado adicionales en función del tamaño de la implementación. Los costos son los siguientes:

CloudWatch Panel de control personalizado 3$

Per-instance-type métricas

0,90 USD por tipo de instancia*

Uso de la API

~0,10 USD por objetivo activo**

*Estos costos se registran por categoría de servicio (EC2/RDS) y solo para los tipos de instancia que realmente se utilizan para la programación.

*

Monitorización de EventBridge eventos

Instance Scheduler publica los eventos de programación y registro en los buses de EventBridge eventos para ofrecer visibilidad de las operaciones de la solución y permitir la integración con otros servicios de AWS.

Event types (Tipos de eventos)

La solución publica dos categorías principales de eventos:

Programación de eventos: se publica cuando Instance Scheduler toma medidas para iniciar, detener o configurar los recursos administrados. Estos eventos incluyen detalles sobre la instancia, la programación y las medidas adoptadas para iniciar, detener o configurar los recursos administrados. Estos eventos incluyen detalles sobre la instancia, la programación y las medidas adoptadas.

Eventos de registro: se publican cuando los recursos están registrados o no registrados para su programación en función de las operaciones de etiquetado.

Destinos de evento

IS-LocalEvents buses de eventos: se implementa un bus de IS-LocalEvents eventos en cada región gestionada de cada cuenta de miembro (incluida la cuenta de hub). Cada bus recibe eventos para programar acciones y registros de recursos en esa región.

IS-GlobalEvents bus de eventos: el bus de IS-GlobalEvents eventos de la cuenta del hub recibe una copia de cada evento enviado a cualquier bus de IS-LocalEvents eventos, lo que permite una supervisión centralizada de todas las cuentas y regiones.

Uso de EventBridge eventos

Puede crear EventBridge reglas para:

  • Supervise las operaciones de programación en toda su infraestructura

  • Active las notificaciones cuando se inicien o detengan las instancias

  • Intégrelo con otros servicios de AWS para lograr flujos de trabajo automatizados

  • Implemente la supervisión y las alertas de conformidad

Estructura de evento

Todos los eventos utilizan el EventBridge formato estándar. Los siguientes ejemplos muestran la estructura de cada tipo de evento:

Programación de eventos:

{ "Source": "instance-scheduler", "DetailType": "Scheduling Action", "Resources": ["arn:aws:ec2:us-east-1:123456789012:instance/i-1234567890abcdef0"], "Detail": { "account": "123456789012", "region": "us-east-1", "service": "ec2", "resource_id": "i-1234567890abcdef0", "requested_action": "Start", "action_taken": "Started", "schedule": "office-hours" } }

Evento de registro:

{ "Source": "instance-scheduler", "DetailType": "Resource Registered", "Resources": ["arn:aws:ec2:us-east-1:123456789012:instance/i-1234567890abcdef0"], "Detail": { "account": "123456789012", "region": "us-east-1", "service": "ec2", "resource_id": "i-1234567890abcdef0", "schedule": "office-hours" } }

Cada evento contiene los siguientes campos clave:

  • Source- Identifica el origen del evento como «programador de instancias»

  • DetailType- Especifica la categoría del evento: «Acción de programación» para las operaciones de instancia o «Recurso registrado» para etiquetar eventos

  • Resources- Matriz que contiene los ARN de los recursos de AWS afectados

  • Detail- Contiene la carga útil del evento con el ID de la cuenta, la región, el tipo de servicio (ec2/rds), el ID del recurso y el nombre de la programación y, para programar los eventos, incluye tanto la acción solicitada como el resultado real

requested_actionValores posibles para programar eventos:

  • Start: El planificador está diseñado para iniciar la instancia

  • Stop: El planificador tenía la intención de detener la instancia

  • Configure: El planificador está diseñado para configurar la instancia

action_takenValores posibles para programar eventos:

  • Started: Se inició la instancia

  • Stopped: Se detuvo la instancia

  • Hibernated: La instancia estaba hibernada

  • Configured: Se modificó la configuración de la instancia

  • Error: Se produjo un error durante la operación de programación

Creando EventBridge reglas

Para supervisar los eventos del programador de instancias:

  1. Navegue hasta la EventBridge consola de su cuenta de AWS

  2. Cree una nueva regla dirigida al bus de IS-GlobalEvents eventos (para el monitoreo centralizado) o al bus de IS-LocalEvents eventos (para el monitoreo local)

  3. Defina los patrones de eventos para que coincidan con los eventos del programador de instancias

  4. Configure objetivos como los temas de SNS, las funciones de Lambda o los registros CloudWatch

Para obtener más información al respecto EventBridge, consulte ¿Qué es Amazon? EventBridge en la Guía del EventBridge usuario de Amazon.