Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Ejecute métricas para flujos de trabajo privados
HealthOmics publica en Amazon métricas de utilización de recursos prácticamente en tiempo real para sus ejecuciones y tareas. CloudWatch Estas métricas le permiten ver el progreso de sus ejecuciones mientras se ejecutan. Puedes usar estas métricas para:
Identifique los cuellos de botella de la unidad central de procesamiento (CPU) o de la unidad de procesamiento gráfico (GPU) mientras las tareas siguen ejecutándose.
Detecte la presión de la memoria o el agotamiento del almacenamiento temporal antes de que una tarea falle.
Right-size las configuraciones de procesamiento y almacenamiento de sus flujos de trabajo.
Cree CloudWatch paneles y alarmas, o intégrelos con herramientas de observabilidad de terceros.
Las métricas de ejecución están disponibles para los flujos de trabajo privados y compartidos.
HealthOmics distribuye estas métricas dentro del cloudwatch.aws/omics ámbito de su propia CloudWatch cuenta.
Estas métricas se emiten utilizando el estándar de métricas compatible con CloudWatch OpenTelemetry (Otel). Esto significa que puede integrarlos con herramientas de OTel-compatible observabilidad junto con CloudWatch paneles y alarmas nativos. Consulta las métricas de Otel con el lenguaje de consulta Prometheus (PromQL) para ver y analizar los datos. Para obtener más información, consulte Métricas de CloudWatch OpenTelemetry.
Disponibilidad por región
Las métricas de ejecución están disponibles en todas HealthOmics las regiones compatibles, excepto en la región de Israel (Tel Aviv) (). il-central-1
Habilitar las métricas para una carrera
Para publicar estas métricas, el rol AWS Identity and Access Management (IAM) que utilices para la ejecución debe tener permiso para escribir métricas. CloudWatch Añade el siguiente permiso a tu rol de ejecución de flujo de trabajo:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "cloudwatch:PutMetricData", "Resource": "*" } ] }
Para obtener más información sobre los permisos, consulte Funciones de servicio para AWS HealthOmics. Para obtener más información sobre cómo iniciar una ejecución, consulteEmpieza una carrera en HealthOmics.
CloudWatch PutMetricDatacuota
CloudWatch tiene una PutMetricData cuota predeterminada de 500 solicitudes por segundo (transacciones por segundo). Esta cuota predeterminada es suficiente para ver las métricas de hasta 15 000 HealthOmics tareas simultáneas. Para ver las métricas de más de 15 000 HealthOmics tareas simultáneas, solicita un aumento del límite de la CloudWatch PutMetricData cuota. Para más información, consulte Service Quotas de CloudWatch .
Métricas disponibles
Disponibilidad métrica
HealthOmics Emite métricas en función del tipo de flujo de trabajo. No todas las métricas se emiten para todos los flujos de trabajo.
En la siguiente tabla se enumeran las métricas que HealthOmics se venden para cada ejecución. Las métricas están disponibles en CloudWatch Query Studio. Las unidades siguen la OpenTelemetry convención: By son bytes, {cpu} son vCPU, {operation} son operaciones y % son un porcentaje.
| Nombre de métrica | Description (Descripción) | Unidad | Tipo | Frecuencia | Disponibilidad. |
|---|---|---|---|---|---|
aws.omics.run.filesystem.usage |
Almacenamiento en uso en el sistema de archivos compartido de la ejecución. | By |
gauge |
30 segundos | Para cada carrera. |
aws.omics.run.filesystem.limit |
Capacidad total del sistema de archivos compartido de la ejecución. | By |
gauge |
30 segundos | Solo para ejecuciones que utilizan el tipo de almacenamiento de STATIC ejecución. |
aws.omics.task.cpu.usage |
La tarea de flujo de trabajo utiliza vCPU. | {cpu} |
gauge |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.cpu.limit |
Las CPU virtuales reservadas para la tarea del flujo de trabajo se basan en la definición del flujo de trabajo o en los valores predeterminados. | {cpu} |
gauge |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.memory.usage |
Memoria utilizada por la tarea de flujo de trabajo. | By |
gauge |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.memory.limit |
Memoria reservada para la tarea de flujo de trabajo. | By |
gauge |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.network.io |
El número de bytes transmitidos y recibidos por la tarea de flujo de trabajo. Dividir por network.io.direction (receive,transmit). |
By |
sum |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.filesystem.io |
El número de bytes del sistema de archivos transferidos por la tarea de flujo de trabajo. Dividir por filesystem.io.direction (read,write). |
By |
sum |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.filesystem.operations |
El número de operaciones del sistema de archivos realizadas por la tarea de flujo de trabajo. Dividir por filesystem.io.direction (read,write). |
{operation} |
sum |
30 segundos | Para cada tarea de la ejecución. |
aws.omics.task.filesystem.scratch.storage.usage |
La tarea de flujo de trabajo utiliza el almacenamiento virtual. | By |
gauge |
30 segundos (LOCALmodo) o 20 minutos (SHAREDmodo) |
Para cada tarea de la ejecución. |
aws.omics.task.filesystem.scratch.storage.limit |
Capacidad total de almacenamiento virtual disponible para la tarea del flujo de trabajo. | By |
gauge |
30 segundos | Para cada tarea de una ejecución que se establezca scratchStorageMode enLOCAL. |
aws.omics.task.gpu.utilization |
Utilización de la GPU para la tarea de flujo de trabajo. Un punto de datos por GPU, identificado porgpu.id. |
% |
gauge |
30 segundos | Solo para tareas que utilizan aceleradores. |
aws.omics.task.gpu.memory.usage |
Memoria de GPU utilizada por la tarea de flujo de trabajo. Un punto de datos por GPU, identificado porgpu.id. |
By |
gauge |
30 segundos | Solo para tareas que utilizan aceleradores. |
aws.omics.task.gpu.memory.limit |
Memoria de GPU disponible para la tarea de flujo de trabajo. Un punto de datos por GPU, identificado porgpu.id. |
By |
gauge |
30 segundos | Solo para tareas que utilizan aceleradores. |
Para obtener más información sobre los aceleradores, consulte. Recursos de tareas en una definición de flujo de trabajo HealthOmics
Para obtener más información sobre el almacenamiento efímero, consulte. Almacenamiento efímero para HealthOmics tareas de flujo de trabajo
Atributos de comunes
Cada métrica de HealthOmics ejecución incluye un conjunto común de etiquetas de recursos que identifican el origen del punto de datos.
| Etiqueta | Description (Descripción) | Ejemplo de valor |
|---|---|---|
| Etiquetas de recursos comunes | ||
@resource.cloud.provider |
El proveedor de servicios en la nube que publicó la métrica. | aws |
@resource.cloud.account.id |
La AWS cuenta a la que pertenece la ejecución. | 123456789012 |
@resource.cloud.region |
La AWS región en la que se ejecutó la carrera. | us-west-2 |
@resource.cloud.resource_id |
El ARN de la ejecución. | arn:aws:omics:us-west-2:123456789012:run/1234567 |
@resource.service.name |
El servicio que publicó la métrica. | omics |
@resource.aws.omics.workflow.id |
El ID del flujo de trabajo que utilizó la ejecución. | 1122334 |
@resource.aws.omics.run.id |
El ID de la ejecución. | 1234567 |
@resource.aws.omics.storage.type |
El tipo de almacenamiento de la ejecución. | DYNAMIC |
| Etiquetas de recursos de tareas | ||
@resource.aws.omics.task.id |
El ID de la tarea a la que se destina el punto de datos. Solo las aws.omics.task.* métricas llevan esta etiqueta. |
1245938 |
Atributos adicionales
Algunas métricas de ejecución incluyen atributos de puntos de datos adicionales que dividen la métrica en series temporales independientes. Puede usar estos atributos para filtrar una consulta de PromQL.
| Atributo adicional | Métricas | Description (Descripción) | Valores |
|---|---|---|---|
gpu.id |
aws.omics.task.gpu.utilization, aws.omics.task.gpu.memory.usage, aws.omics.task.gpu.memory.limit |
El índice de base cero de la GPU de la instancia. | 0, 1, 2 o 3 |
scratch.storage.mode |
aws.omics.task.filesystem.scratch.storage.usage, aws.omics.task.filesystem.scratch.storage.limit |
Donde la tarea escribe sus datos iniciales, en función de los efectivosscratchStorageMode. |
LOCAL o SHARED |
network.io.direction |
aws.omics.task.network.io |
La dirección de la transferencia de red. | receive o transmit |
filesystem.io.direction |
aws.omics.task.filesystem.io, aws.omics.task.filesystem.operations |
La dirección del funcionamiento del sistema de archivos. | read o write |
Consultando las métricas de HealthOmics ejecución
Para ver las métricas de ejecución en la CloudWatch consola, HealthOmics ejecute una consulta de PromQL en Query Studio.
Para ver las métricas de HealthOmics ejecución (consola) CloudWatch
-
Confirma que la carrera se inició con el
cloudwatch:PutMetricDatapermiso. -
Inicie sesión en la consola de administración de AWS y abra la consola de CloudWatch
. -
En el panel de navegación, elija Query Studio.
-
En el editor de consultas, seleccione PromQL en la lista desplegable.
-
En el modo Builder, busque y seleccione el nombre de una métrica y sus etiquetas. O bien, en el modo Editor, introduzca una consulta de PromQL.
-
Elija un rango de tiempo con el selector de rango de tiempo.
-
Seleccione Ejecutar para mostrar los resultados como un gráfico de series temporales. Para cambiar la forma en que se muestra el gráfico, elija Personalizar.
Por ejemplo, la siguiente consulta devuelve las CPU virtuales que utiliza cada tarea de una ejecución. runIDSustitúyala por el ID de la ejecución que deseas inspeccionar.
{"aws.omics.task.cpu.usage", "@resource.aws.omics.run.id"="runID"}
Para etiquetar cada serie temporal con su ID de ejecución y su ID de tarea, puede elegir Etiqueta personalizada e introducir lo siguiente.
{@resource.aws.omics.run.id="${@resource.aws.omics.run.id}",@resource.aws.omics.task.id="${@resource.aws.omics.task.id}"}
Para consultar las métricas de HealthOmics ejecución (API)
CloudWatch proporciona Prometheus-compatible API y puntos finales para consultar datos métricos. Para obtener más información sobre la consulta de métricas con estas API, consulte las API. Prometheus-compatible
Crear una alarma mediante CloudWatch
Puede crear una CloudWatch alarma a partir de una consulta de PromQL para que le CloudWatch notifique cuando una métrica supere un umbral. La alarma puede enviar una notificación a un tema de Amazon Simple Notification Service (Amazon SNS) o iniciar otra acción cuando la alarma cambie de estado.
Para crear una alarma a partir de una consulta de PromQL (consola) CloudWatch
-
Inicie sesión en la consola de administración de AWS y abra la consola de CloudWatch
. -
En el panel de navegación, elija Query Studio.
-
Seleccione PromQL, introduzca su consulta, verifique el gráfico y, a continuación, seleccione el botón Crear alarma.
Añadir métricas de HealthOmics ejecución a un panel CloudWatch
Puede añadir una consulta de PromQL a un CloudWatch panel de control en forma de widget para supervisar la utilización de los HealthOmics recursos junto con el resto de las métricas.
Para añadir métricas de HealthOmics ejecución a un CloudWatch panel de control (consola) CloudWatch
-
Inicie sesión en la consola de administración de AWS y abra la consola de CloudWatch
. -
En el panel de navegación, elija Query Studio.
-
Elija PromQL, introduzca la consulta y, a continuación, verifique el gráfico.
-
Seleccione Acción y, a continuación, seleccione Añadir al panel.
-
Elige un panel existente o crea uno nuevo y, a continuación, guarda el widget.
Analizar las métricas de ejecución con el HealthOmics servidor MCP
Puede usar el servidor HealthOmics Model Context Protocol (MCP) para recuperar las métricas de ejecución e investigar los errores de ejecución en varias dimensiones de datos con la ayuda de un modelo de IA. Puede usar el servidor MCP a través de la CLI de Kiro, Claude Code o cualquier otro MCP-compatible cliente de agencia. Para obtener más información, consulte el servidor AWS HealthOmics
Avisos
HealthOmics comienza a emitir métricas de ejecución cuando una tarea alcanza el
RUNNINGestado y deja de emitirlas cuando la tarea alcanza el estado.COMPLETEDPara obtener más información sobre los estados de las tareas, consulte. Valores de estado de la tareaLos primeros puntos de datos aparecen tras un breve retraso de unos 30 segundos.
Es posible que las tareas que se ejecutan durante menos de 30 segundos no tengan métricas.
Si el tipo de almacenamiento de la ejecución es
DYNAMIC,aws.omics.run.filesystem.usagepuede experimentar un retraso de más de 30 minutos, por lo que es posible que no esté disponible para las ejecuciones que tarden menos de 30 minutos.Cuando
scratchStorageModelo estéSHARED, esaws.omics.task.filesystem.scratch.storage.usageposible que no esté disponible para las tareas que crean un gran número de archivos temporales. HealthOmics mide el uso en este modo mediante un análisis recursivo del directorio temporal de la tarea, y el análisis no siempre finaliza dentro del límite de tiempo cuando el número de archivos es alto.Las métricas de CPU y memoria pueden diferir de los valores del manifiesto de ejecución porque las dos mediciones utilizan un ámbito diferente. Las métricas de ejecución reflejan con mayor precisión lo que consume realmente la tarea.
Las métricas de ejecución solo están disponibles en la AWS cuenta que posee la función de servicio e inicia la ejecución.
Facturación
AWS HealthOmics no te cobra por las métricas de ejecución. Las métricas se publican CloudWatch en Amazon en tu cuenta y te CloudWatch facturan directamente la actividad asociada. Los cargos se basan en el volumen de datos métricos ingeridos. Para ver los precios de una AWS región específica, consulta los CloudWatch precios de
| Actividad | ¿Cómo se te cobra |
|---|---|
| OpenTelemetry Métricas de publicación | Por GB de datos ingeridos. Incluye 15 meses de almacenamiento, sin cargos adicionales por el almacenamiento ni por el número de series métricas únicas. |
| Ejecución de consultas de PromQL en la CloudWatch consola, incluidos Query Studio y los paneles | Gratuito. |
| Ejecutar consultas de PromQL con las API CloudWatch | Por millón de muestras escaneadas. |
| Alarmas que evalúan una consulta de PromQL | Un cargo por alarma estándar, además de cargos por consulta por las muestras escaneadas en cada evaluación. |
Desactivación
De forma predeterminada, HealthOmics publica las métricas de ejecución siempre que el rol de servicio de una ejecución tenga el cloudwatch:PutMetricData permiso. Para excluirse y detener los cargos futuros, puede omitir este permiso de la función de servicio en cada nivel de ejecución. Para dejar de publicar aunque otra política conceda el permiso, agrega una denegación explícita al rol:
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Deny", "Action": "cloudwatch:PutMetricData", "Resource": "*" } ] }
Otra forma de excluirse es desactivar el registro de una ejecución configurando LogLevel
= OFF la StartRun solicitud. Cuando se establece LogLevel enOFF, HealthOmics no se publican las métricas de ejecución.