기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.
프라이빗 워크플로에 대한 지표 실행
HealthOmics는 실행 및 작업에 대한 거의 실시간에 가까운 리소스 사용률 지표를 Amazon CloudWatch에 게시합니다. 이러한 지표를 통해 실행 중에 실행이 어떻게 진행되고 있는지 파악할 수 있습니다. 이러한 지표를 사용하여 다음을 수행할 수 있습니다.
작업이 계속 실행되는 동안 중앙 처리 장치(CPU) 또는 그래픽 처리 장치(GPU) 병목 현상을 식별합니다.
작업이 실패하기 전에 메모리 압력 또는 스크래치 스토리지 소진을 감지합니다.
워크플로에 맞는 컴퓨팅 및 스토리지 구성의 크기를 조정합니다.
CloudWatch 대시보드 및 경보를 구축하거나 타사 관찰성 도구와 통합합니다.
실행 지표는 프라이빗 및 공유 워크플로에 사용할 수 있습니다.
HealthOmics는 자체 CloudWatch 계정의 cloudwatch.aws/omics 범위에 따라 이러한 지표를 제공합니다.
이러한 지표는 CloudWatch OpenTelemetry(OTel) 호환 지표 표준을 사용하여 내보내집니다. 즉, 기본 CloudWatch 대시보드 및 경보와 함께 OTel 호환 관찰성 도구와 통합할 수 있습니다. Prometheus 쿼리 언어(PromQL)를 사용하여 OTel 지표를 쿼리하여 데이터를 보고 분석합니다. 자세한 내용은 CloudWatch OpenTelemetry 지표를 참조하세요.
리전 가용성
실행 지표는 이스라엘(텔아비브) 리전()을 제외한 지원되는 모든 HealthOmics 리전에서 사용할 수 있습니다il-central-1.
실행에 대한 지표 활성화
이러한 지표를 게시하려면 실행에 사용하는 AWS Identity and Access Management (IAM) 역할에 CloudWatch에 지표를 쓸 수 있는 권한이 있어야 합니다. 워크플로 실행 역할에 다음 권한을 추가합니다.
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": "cloudwatch:PutMetricData", "Resource": "*" } ] }
권한에 대한 자세한 내용은 에 대한 서비스 역할 AWS HealthOmics 섹션을 참조하세요. 실행 시작에 대한 자세한 내용은 섹션을 참조하세요HealthOmics에서 실행 시작.
CloudWatch 할당PutMetricData량
CloudWatch의 기본 할당PutMetricData량은 초당 요청 500개(초당 트랜잭션)입니다. 이 기본 할당량은 최대 15,000개의 동시 HealthOmics 작업에 대한 지표를 보기에 충분합니다. 15,000개 이상의 동시 HealthOmics 작업에 대한 지표를 보려면 CloudWatch 할당PutMetricData량에 대한 한도 증가를 요청합니다. 자세한 내용은 CloudWatch 서비스 할당량을 참조하세요.
사용 가능한 지표
지표 가용성
HealthOmics는 워크플로 유형에 따라 지표를 내보냅니다. 모든 워크플로에 대해 모든 지표가 생성되는 것은 아닙니다.
다음 표에는 각 실행에 대해 HealthOmics가 제공하는 지표가 나열되어 있습니다. 지표는 CloudWatch Query Studio에서 사용할 수 있습니다. 단위By는 OpenTelemetry 규칙을 따릅니다.는 바이트, {cpu}는 vCPUs, {operation}는 작업, %는 백분율입니다.
| 지표 이름 | 설명 | 단위 | 유형 | 빈도 | 가용성 |
|---|---|---|---|---|---|
aws.omics.run.filesystem.usage |
실행의 공유 파일 시스템에서 사용 중인 스토리지입니다. | By |
gauge |
30초 | 모든 실행에 대해. |
aws.omics.run.filesystem.limit |
실행 공유 파일 시스템의 총 용량입니다. | By |
gauge |
30초 | 실행 스토리지 유형을 사용하는 STATIC 실행에만 해당됩니다. |
aws.omics.task.cpu.usage |
워크플로 작업에서 사용 중인 vCPUs. | {cpu} |
gauge |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.cpu.limit |
워크플로 정의 또는 기본값을 기반으로 워크플로 작업에 예약된 vCPUs. | {cpu} |
gauge |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.memory.usage |
워크플로 작업에서 사용 중인 메모리입니다. | By |
gauge |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.memory.limit |
워크플로 작업에 예약된 메모리입니다. | By |
gauge |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.network.io |
워크플로 작업에서 전송 및 수신한 바이트 수입니다. network.io.direction (receive, )로 분할합니다transmit. |
By |
sum |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.filesystem.io |
워크플로 작업에서 전송한 파일 시스템 바이트 수입니다. filesystem.io.direction (read, )로 분할합니다write. |
By |
sum |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.filesystem.operations |
워크플로 작업에서 수행한 파일 시스템 작업 수입니다. filesystem.io.direction (read, )로 분할합니다write. |
{operation} |
sum |
30초 | 실행 중인 모든 작업에 대해. |
aws.omics.task.filesystem.scratch.storage.usage |
워크플로 작업에서 사용 중인 스크래치 스토리지입니다. | By |
gauge |
30초(LOCAL 모드) 또는 20분(SHARED 모드) |
실행 중인 모든 작업에 대해. |
aws.omics.task.filesystem.scratch.storage.limit |
워크플로 작업에 사용할 수 있는 총 스크래치 스토리지 용량입니다. | By |
gauge |
30초 | 가 scratchStorageMode 로 설정된 실행의 모든 작업에 대해LOCAL. |
aws.omics.task.gpu.utilization |
워크플로 작업에 대한 GPU 사용률입니다. 로 식별되는 GPU당 하나의 데이터 포인트입니다gpu.id. |
% |
gauge |
30초 | 액셀러레이터를 사용하는 작업에만 해당됩니다. |
aws.omics.task.gpu.memory.usage |
워크플로 작업에서 사용 중인 GPU 메모리입니다. 로 식별되는 GPU당 하나의 데이터 포인트입니다gpu.id. |
By |
gauge |
30초 | 액셀러레이터를 사용하는 작업에만 해당됩니다. |
aws.omics.task.gpu.memory.limit |
워크플로 작업에 사용할 수 있는 GPU 메모리입니다. 로 식별되는 GPU당 하나의 데이터 포인트입니다gpu.id. |
By |
gauge |
30초 | 액셀러레이터를 사용하는 작업에만 해당됩니다. |
액셀러레이터에 대한 자세한 내용은 섹션을 참조하세요HealthOmics 워크플로 정의의 태스크 리소스.
임시 스토리지에 대한 자세한 내용은 섹션을 참조하세요HealthOmics 워크플로 작업을 위한 임시 스토리지.
공통 속성
모든 HealthOmics 실행 지표에는 데이터 포인트의 소스를 식별하는 공통 리소스 레이블 세트가 있습니다.
| Label | 설명 | 예시 값 |
|---|---|---|
| 공통 리소스 레이블 | ||
@resource.cloud.provider |
지표를 게시한 클라우드 공급자입니다. | aws |
@resource.cloud.account.id |
실행이 속한 AWS 계정입니다. | 123456789012 |
@resource.cloud.region |
실행이 실행된 AWS 리전입니다. | us-west-2 |
@resource.cloud.resource_id |
실행의 ARN입니다. | arn:aws:omics:us-west-2:123456789012:run/1234567 |
@resource.service.name |
지표를 게시한 서비스입니다. | omics |
@resource.aws.omics.workflow.id |
실행에서 사용한 워크플로의 ID입니다. | 1122334 |
@resource.aws.omics.run.id |
실행의 ID입니다. | 1234567 |
@resource.aws.omics.storage.type |
실행 스토리지 유형입니다. | DYNAMIC |
| 작업 리소스 레이블 | ||
@resource.aws.omics.task.id |
데이터 포인트가 사용되는 작업의 ID입니다. aws.omics.task.* 지표에만이 레이블이 있습니다. |
1245938 |
추가 속성
일부 실행 지표에는 지표를 별도의 시계열로 분할하는 추가 데이터 포인트 속성이 있습니다. 이러한 속성을 사용하여 PromQL 쿼리를 필터링할 수 있습니다.
| 추가 속성 | Metrics | 설명 | 값 |
|---|---|---|---|
gpu.id |
aws.omics.task.gpu.utilization, aws.omics.task.gpu.memory.usage, aws.omics.task.gpu.memory.limit |
인스턴스에 있는 GPU의 제로 기반 인덱스입니다. | 0, 1, 2 또는 3 |
scratch.storage.mode |
aws.omics.task.filesystem.scratch.storage.usage, aws.omics.task.filesystem.scratch.storage.limit |
작업이 유효에 따라 스크래치 데이터를 쓰는 위치입니다scratchStorageMode. |
LOCAL 또는 SHARED |
network.io.direction |
aws.omics.task.network.io |
네트워크 전송의 방향입니다. | receive 또는 transmit |
filesystem.io.direction |
aws.omics.task.filesystem.io, aws.omics.task.filesystem.operations |
파일 시스템 작업의 방향입니다. | read 또는 write |
HealthOmics 실행 지표 쿼리
쿼리 스튜디오에서 PromQL 쿼리를 실행하여 CloudWatch 콘솔에서 HealthOmics 실행 지표를 볼 수 있습니다.
HealthOmics 실행 지표를 보려면(CloudWatch 콘솔)
-
cloudwatch:PutMetricData권한으로 실행이 시작되었는지 확인합니다. -
AWS Management Console에 로그인하고 CloudWatch 콘솔
을 엽니다. -
탐색 창에서 Query Studio를 선택합니다.
-
쿼리 편집기의 드롭다운 목록에서 PromQL을 선택합니다.
-
Builder 모드에서 지표 이름과 해당 레이블을 찾아 선택합니다. 또는 편집기 모드에서 PromQL 쿼리를 입력합니다.
-
시간 범위 선택기를 사용하여 시간 범위를 선택합니다.
-
실행을 선택하여 결과를 시계열 그래프로 표시합니다. 그래프 표시 방식을 변경하려면 사용자 지정을 선택합니다.
예를 들어 다음 쿼리는 실행의 각 작업에서 사용 중인 vCPUs를 반환합니다. runID를 검사하려는 실행의 ID로 바꿉니다.
{"aws.omics.task.cpu.usage", "@resource.aws.omics.run.id"="runID"}
각 시계열에 실행 ID와 작업 ID로 레이블을 지정하려면 사용자 지정 레이블을 선택하고 다음을 입력합니다.
{@resource.aws.omics.run.id="${@resource.aws.omics.run.id}",@resource.aws.omics.task.id="${@resource.aws.omics.task.id}"}
HealthOmics 실행 지표를 쿼리하려면(API)
CloudWatch는 지표 데이터를 쿼리하기 위한 Prometheus 호환 APIs 및 엔드포인트를 제공합니다. 이러한 APIs 사용하여 지표를 쿼리하는 방법에 대한 자세한 내용은 Prometheus 호환 APIs.
CloudWatch를 사용하여 경보 생성
지표가 임계값을 초과할 때 CloudWatch에서 알리도록 PromQL 쿼리에서 CloudWatch 경보를 생성할 수 있습니다. 경보는 Amazon Simple Notification Service(Amazon SNS) 주제에 알림을 보내거나 경보 상태가 변경될 때 다른 작업을 시작할 수 있습니다.
PromQL 쿼리에서 경보를 생성하려면(CloudWatch 콘솔)
-
AWS Management Console에 로그인하고 CloudWatch 콘솔
을 엽니다. -
탐색 창에서 Query Studio를 선택합니다.
-
PromQL을 선택하고 쿼리를 입력한 다음 그래프를 확인한 다음 경보 생성 버튼을 선택합니다.
CloudWatch 대시보드에 HealthOmics 실행 지표 추가
다른 지표와 함께 HealthOmics 리소스 사용률을 모니터링할 수 있도록 CloudWatch 대시보드에 PromQL 쿼리를 위젯으로 추가할 수 있습니다.
HealthOmics를 추가하려면 CloudWatch 대시보드에 지표를 실행합니다(CloudWatch 콘솔).
-
AWS Management Console에 로그인하고 CloudWatch 콘솔
을 엽니다. -
탐색 창에서 Query Studio를 선택합니다.
-
PromQL을 선택하고 쿼리를 입력한 다음 그래프를 확인합니다.
-
작업을 선택한 다음 대시보드에 추가를 선택합니다.
-
기존 대시보드를 선택하거나 새 대시보드를 생성한 다음 위젯을 저장합니다.
HealthOmics MCP 서버를 사용하여 실행 지표 분석
HealthOmics 모델 컨텍스트 프로토콜(MCP) 서버를 사용하여 AI 모델의 도움을 받아 실행 지표를 검색하고 여러 차원의 데이터에서 실행 실패를 조사할 수 있습니다. Kiro CLI, Claude Code 또는 기타 MCP 호환 에이전트 클라이언트를 통해 MCP 서버를 사용할 수 있습니다. 자세한 내용은 AWS HealthOmics MCP 서버
콜아웃
HealthOmics는 작업이
RUNNING상태에 도달한 후 실행 지표를 내보내기 시작하고 작업이COMPLETED상태에 도달한 후 실행 지표를 더 이상 내보내지 않습니다. 작업 상태에 대한 자세한 내용은 섹션을 참조하세요작업 상태 값.첫 번째 데이터 포인트는 약 30초의 짧은 지연 후 나타납니다.
30초 미만 동안 실행되는 작업에는 지표가 없을 수 있습니다.
실행의 스토리지 유형이 인 경우가 30분 이상
DYNAMICaws.omics.run.filesystem.usage지연될 수 있으므로 30분 미만의 실행에는 사용하지 못할 수 있습니다.이
scratchStorageMode인 경우 많은 수의 임시 파일을 생성하는 작업에를 사용하지 못할SHAREDaws.omics.task.filesystem.scratch.storage.usage수 있습니다. HealthOmics는 작업의 임시 디렉터리를 재귀적으로 스캔하여이 모드의 사용량을 측정하며, 파일 수가 많을 때 스캔이 항상 시간 제한 내에 완료되는 것은 아닙니다.CPU 및 메모리 지표는 두 측정값이 다른 범위를 사용하기 때문에 실행 매니페스트 값과 다를 수 있습니다. 실행 지표는 작업이 실제로 소비하는 것을 더 잘 반영합니다.
실행 지표는 서비스 역할을 소유하고 실행을 시작하는 AWS 계정에서만 사용할 수 있습니다.
결제
AWS HealthOmics 는 실행 지표에 대해 요금을 부과하지 않습니다. 지표는 계정의 Amazon CloudWatch에 게시되며 CloudWatch는 연결된 활동에 대해 직접 요금을 청구합니다. 요금은 수집된 지표 데이터의 양을 기준으로 합니다. 특정 AWS 리전의 요금은 Amazon CloudWatch 요금을
| 활동 | 요금이 청구되는 방식 |
|---|---|
| OpenTelemetry 지표 게시 | 수집된 데이터의 GB당. 스토리지 또는 고유한 지표 시리즈 수에 대한 별도의 요금 없이 15개월의 스토리지가 포함됩니다. |
| 쿼리 스튜디오 및 대시보드를 포함하여 CloudWatch 콘솔에서 PromQL 쿼리 실행 | 무료입니다. |
| CloudWatch APIs를 사용하여 PromQL 쿼리 실행 | 스캔한 샘플 백만 개당. |
| PromQL 쿼리를 평가하는 경보 | 표준 경보 요금과 각 평가에서 스캔한 샘플에 대한 쿼리 요금. |
옵트아웃
기본적으로 HealthOmics는 실행에 대한 서비스 역할에 cloudwatch:PutMetricData 권한이 있을 때마다 실행 지표를 게시합니다. 향후 요금을 옵트아웃하고 중지하려면 각 실행 수준에서 서비스 역할에서이 권한을 생략할 수 있습니다. 다른 정책이 권한을 부여하더라도 게시를 중지하려면 역할에 명시적 거부를 추가합니다.
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Deny", "Action": "cloudwatch:PutMetricData", "Resource": "*" } ] }
옵트아웃하는 또 다른 방법은 StartRun 요청LogLevel = OFF에서를 설정하여 실행에 대한 로깅을 끄는 것입니다. 를 LogLevel로 설정하면 OFF HealthOmics는 실행 지표를 게시하지 않습니다.