View a markdown version of this page

Configurazione del componente aggiuntivo per l'osservabilità SageMaker HyperPod - Amazon SageMaker AI

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Configurazione del componente aggiuntivo per l'osservabilità SageMaker HyperPod

L’elenco seguente descrive i prerequisiti per la configurazione del componente aggiuntivo Observability.

Per inviare le metriche del cluster Amazon SageMaker HyperPod (SageMaker HyperPod) a uno spazio di lavoro Amazon Managed Service for Prometheus e, facoltativamente, visualizzarle in Amazon Managed Grafana, collega innanzitutto le seguenti politiche e autorizzazioni gestite al ruolo della tua console.

  • Per utilizzare Amazon Managed Grafana, abilita Centro identità AWS IAM (IAM Identity Center) dove Amazon Managed Grafana è disponibile. Regione AWS Per istruzioni, consulta Getting started with IAM Identity Center in Centro identità AWS IAM User Guide. Per un elenco delle Regioni AWS in cui è disponibile Grafana gestito da Amazon, consulta Supported Regions in Amazon Managed Grafana User Guide.

  • Crea almeno un utente nel Centro identità IAM.

  • Assicurati che il componente aggiuntivo Amazon EKS Pod Identity Agent sia installato nel tuo cluster Amazon EKS. Il componente aggiuntivo Amazon EKS Pod Identity Agent consente al componente aggiuntivo di SageMaker HyperPod osservabilità di ottenere le credenziali per interagire con Amazon Managed Service for Prometheus and Logs. CloudWatch Per verificare se il tuo cluster Amazon EKS dispone del componente aggiuntivo, accedi alla console Amazon EKS e controlla la scheda del cluster. Add-ons Per informazioni su come installare il componente aggiuntivo, se non è installato, consulta Create add-on (Console di gestione AWS) in Amazon EKS User Guide.

    Nota

    L'Amazon EKS Pod Identity Agent è richiesto per i gruppi di istanze standard. Per i Restricted Instance Groups (RIG), il Pod Identity Agent non è disponibile a causa di vincoli di isolamento della rete. Il ruolo IAM di esecuzione del gruppo di istanze del cluster viene utilizzato per interagire con Amazon Managed Service for Prometheus. Per informazioni su come configurare quel ruolo, consulta. Prerequisiti aggiuntivi per i gruppi di istanze con restrizioni

  • Assicurati di avere almeno un nodo nel SageMaker HyperPod cluster prima di installare il componente aggiuntivo SageMaker HyperPod Observability. Il tipo di istanza Amazon EC2 con le dimensioni più ridotte adatto a questo caso è 4xlarge. Questo requisito di dimensione minima del nodo garantisce che il nodo possa ospitare tutti i pod creati dal componente aggiuntivo di SageMaker HyperPod osservabilità insieme a qualsiasi altro pod già in esecuzione sul cluster.

  • Aggiungi le policy e le autorizzazioni seguenti al tuo ruolo.

    • AWS politica gestita: AmazonSageMakerHyperPodObservabilityAdminAccess

    • AWS politica gestita: AWSGrafanaWorkspacePermissionManagementV2

    • AWS politica gestita: AmazonSageMakerFullAccess

    • Autorizzazioni aggiuntive per configurare i ruoli IAM richiesti per l’accesso ai componenti aggiuntivi Grafana gestito da Amazon e Amazon Elastic Kubernetes Service:

      JSON
      { "Version":"2012-10-17", "Statement": [ { "Sid": "CreateRoleAccess", "Effect": "Allow", "Action": [ "iam:CreateRole", "iam:CreatePolicy", "iam:AttachRolePolicy", "iam:ListRoles" ], "Resource": [ "arn:aws:iam::*:role/service-role/AmazonSageMakerHyperPodObservabilityGrafanaAccess*", "arn:aws:iam::*:role/service-role/AmazonSageMakerHyperPodObservabilityAddonAccess*", "arn:aws:iam::*:policy/service-role/HyperPodObservabilityAddonPolicy*", "arn:aws:iam::*:policy/service-role/HyperPodObservabilityGrafanaPolicy*" ] } ] }
    • Autorizzazioni aggiuntive necessarie per gestire gli utenti del Centro identità IAM per Grafana gestito da Amazon:

      JSON
      { "Version":"2012-10-17", "Statement": [ { "Sid": "SSOAccess", "Effect": "Allow", "Action": [ "sso:ListProfileAssociations", "sso-directory:SearchUsers", "sso-directory:SearchGroups", "sso:AssociateProfile", "sso:DisassociateProfile" ], "Resource": [ "*" ] } ] }

Prerequisiti aggiuntivi per i gruppi di istanze con restrizioni

Se il cluster contiene gruppi di istanze con restrizioni, il ruolo di esecuzione del gruppo di istanze deve disporre delle autorizzazioni per scrivere metriche su Amazon Managed Service for Prometheus. Quando utilizzi Quick setup per creare il cluster con l'osservabilità abilitata, queste autorizzazioni vengono aggiunte automaticamente al ruolo di esecuzione.

Se utilizzi la configurazione personalizzata o aggiungi l'osservabilità a un cluster RIG esistente, assicurati che il ruolo di esecuzione per ogni gruppo di istanze con restrizioni disponga delle seguenti autorizzazioni:

{ "Version": "2012-10-17", "Statement": [ { "Sid": "PrometheusAccess", "Effect": "Allow", "Action": "aps:RemoteWrite", "Resource": "arn:aws:aps:us-east-1:account_id:workspace/workspace-ID" } ] }

Sostituisci us-east-1 e workspace-ID con il tuo ID account e Regione AWS l'ID dello spazio di lavoro Amazon Managed Service for Prometheus. account_id

Una volta soddisfatti i prerequisiti sopra indicati, puoi installare il componente aggiuntivo Observability.

Per installare rapidamente il componente aggiuntivo Observability
  1. Apri la console Amazon AI all'indirizzo SageMaker . https://console.aws.amazon.com/sagemaker/

  2. Vai alla pagina dei dettagli del cluster.

  3. Nella scheda Dashboard, individua il componente aggiuntivo denominato HyperPod Monitoring & Observability e scegli Installazione rapida.

Per eseguire un’installazione personalizzata del componente aggiuntivo Observability
  1. Vai alla pagina dei dettagli del cluster.

  2. Nella scheda Dashboard, individua il componente aggiuntivo denominato HyperPod Monitoring & Observability e scegli Installazione personalizzata.

  3. Specifica le categorie delle metriche da visualizzare. Per ulteriori informazioni su tali categorie, consulta SageMaker HyperPod metriche del cluster.

  4. Specifica se desideri abilitare Amazon CloudWatch Logs.

  5. Specifica se desideri che il servizio crei un nuovo spazio di lavoro del Servizio gestito da Amazon per Prometheus.

  6. Per visualizzare le metriche nelle dashboard di Grafana gestito da Amazon, seleziona la casella Utilizza uno spazio di lavoro Grafana gestito da Amazon. Puoi specificare il tuo spazio di lavoro o lasciare che il servizio ne crei uno nuovo per te.

    Nota

    Amazon Managed Grafana non è disponibile in tutte le versioni Regioni AWS in cui è disponibile Amazon Managed Service for Prometheus. Tuttavia, puoi configurare uno spazio di lavoro Grafana in qualsiasi Regione AWS e impostarlo per ottenere dati metrici da uno spazio di lavoro di Prometheus che si trova in un’altra Regione AWS. Per informazioni, consulta Use AWS data source configuration to add Amazon Managed Service for Prometheus as a data source e Connect to Amazon Managed Service for Prometheus and open-source Prometheus data sources.