

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

# Pré-requisitos para usar SageMaker HyperPod
<a name="sagemaker-hyperpod-prerequisites"></a>

As seções a seguir explicam os pré-requisitos antes de começar. SageMaker HyperPod

**Topics**
+ [SageMaker HyperPod cotas](#sagemaker-hyperpod-prerequisites-quotas)
+ [Configuração SageMaker HyperPod com uma Amazon VPC personalizada](#sagemaker-hyperpod-prerequisites-optional-vpc)
+ [Configurando SageMaker HyperPod clusters em várias AZs](#sagemaker-hyperpod-prerequisites-multiple-availability-zones)
+ [Configurar AWS Systems Manager e Run As para controle de acesso do usuário do cluster](#sagemaker-hyperpod-prerequisites-ssm)
+ [(Opcional) Configuração SageMaker HyperPod com o Amazon FSx for Lustre](#sagemaker-hyperpod-prerequisites-optional-fsx)

## SageMaker HyperPod cotas
<a name="sagemaker-hyperpod-prerequisites-quotas"></a>

Você pode criar SageMaker HyperPod clusters considerando as cotas de *uso do cluster* em sua AWS conta.

**Importante**  
Para saber mais sobre SageMaker HyperPod preços, consulte [SageMaker HyperPod preços](sagemaker-hyperpod-ref.md#sagemaker-hyperpod-ref-pricing) [Amazon SageMaker Pricing](https://aws.amazon.com/sagemaker/pricing/).

### Veja as SageMaker HyperPod cotas da Amazon usando o Console de gerenciamento da AWS
<a name="sagemaker-hyperpod-prerequisites-quotas-view"></a>

Procure os valores padrão e aplicados de uma *cota*, também conhecida como *limite*, para *uso do cluster*, que é usada para SageMaker HyperPod.

1. Abra o [console do Service Quotas](https://console.aws.amazon.com/servicequotas/).

1. No painel de navegação à esquerda, selecione **Serviços da AWS **.

1. Na lista de **AWS serviços**, pesquise e selecione **Amazon SageMaker AI**.

1. Na lista **de cotas de serviço**, você pode ver o nome da cota de serviço, o valor aplicado (se disponível), a cota AWS padrão e se o valor da cota é ajustável. 

1. Na barra de pesquisa, digite **uso do cluster**. Isso mostra as cotas para uso do cluster, as cotas aplicadas e as cotas padrão.

**Lista de cotas de serviços comuns para criar um HyperPod cluster e seus pré-requisitos**

Talvez você queira verificar se solicitou aumentos no limite da cota de serviço para as cotas a seguir para criar um novo HyperPod cluster junto com os pré-requisitos no console de IA. SageMaker Navegue até o console do **Service Quota** e pesquise os seguintes termos.


****  

| Não | Nome da cota | Termo de pesquisa | Description | 
| --- | --- | --- | --- | 
| 1 | Número máximo de instâncias permitidas por SageMaker HyperPod cluster | Em SageMaker AI, pesquise por “Número máximo de instâncias permitido por SageMaker HyperPod cluster” | O valor da cota no nível da conta deve ser maior do que o número de instâncias que você deseja adicionar ao seu cluster | 
| 2 | Tamanho máximo do volume do EBS em GB para uma instância de SageMaker HyperPod cluster | Em SageMaker AI, pesquise por “Tamanho máximo do volume do EBS em GB para uma instância de HyperPod cluster”  | O valor da cota em nível de conta deve ser maior do que o volume do EBS que você deseja adicionar ao seu cluster | 
| 3 | Número total de instâncias permitidas em todos os SageMaker HyperPod clusters | Em SageMaker AI, pesquise por “Número total de instâncias permitidas em SageMaker HyperPod clusters”  | O valor da cota no nível da conta deve ser maior do que o total de instâncias que você deseja adicionar em todos os clusters da sua conta em conjunto | 
| 4 | Cotas de instância  | Em SageMaker IA, pesquise por “ml”. <instance\_type>para uso de cluster”, por exemplo: ml.p5.48xlarge para uso de cluster | O valor da cota em nível de conta para o tipo de instância específico (por exemplo: ml.p5.48xlarge) deve ser maior que o número de instâncias a serem adicionadas em todos os clusters da sua conta em conjunto. | 
| 5 | VPCs por região | Em Amazon Virtual Private Cloud (Amazon VPC), pesquise por “VPCs por região” | O valor da cota no nível da conta deve ser suficiente para criar uma nova VPC na conta ao configurar seu cluster. HyperPod Verifique se você já esgotou esse limite de cota no console da VPC. Esse aumento de cota só é necessário se você criar uma nova VPC por meio da opção de configuração de cluster rápida ou personalizada no SageMaker HyperPod console. | 
| 6 | Gateways da Internet por região | Em Amazon Virtual Private Cloud (Amazon VPC), pesquise por “Gateways de Internet por região” | O valor da cota no nível da conta deve ser suficiente para criar um gateway de Internet adicional na conta ao configurar seu cluster. SageMaker HyperPod Esse aumento de cota só é necessário se você criar uma nova VPC por meio da opção de configuração de cluster rápida ou personalizada no SageMaker HyperPod console.  | 
| 7 | Interfaces de rede por região | Em Amazon Virtual Private Cloud (Amazon VPC), pesquise por “Interfaces de rede por região” | O valor da cota no nível da conta deve ter interfaces de rede suficientes na conta ao configurar seu cluster. HyperPod  | 
| 8 | EC2-VPC IPs elásticos | Em Amazon Elastic Compute Cloud (Amazon EC2), pesquise por “Elastic IPs” EC2-VPC  | O valor da cota no nível da conta deve ser suficiente para criar uma nova VPC na conta ao configurar seu cluster. HyperPod Verifique se você já esgotou esse limite de cota no console da VPC. Esse aumento de cota só é necessário se você criar uma nova VPC por meio da opção de configuração de cluster rápida ou personalizada no SageMaker HyperPod console. | 

### Solicite um aumento de SageMaker HyperPod cota da Amazon usando o Console de gerenciamento da AWS
<a name="sagemaker-hyperpod-prerequisites-quotas-increase"></a>

Aumente suas cotas no nível da conta ou do recurso.

1. Para aumentar a cota de instâncias para *uso do cluster*, selecione a cota que você deseja aumentar.

1. Se a cota for ajustável, você poderá solicitar um aumento de cota no nível da conta ou do recurso com base no valor listado na coluna **Ajustabilidade**.

1. Em **Alterar o valor da cota**, insira o novo valor. O novo valor deve ser maior que o valor atual.

1. Escolha **Solicitar**.

1. Para visualizar quaisquer solicitações pendentes ou resolvidas recentemente no console, navegue até a guia **Histórico de solicitações** na página de detalhes do serviço ou escolha **Painel no painel** de navegação. Para solicitações pendentes, escolha o status da solicitação para abrir o recibo da solicitação. O status inicial de uma solicitação é **Pending** (Pendente). Depois que o status mudar para **Cota solicitada**, você verá o número do caso com AWS Support. Escolha o número do caso para abrir o tíquete de sua solicitação.

Para informações sobre como solicitar o aumento da cota, consulte [Solicitar um aumento de cota](https://docs.aws.amazon.com/servicequotas/latest/userguide/request-quota-increase.html) no *Guia do usuário do AWS Service Quotas*.

## Configuração SageMaker HyperPod com uma Amazon VPC personalizada
<a name="sagemaker-hyperpod-prerequisites-optional-vpc"></a>

Para configurar um SageMaker HyperPod cluster com uma Amazon VPC personalizada, analise os seguintes pré-requisitos.

**nota**  
A configuração da VPC é obrigatória para a orquestração do Amazon EKS. Para a orquestração do Slurm, a configuração da VPC é opcional.
+  Valide a capacidade [da Elastic Network Interface](https://docs.aws.amazon.com/AWSEC2/latest/UserGuide/using-eni.html) (ENI) em sua Conta da AWS antes de criar um SageMaker HyperPod cluster com uma VPC personalizada. O limite de ENI é controlado pelo Amazon EC2 e varia de acordo com. Região da AWS SageMaker HyperPod não pode solicitar automaticamente aumentos de cota. 

**Para verificar sua cota de ENI atual:**

  1. Abra o [console do Service Quotas](https://console.aws.amazon.com/servicequotas/).

  1. **Na seção **Gerenciar cotas**, use a lista suspensa ** AWS Serviços** para pesquisar VPC.** 

  1. Opte por visualizar as cotas da **Amazon Virtual Private Cloud (Amazon VPC)**. 

  1. Procure a cota de serviço, as **interfaces de rede por região** ou o **código de cota** `L-DF5E4CA3`.

  Se o limite atual de ENI for insuficiente para as necessidades SageMaker HyperPod do cluster, solicite um aumento de cota. Garantir previamente a capacidade de ENI adequada ajuda a evitar falhas na implantação do cluster.
+ Ao usar uma VPC personalizada para conectar um SageMaker HyperPod cluster com AWS recursos, forneça o nome, o ID, os IDs de sub-rede e os IDs do grupo de segurança da VPC durante a criação do cluster. Região da AWS
**nota**  
Quando a Amazon VPC e as sub-redes permitem usar IPv6 na [https://docs.aws.amazon.com//sagemaker/latest/APIReference/API_CreateCluster.html#sagemaker-CreateCluster-request-VpcConfig](https://docs.aws.amazon.com//sagemaker/latest/APIReference/API_CreateCluster.html#sagemaker-CreateCluster-request-VpcConfig) do cluster ou em nível de grupo de instâncias usando o atributo `OverrideVPCConfig` de [https://docs.aws.amazon.com//sagemaker/latest/APIReference/API_ClusterInstanceGroupSpecification.html](https://docs.aws.amazon.com//sagemaker/latest/APIReference/API_ClusterInstanceGroupSpecification.html), as comunicações de rede diferem com base na plataforma de orquestração do cluster:  
Slurm-orchestrated os clusters configuram automaticamente nós com endereços IPv6 e IPv4 duplos, permitindo comunicações de rede IPv6 imediatas. Nenhuma configuração adicional é necessária além das configurações de IPv6 da `VPCConfig`.
Em EKS-orchestrated clusters, os nós recebem endereçamento de pilha dupla, mas os pods só podem usar IPv6 quando o cluster Amazon EKS é explícito. IPv6-enabled Você deve criar um cluster IPv6 do Amazon EKS. Os clusters IPv4 existentes do Amazon EKS não podem ser convertidos em IPv6. Para ter informações sobre a implantação de um cluster IPv6 do Amazon EKS, consulte [Implantar um cluster IPv6 do Amazon EKS](https://docs.aws.amazon.com/eks/latest/userguide/deploy-ipv6-cluster.html#_deploy_an_ipv6_cluster_with_eksctl).
Recursos adicionais para configuração do IPv6:  
Para ter informações sobre como adicionar suporte a IPv6 à sua VPC, consulte [IPv6 Support for VPC](https://docs.aws.amazon.com//vpc/latest/userguide/vpc-migrate-ipv6.html).
Para obter informações sobre como criar uma nova IPv6-compatible VPC, consulte o Guia de [Amazon VPC criação](https://docs.aws.amazon.com//vpc/latest/userguide/create-vpc.html).
Para configurar SageMaker HyperPod com uma Amazon VPC personalizada, consulte Configuração personalizada [da Amazon VPC para](https://docs.aws.amazon.com//sagemaker/latest/dg/sagemaker-hyperpod-prerequisites.html#sagemaker-hyperpod-prerequisites-optional-vpc). SageMaker HyperPod
+ Certifique-se de que todos os recursos estejam implantados da Região da AWS mesma forma que o SageMaker HyperPod cluster. Configure as regras do grupo de segurança para permitir a comunicação entre recursos dentro da VPC. Por exemplo, ao criar uma VPC na `us-west-2`, provisione sub-redes em uma ou mais zonas de disponibilidade (como `us-west-2a` ou `us-west-2b`) e crie um grupo de segurança que permita o tráfego intragrupo.
**nota**  
SageMaker HyperPod suporta a implantação de zonas de multidisponibilidade. Para obter mais informações, consulte [Configurando SageMaker HyperPod clusters em várias AZs](#sagemaker-hyperpod-prerequisites-multiple-availability-zones).
+ Estabeleça conectividade Amazon Simple Storage Service (Amazon S3) para grupos de VPC-deployed SageMaker HyperPod instâncias criando um VPC endpoint. Sem acesso à internet, os grupos de instâncias não podem armazenar ou recuperar scripts de ciclo de vida, dados de treinamento ou artefatos de modelo. Recomendamos que você crie uma política personalizada do IAM restringindo o acesso ao bucket do Amazon S3 à VPC privada. Para ter mais informações, consulte [Gateway endpoints for Amazon S3](https://docs.aws.amazon.com/AmazonVPC/latest/UserGuide/vpc-endpoints-s3.html) no *Guia do AWS PrivateLink *.
+ Para HyperPod clusters que usam instâncias habilitadas para o Elastic Fabric Adapter (EFA), configure o grupo de segurança para permitir todo o tráfego de entrada e saída de e para o próprio grupo de segurança. Mais especificamente, evite usar `0.0.0.0/0` para regras de saída, pois isso pode causar falhas na verificação de integridade do EFA. Para obter mais informações sobre as diretrizes de preparação de grupos de segurança da EFA, consulte [Etapa 1: Preparar um grupo EFA-enabled de segurança](https://docs.aws.amazon.com/AWSEC2/latest/UserGuide/efa-start.html#efa-start-security) no Guia do *usuário do Amazon EC2*.
+ Considere cuidadosamente o tamanho do bloco de Inter-Domain roteamento sem classe (CIDR) da sua sub-rede antes de criar clusters. HyperPod 
  + O tamanho do bloco CIDR da sub-rede não pode ser alterado após a criação. Isso é especialmente importante quando você usa grandes instâncias aceleradas, como a P5. Sem um tamanho de bloco suficiente, você deve recriar os clusters ao aumentar a escala verticalmente.
  + Ao escolher o tamanho apropriado do bloco CIDR da sub-rede, considere estes fatores: os tipos de instância, o número esperado de instâncias e o número de endereços IP consumidos por instância.
  + Para Slurm-orchestrated clusters, cada instância P5 pode criar 32 endereços IP (um por placa de rede). Para EKS-orchestrated clusters, cada instância P5 pode criar 81 endereços IP (50 da placa primária mais um de cada uma das 31 placas restantes). Para ter especificações detalhadas, consulte [Network specifications](https://docs.aws.amazon.com/ec2/latest/instancetypes/ac.html#ac_network) no *Guia do desenvolvedor de tipos de instância do Amazon EC2*.
  + [Para exemplos de CloudFormation modelos que especificam o tamanho do bloco CIDR da sub-rede, consulte o modelo [HyperPod Slurm e o modelo HyperPod ](https://github.com/aws-samples/awsome-distributed-training/blob/main/1.architectures/5.sagemaker-hyperpod/sagemaker-hyperpod.yaml)[Amazon EKS no incrível repositório de treinamento distribuído](https://github.com/aws-samples/awsome-distributed-training/blob/main/1.architectures/7.sagemaker-hyperpod-eks/cfn-templates/nested-stacks/private-subnet-stack.yaml).](https://github.com/aws-samples/awsome-distributed-training/tree/main)

## Configurando SageMaker HyperPod clusters em várias AZs
<a name="sagemaker-hyperpod-prerequisites-multiple-availability-zones"></a>

Você pode configurar seus SageMaker HyperPod clusters em várias zonas de disponibilidade (AZs) para melhorar a confiabilidade e a disponibilidade.

**nota**  
O tráfego do Elastic Fabric Adapter (EFA) não pode cruzar AZs ou VPCs. Isso não se aplica ao tráfego IP normal do dispositivo ENA de uma interface EFA. Para ter mais informações, consulte [Limitações de EFA](https://docs.aws.amazon.com/AWSEC2/latest/UserGuide/efa.html).
+ **Comportamento padrão**

  HyperPod implanta todas as instâncias do cluster em uma única zona de disponibilidade. A configuração da VPC determina a AZ de implantação:
  + Para Slurm-orchestrated clusters, a configuração de VPC é opcional. Quando nenhuma configuração de VPC é fornecida, o HyperPod padrão é uma sub-rede da plataforma VPC. 
  + Para EKS-orchestrated clusters, a configuração de VPC é necessária.
  + Para os orquestradores Slurm e EKS, quando fornecido, [https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_VpcConfig.html](https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_VpcConfig.html) HyperPodseleciona uma sub-rede na lista de sub-redes do fornecido. `VpcConfig` Todos os grupos de instâncias herdam a AZ da sub-rede. 
**nota**  
Após a criação de um cluster, não é possível modificar as definições da `VpcConfig`.

  Para saber mais sobre como configurar VPCs para HyperPod clusters, consulte a seção anterior,. [Configuração SageMaker HyperPod com uma Amazon VPC personalizada](#sagemaker-hyperpod-prerequisites-optional-vpc)
+ ** Multi-AZ configuração**

  Você pode configurar seu HyperPod cluster em várias AZs ao criar um cluster ou ao adicionar um novo grupo de instâncias a um cluster existente. Para configurar implantações multi-AZ, você pode substituir as configurações de VPC padrão do cluster especificando diferentes sub-redes e grupos de segurança, possivelmente em diferentes zonas de disponibilidade, para grupos de instâncias individuais no cluster. 

  SageMaker HyperPod Os usuários da API podem usar a `OverrideVpcConfig` propriedade dentro do [ClusterInstanceGroupSpecification](https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_ClusterInstanceGroupSpecification.html)ao trabalhar com as [https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_UpdateCluster.html](https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_UpdateCluster.html)APIs [https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_CreateCluster.html](https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_CreateCluster.html)ou.

  O campo `OverrideVpcConfig`:
  + Não pode ser modificado após a criação do grupo de instâncias.
  + É opcional. Se não for especificado, o nível do cluster da [https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_VpcConfig.html](https://docs.aws.amazon.com/sagemaker/latest/APIReference/API_VpcConfig.html) será usado como padrão.
  + Para Slurm-orchestrated clusters, só pode ser especificado quando o nível do cluster `VpcConfig` é fornecido. Se `VpcConfig` não for especificada no nível do cluster, `OverrideVpcConfig` não poderá ser usada para nenhum grupo de instâncias.
  + Contém dois campos obrigatórios:
    + `Subnets`: aceita de 1 a 16 IDs de sub-rede.
    + `SecurityGroupIds`: aceita de 1 a 5 IDs de grupo de segurança.

  Para obter mais informações sobre como criar ou atualizar um SageMaker HyperPod cluster usando a interface do usuário do SageMaker HyperPod console ou o AWS CLI:
  + [Orquestração do Slurm: consulte Clusters operacionais. Slurm-orchestrated HyperPod](sagemaker-hyperpod-operate-slurm.md)
  + Orquestração do EKS. Consulte [ EKS-orchestrated HyperPodClusters operacionais](sagemaker-hyperpod-eks-operate.md).

**nota**  
Ao executar workloads em várias AZs, esteja ciente de que a comunicação de rede entre AZs gera latência adicional. Considere esse impacto ao projetar aplicações sensíveis à latência.

## Configurar AWS Systems Manager e Run As para controle de acesso do usuário do cluster
<a name="sagemaker-hyperpod-prerequisites-ssm"></a>

[SageMaker HyperPod DLAMI](sagemaker-hyperpod-ref.md#sagemaker-hyperpod-ref-hyperpod-ami)vem com [AWS Systems Manager](https://aws.amazon.com/systems-manager/)(SSM) pronto para uso para ajudar você a gerenciar o acesso aos grupos de instâncias SageMaker HyperPod do cluster. Esta seção descreve como criar usuários do sistema operacional (SO) em seus SageMaker HyperPod clusters e associá-los a usuários e funções do IAM. Isso é útil para autenticar sessões SSM usando as credenciais da conta de usuário do sistema operacional.

**nota**  
Conceder aos usuários acesso aos nós HyperPod do cluster permite que eles instalem e operem software gerenciado pelo usuário nos nós. Mantenha o princípio de permissões de privilégio mínimo para os usuários.

### Ativando o Run As em seu AWS account
<a name="sagemaker-hyperpod-prerequisites-ssm-enable-runas"></a>

Como administrador AWS da conta ou administrador da nuvem, você pode gerenciar o acesso aos SageMaker HyperPod clusters em uma função do IAM ou nível de usuário usando o [recurso Run As no SSM](https://docs.aws.amazon.com/systems-manager/latest/userguide/session-preferences-run-as.html). Com esse atributo, você pode iniciar cada sessão de SSM usando o usuário do sistema operacional associado ao perfil ou ao perfil do IAM.

Para ativar o Run As em sua AWS conta, siga as etapas [em Ativar o suporte ao Run As para nós gerenciados do Linux e macOS](https://docs.aws.amazon.com/systems-manager/latest/userguide/session-preferences-run-as.html). Se você já criou usuários de sistema operacional em seu cluster, certifique-se de associá-los às funções ou perfis do IAM, marcando-os conforme orientado na **Opção 2** da etapa 5, em **Ativar a opção de compatibilidade Executar como para nós gerenciados do Linux e macOS**.

## (Opcional) Configuração SageMaker HyperPod com o Amazon FSx for Lustre
<a name="sagemaker-hyperpod-prerequisites-optional-fsx"></a>

Para começar a usar SageMaker HyperPod e mapear caminhos de dados entre o cluster e seu sistema de arquivos FSx for Lustre, selecione um dos Regiões da AWS suportados pelo. SageMaker HyperPod Depois de escolher a Região da AWS que você prefere, você também deve determinar qual zona de disponibilidade (AZ) usar. 

Se você usar nós de SageMaker HyperPod computação em AZs diferentes das AZs em que seu sistema de arquivos FSx for Lustre está configurado dentro do Região da AWS mesmo, pode haver sobrecarga de comunicação e rede. Recomendamos que você use a mesma AZ física da conta de SageMaker HyperPod serviço para evitar qualquer tráfego cruzado de AZ entre SageMaker HyperPod clusters e seu sistema de arquivos FSx for Lustre. Além disso, verifique se o configurou com sua VPC. Se você quiser usar o Amazon FSx como o principal sistema de arquivos para armazenamento, deverá configurar SageMaker HyperPod clusters com sua VPC.