View a markdown version of this page

Crie um grupo de nós de computação para executar trabalhos de computação no AWS PEÇAS - AWS PEÇAS

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Crie um grupo de nós de computação para executar trabalhos de computação no AWS PEÇAS

Nesta etapa, você iniciará um grupo de nós de computação que se dimensiona elasticamente para executar trabalhos enviados ao cluster.

Para criar o grupo de nós de computação
  • Abra o console AWS PCS e navegue até Clusters.

  • Selecione o cluster chamado get-started

  • Navegue até Compute node groups e escolha Create.

  • Na seção Configuração do grupo de nós de computação, forneça o seguinte:

    • Nome do grupo de nós de computação — Digitecompute-1.

  • Em Configuração de computação, insira ou selecione estes valores:

    • Modelo de lançamento do EC2 — Escolha o modelo de lançamento em que o nome está compute-getstarted-lt

    • Perfil de instância do IAM — Escolha o perfil da instância chamado AWSPCS-getstarted-role

    • Sub-redes — Selecione a sub-rede com a qual o nome começa. hpc-networking:PrivateSubnetA Os nós de computação são executados em uma sub-rede privada porque processam trabalhos e não precisam ser acessados pela Internet.

    • Instâncias — Selecionec6i.xlarge.

    • Configuração de escalabilidade — Para Contagem mínima de instâncias, insira. 0 Para Contagem máxima de instâncias, insira4. No mínimo, 0 permite que o AWS PCS reduza o grupo para nenhuma instância quando não há tarefas para executar, então você paga pela computação somente quando o trabalho está na fila.

  • Em Configurações adicionais, especifique o seguinte:

    • ID da AMI — selecione uma AMI que você deseja usar, que tenha um nome no seguinte formato:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      nota

      As AMIs de amostra para o Slurm 25.05 e versões anteriores usam o Amazon Linux (2amzn2) em vez do Amazon Linux 2023 (). al2023

      Para obter mais informações sobre os exemplos de AMIs, consulteUsando amostras de Amazon Machine Images (AMIs) com AWS PCS.

  • Na seção Ações do ciclo de vida do nó, adicione scripts que montam armazenamento compartilhado e encaminham registros do nó. Escolha Adicionar script para cada uma das ações a seguir. Os scripts são executados de cima para baixo em um estágio, então adicione-os na ordem mostrada. Para obter mais informações sobre os scripts que a AWS mantém, consulteAWS-scripts mantidos.

    1. configure-cloudwatch-logs — Encaminha os logs de ação do ciclo de vida de cada nó para o Amazon Logs. CloudWatch Configure-o primeiro para que as ações a seguir tenham sua saída capturada da primeira inicialização do nó.

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Local do script — insiras3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh, region substituindo pela AWS Região do seu cluster.

      • Nome — Inserirconfigure-cloudwatch-logs.

      • Argumentos — Deixe esse campo vazio. O script envia registros automaticamente para o grupo de /aws/pcs/cluster-id/lifecycle registros.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneFIRST_BOOT_ONLY.

    2. configure-efs-homes — Monta o sistema de arquivos Amazon EFS como base do diretório inicial /home e configura o nó para criar o diretório inicial de cada usuário no primeiro login.

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Local do script — insiras3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh, region substituindo pela AWS Região do seu cluster.

      • Nome — Inserirconfigure-efs-homes.

      • Argumentos — Insira--efs-id efs-file-system-id --home-base /home --options tls, efs-file-system-id substituindo pelo ID do sistema de arquivos EFS que você criou anteriormente no tutorial.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneEVERY_BOOT.

    3. mount-fsx-lustre — monta o sistema de arquivos FSx for Lustre para um armazenamento de rascunho compartilhado de alto desempenho. /shared

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Local do script — insiras3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh, region substituindo pela AWS Região do seu cluster (por exemplo,us-east-1).

      • Nome — Inserirmount-fsx-lustre.

      • Argumentos — Insira--fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared, fsx-dns-name substituindo pelo nome DNS e mount-name pelo nome do Mount que você anotou ao criar o sistema de arquivos FSx for Lustre.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneEVERY_BOOT.

    4. set-shared-dir-mode — Define permissões /shared fixas e graváveis mundialmente para que qualquer usuário possa criar arquivos 1777 nele. Ele é executado depois mount-fsx-lustre para que se aplique ao sistema de arquivos montado.

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Localização do script — Enterhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Esse script comunitário foi publicado pela HPC Recipes for AWS.

      • Nome — Inserirset-shared-dir-mode.

      • Argumentos — Digite--path /shared --mode 1777.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneEVERY_BOOT.

  • Escolha Criar grupo de nós de computação.

O campo Status mostra Criando enquanto o grupo de nós de computação está sendo provisionado.

Importante

Aguarde até que o campo Status mostre Ativo antes de prosseguir para a próxima etapa deste tutorial.