View a markdown version of this page

Crie um grupo de nós de computação para nós de login no AWS PEÇAS - AWS PEÇAS

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Crie um grupo de nós de computação para nós de login no AWS PEÇAS

Um grupo de nós de computação é uma coleção virtual de nós de computação (instâncias do EC2) que o AWS PCS inicia e gerencia. Ao definir um grupo de nós de computação, você especifica características comuns, como tipos de instância do EC2, contagem mínima e máxima de instâncias, sub-redes VPC de destino, opção de compra preferida e configuração de inicialização personalizada. AWS O PCS inicia, gerencia e encerra com eficiência os nós de computação em um grupo de nós de computação, de acordo com essas configurações.

Nesta etapa, você iniciará um grupo de nós de computação estáticos que fornece acesso interativo ao cluster. Você pode usar o SSH ou o Amazon EC2 Systems Manager (SSM) para fazer login nele, executar comandos de shell e gerenciar trabalhos do Slurm.

Para criar o grupo de nós de computação
  • Abra o console AWS PCS e navegue até Clusters.

  • Selecione o cluster chamado get-started

  • Navegue até Compute node groups e escolha Create.

  • Na seção Configuração do grupo de nós de computação, forneça o seguinte:

    • Nome do grupo de nós de computação — Digitelogin.

  • Em Configuração de computação, insira ou selecione estes valores:

    • Modelo de lançamento do EC2 — Escolha o modelo de lançamento em que o nome está login-getstarted-lt

    • Perfil de instância do IAM — Escolha o perfil da instância chamado AWSPCS-getstarted-role

    • Sub-redes — Selecione a sub-rede com a qual o nome começa. hpc-networking:PublicSubnetA Os nós de login são executados em uma sub-rede pública para que você possa acessá-los para fazer login e enviar trabalhos.

    • Instâncias — Selecionec6i.xlarge.

    • Configuração de escalabilidade — Para Contagem mínima de instâncias, insira. 1 Para Contagem máxima de instâncias, insira1. A correção de ambas as contagens 1 mantém um único nó de login funcionando o tempo todo como um ponto de entrada estável para o cluster.

  • Em Configurações adicionais, especifique o seguinte:

    • ID da AMI — selecione uma AMI que você deseja usar, que tenha um nome no seguinte formato:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      nota

      As AMIs de amostra para o Slurm 25.05 e versões anteriores usam o Amazon Linux (2amzn2) em vez do Amazon Linux 2023 (). al2023

      Para obter mais informações sobre os exemplos de AMIs, consulteUsando amostras de Amazon Machine Images (AMIs) com AWS PCS.

  • Na seção Ações do ciclo de vida do nó, adicione scripts que montam armazenamento compartilhado e encaminham registros do nó. Escolha Adicionar script para cada uma das ações a seguir. Os scripts são executados de cima para baixo em um estágio, então adicione-os na ordem mostrada. Para obter mais informações sobre os scripts que a AWS mantém, consulteAWS-scripts mantidos.

    1. configure-cloudwatch-logs — Encaminha os logs de ação do ciclo de vida de cada nó para o Amazon Logs. CloudWatch Configure-o primeiro para que as ações a seguir tenham sua saída capturada da primeira inicialização do nó.

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Local do script — insiras3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh, region substituindo pela AWS Região do seu cluster.

      • Nome — Inserirconfigure-cloudwatch-logs.

      • Argumentos — Deixe esse campo vazio. O script envia registros automaticamente para o grupo de /aws/pcs/cluster-id/lifecycle registros.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneFIRST_BOOT_ONLY.

    2. configure-efs-homes — Monta o sistema de arquivos Amazon EFS como base do diretório inicial /home e configura o nó para criar o diretório inicial de cada usuário no primeiro login.

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Local do script — insiras3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh, region substituindo pela AWS Região do seu cluster.

      • Nome — Inserirconfigure-efs-homes.

      • Argumentos — Insira--efs-id efs-file-system-id --home-base /home --options tls, efs-file-system-id substituindo pelo ID do sistema de arquivos EFS que você criou anteriormente no tutorial.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneEVERY_BOOT.

    3. mount-fsx-lustre — monta o sistema de arquivos FSx for Lustre para um armazenamento de rascunho compartilhado de alto desempenho. /shared

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Local do script — insiras3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh, region substituindo pela AWS Região do seu cluster (por exemplo,us-east-1).

      • Nome — Inserirmount-fsx-lustre.

      • Argumentos — Insira--fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared, fsx-dns-name substituindo pelo nome DNS e mount-name pelo nome do Mount que você anotou ao criar o sistema de arquivos FSx for Lustre.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneEVERY_BOOT.

    4. set-shared-dir-mode — Define permissões /shared fixas e graváveis mundialmente para que qualquer usuário possa criar arquivos 1777 nele. Ele é executado depois mount-fsx-lustre para que se aplique ao sistema de arquivos montado.

      • Estágio do ciclo de vida — Selecione. nodeBootstrapped

      • Localização do script — Enterhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Esse script comunitário foi publicado pela HPC Recipes for AWS.

      • Nome — Inserirset-shared-dir-mode.

      • Argumentos — Digite--path /shared --mode 1777.

      • Comportamento de tratamento de erros — SelecioneCONTINUE.

      • Política de execução — SelecioneEVERY_BOOT.

  • Escolha Criar grupo de nós de computação.

O campo Status mostra Criando enquanto o grupo de nós de computação está sendo provisionado. Você pode prosseguir para a próxima etapa do tutorial enquanto ela estiver em andamento.