As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
Crie um grupo de nós de computação para nós de login no AWS PEÇAS
Um grupo de nós de computação é uma coleção virtual de nós de computação (instâncias do EC2) que o AWS PCS inicia e gerencia. Ao definir um grupo de nós de computação, você especifica características comuns, como tipos de instância do EC2, contagem mínima e máxima de instâncias, sub-redes VPC de destino, opção de compra preferida e configuração de inicialização personalizada. AWS O PCS inicia, gerencia e encerra com eficiência os nós de computação em um grupo de nós de computação, de acordo com essas configurações.
Nesta etapa, você iniciará um grupo de nós de computação estáticos que fornece acesso interativo ao cluster. Você pode usar o SSH ou o Amazon EC2 Systems Manager (SSM) para fazer login nele, executar comandos de shell e gerenciar trabalhos do Slurm.
Para criar o grupo de nós de computação
-
Abra o console AWS PCS
e navegue até Clusters. -
Selecione o cluster chamado
get-started -
Navegue até Compute node groups e escolha Create.
-
Na seção Configuração do grupo de nós de computação, forneça o seguinte:
-
Nome do grupo de nós de computação — Digite
login.
-
-
Em Configuração de computação, insira ou selecione estes valores:
-
Modelo de lançamento do EC2 — Escolha o modelo de lançamento em que o nome está
login-getstarted-lt -
Perfil de instância do IAM — Escolha o perfil da instância chamado
AWSPCS-getstarted-role -
Sub-redes — Selecione a sub-rede com a qual o nome começa.
hpc-networking:PublicSubnetAOs nós de login são executados em uma sub-rede pública para que você possa acessá-los para fazer login e enviar trabalhos. -
Instâncias — Selecione
c6i.xlarge. -
Configuração de escalabilidade — Para Contagem mínima de instâncias, insira.
1Para Contagem máxima de instâncias, insira1. A correção de ambas as contagens1mantém um único nó de login funcionando o tempo todo como um ponto de entrada estável para o cluster.
-
-
Em Configurações adicionais, especifique o seguinte:
-
ID da AMI — selecione uma AMI que você deseja usar, que tenha um nome no seguinte formato:
aws-pcs-sample_ami-al2023-platform-slurm-versionnota
As AMIs de amostra para o Slurm 25.05 e versões anteriores usam o Amazon Linux (2
amzn2) em vez do Amazon Linux 2023 ().al2023Para obter mais informações sobre os exemplos de AMIs, consulteUsando amostras de Amazon Machine Images (AMIs) com AWS PCS.
-
-
Na seção Ações do ciclo de vida do nó, adicione scripts que montam armazenamento compartilhado e encaminham registros do nó. Escolha Adicionar script para cada uma das ações a seguir. Os scripts são executados de cima para baixo em um estágio, então adicione-os na ordem mostrada. Para obter mais informações sobre os scripts que a AWS mantém, consulteAWS-scripts mantidos.
-
configure-cloudwatch-logs — Encaminha os logs de ação do ciclo de vida de cada nó para o Amazon Logs. CloudWatch Configure-o primeiro para que as ações a seguir tenham sua saída capturada da primeira inicialização do nó.
-
Estágio do ciclo de vida — Selecione.
nodeBootstrapped -
Local do script — insira
s3://aws-pcs-repo-,region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.shregionsubstituindo pela AWS Região do seu cluster. -
Nome — Inserir
configure-cloudwatch-logs. -
Argumentos — Deixe esse campo vazio. O script envia registros automaticamente para o grupo de
/aws/pcs/registros.cluster-id/lifecycle -
Comportamento de tratamento de erros — Selecione
CONTINUE. -
Política de execução — Selecione
FIRST_BOOT_ONLY.
-
-
configure-efs-homes — Monta o sistema de arquivos Amazon EFS como base do diretório inicial
/homee configura o nó para criar o diretório inicial de cada usuário no primeiro login.-
Estágio do ciclo de vida — Selecione.
nodeBootstrapped -
Local do script — insira
s3://aws-pcs-repo-,region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.shregionsubstituindo pela AWS Região do seu cluster. -
Nome — Inserir
configure-efs-homes. -
Argumentos — Insira
--efs-id,efs-file-system-id--home-base /home --options tlsefs-file-system-idsubstituindo pelo ID do sistema de arquivos EFS que você criou anteriormente no tutorial. -
Comportamento de tratamento de erros — Selecione
CONTINUE. -
Política de execução — Selecione
EVERY_BOOT.
-
-
mount-fsx-lustre — monta o sistema de arquivos FSx for Lustre para um armazenamento de rascunho compartilhado de alto desempenho.
/shared-
Estágio do ciclo de vida — Selecione.
nodeBootstrapped -
Local do script — insira
s3://aws-pcs-repo-,region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.shregionsubstituindo pela AWS Região do seu cluster (por exemplo,us-east-1). -
Nome — Inserir
mount-fsx-lustre. -
Argumentos — Insira
--fsx-dns-name,fsx-dns-name--mount-namemount-name--mount-point /sharedfsx-dns-namesubstituindo pelo nome DNS emount-namepelo nome do Mount que você anotou ao criar o sistema de arquivos FSx for Lustre. -
Comportamento de tratamento de erros — Selecione
CONTINUE. -
Política de execução — Selecione
EVERY_BOOT.
-
-
set-shared-dir-mode — Define permissões
/sharedfixas e graváveis mundialmente para que qualquer usuário possa criar arquivos1777nele. Ele é executado depoismount-fsx-lustrepara que se aplique ao sistema de arquivos montado.-
Estágio do ciclo de vida — Selecione.
nodeBootstrapped -
Localização do script — Enter
https://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Esse script comunitário foi publicado pela HPC Recipes for AWS. -
Nome — Inserir
set-shared-dir-mode. -
Argumentos — Digite
--path /shared --mode 1777. -
Comportamento de tratamento de erros — Selecione
CONTINUE. -
Política de execução — Selecione
EVERY_BOOT.
-
-
-
Escolha Criar grupo de nós de computação.
O campo Status mostra Criando enquanto o grupo de nós de computação está sendo provisionado. Você pode prosseguir para a próxima etapa do tutorial enquanto ela estiver em andamento.