View a markdown version of this page

Créez un groupe de nœuds de calcul pour les nœuds de connexion dans AWS PIÈCES - AWS PIÈCES

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Créez un groupe de nœuds de calcul pour les nœuds de connexion dans AWS PIÈCES

Un groupe de nœuds de calcul est un ensemble virtuel de nœuds de calcul (instances EC2) que AWS PCS lance et gère. Lorsque vous définissez un groupe de nœuds de calcul, vous spécifiez des caractéristiques communes telles que les types d'instances EC2, le nombre d'instances minimum et maximum, les sous-réseaux VPC cibles, l'option d'achat préférée et la configuration de lancement personnalisée. AWS PCS lance, gère et met fin de manière efficace aux nœuds de calcul d'un groupe de nœuds de calcul, conformément à ces paramètres.

Au cours de cette étape, vous allez lancer un groupe de nœuds de calcul statiques qui fournit un accès interactif au cluster. Vous pouvez utiliser SSH ou Amazon EC2 Systems Manager (SSM) pour vous y connecter, puis exécuter des commandes shell et gérer les tâches Slurm.

Pour créer le groupe de nœuds de calcul
  • Ouvrez la console AWS PCS et accédez à Clusters.

  • Sélectionnez le cluster nommé get-started

  • Accédez à Calculer les groupes de nœuds et choisissez Créer.

  • Dans la section Configuration du groupe de nœuds de calcul, fournissez les informations suivantes :

    • Nom du groupe de nœuds de calcul — Entrezlogin.

  • Dans Configuration informatique, entrez ou sélectionnez les valeurs suivantes :

    • Modèle de lancement EC2 — Choisissez le modèle de lancement dont le nom est login-getstarted-lt

    • Profil d'instance IAM  : choisissez le profil d'instance nommé AWSPCS-getstarted-role

    • Sous-réseaux  : sélectionnez le sous-réseau dont le nom commence par. hpc-networking:PublicSubnetA Les nœuds de connexion s'exécutent dans un sous-réseau public afin que vous puissiez les contacter pour vous connecter et soumettre des travaux.

    • Instances — Sélectionnezc6i.xlarge.

    • Configuration de mise à l'échelle  : pour le nombre minimal d'instances, entrez 1. Pour Nombre maximum d'instances, entrez1. Corriger les deux comptes 1 permet à un seul nœud de connexion de fonctionner à tout moment en tant que point d'entrée stable vers le cluster.

  • Dans Paramètres supplémentaires, spécifiez les éléments suivants :

    • ID AMI  : sélectionnez l'AMI que vous souhaitez utiliser, dont le nom est au format suivant :

      aws-pcs-sample_ami-al2023-platform-slurm-version
      Note

      Les exemples d'AMI pour Slurm 25.05 et les versions précédentes utilisent Amazon Linux 2 (amzn2) au lieu d'Amazon Linux 2023 (). al2023

      Pour plus d'informations sur les exemples d'AMI, consultezUtilisation d'exemples d'Amazon Machine Images (AMI) avec AWS PIÈCES.

  • Dans la section Actions relatives au cycle de vie des nœuds, ajoutez des scripts qui montent le stockage partagé et transmettent les journaux des nœuds. Choisissez Ajouter un script pour chacune des actions suivantes. Les scripts s'exécutent de haut en bas au cours d'une étape, alors ajoutez-les dans l'ordre indiqué. Pour plus d'informations sur les scripts gérés par AWS, consultezAWS-scripts gérés.

    1. configure-cloudwatch-logs  : transmet les journaux des actions du cycle de vie de chaque nœud à Amazon Logs. CloudWatch Configurez-le d'abord pour que les actions qui suivent soient capturées dès le premier démarrage du nœud.

      • Étape du cycle de vie — SélectionneznodeBootstrapped.

      • Emplacement du script  : entrezs3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh, en le region remplaçant par la AWS région de votre cluster.

      • Nom — Entrezconfigure-cloudwatch-logs.

      • Arguments — Laissez ce champ vide. Le script envoie automatiquement les journaux au groupe de /aws/pcs/cluster-id/lifecycle journaux.

      • Comportement de gestion des erreurs — SélectionnezCONTINUE.

      • Politique d'exécution — SélectionnezFIRST_BOOT_ONLY.

    2. configure-efs-homes — Monte le système de fichiers Amazon EFS en tant que répertoire de base /home et configure le nœud pour créer le répertoire personnel de chaque utilisateur lors de la première connexion.

      • Étape du cycle de vie — SélectionneznodeBootstrapped.

      • Emplacement du script  : entrezs3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh, en le region remplaçant par la AWS région de votre cluster.

      • Nom — Entrezconfigure-efs-homes.

      • Arguments — Entrez--efs-id efs-file-system-id --home-base /home --options tls, en le efs-file-system-id remplaçant par l'ID du système de fichiers EFS que vous avez créé plus tôt dans le didacticiel.

      • Comportement de gestion des erreurs — SélectionnezCONTINUE.

      • Politique d'exécution — SélectionnezEVERY_BOOT.

    3. mount-fsx-lustre — Permet de monter le système de fichiers FSx for Lustre pour un stockage scratch partagé hautes performances/shared.

      • Étape du cycle de vie — SélectionneznodeBootstrapped.

      • Emplacement du script  : entrezs3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh, en le region remplaçant par AWS la région de votre cluster (par exemple,us-east-1).

      • Nom — Entrezmount-fsx-lustre.

      • Arguments — Entrez--fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared, en le fsx-dns-name remplaçant par le nom DNS et mount-name par le nom de montage que vous avez noté lors de la création du système de fichiers FSx pour Lustre.

      • Comportement de gestion des erreurs — SélectionnezCONTINUE.

      • Politique d'exécution — SélectionnezEVERY_BOOT.

    4. set-shared-dir-mode — Définit sur des autorisations persistantes et /shared accessibles en écriture universelle (mode1777) afin que tout utilisateur puisse y créer des fichiers. Il s'exécute mount-fsx-lustre ensuite pour s'appliquer au système de fichiers monté.

      • Étape du cycle de vie — SélectionneznodeBootstrapped.

      • Emplacement du script — Entrezhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Ce script communautaire est publié par HPC Recipes pour AWS.

      • Nom — Entrezset-shared-dir-mode.

      • Arguments — Entrez--path /shared --mode 1777.

      • Comportement de gestion des erreurs — SélectionnezCONTINUE.

      • Politique d'exécution — SélectionnezEVERY_BOOT.

  • Choisissez Créer un groupe de nœuds de calcul.

Le champ État indique Création pendant le provisionnement du groupe de nœuds de calcul. Vous pouvez passer à l'étape suivante du didacticiel pendant qu'il est en cours.