View a markdown version of this page

Cree un grupo de nodos de procesamiento para los nodos de inicio de sesión en AWS PC - AWS PIEZAS

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Cree un grupo de nodos de procesamiento para los nodos de inicio de sesión en AWS PC

Un grupo de nodos de procesamiento es una colección virtual de nodos de procesamiento (instancias EC2) que AWS PCS lanza y administra. Al definir un grupo de nodos de procesamiento, especificas características comunes, como los tipos de instancias EC2, el número mínimo y máximo de instancias, las subredes de VPC de destino, la opción de compra preferida y la configuración de lanzamiento personalizada. AWS PCS lanza, administra y termina de manera eficiente los nodos de procesamiento de un grupo de nodos de procesamiento, de acuerdo con esta configuración.

En este paso, lanzará un grupo de nodos de procesamiento estático que proporcionará acceso interactivo al clúster. Puedes usar SSH o Amazon EC2 Systems Manager (SSM) para iniciar sesión en él, ejecutar los comandos de shell y gestionar los trabajos de Slurm.

Para crear el grupo de nodos de procesamiento
  • Abra la consola AWS PCS y navegue hasta Clusters.

  • Seleccione el clúster denominado get-started

  • Dirígete a Compute node groups y elige Create.

  • En la sección Configuración de grupos de nodos de computación, proporciona lo siguiente:

    • Nombre del grupo de nodos de computación: Introducelogin.

  • En Configuración informática, introduzca o seleccione estos valores:

    • Plantilla de lanzamiento de EC2: elija la plantilla de lanzamiento en la que aparece el nombre login-getstarted-lt

    • Perfil de instancia de IAM: elija el perfil de instancia denominado AWSPCS-getstarted-role

    • Subredes: seleccione la subred en la que empieza el nombre. hpc-networking:PublicSubnetA Los nodos de inicio de sesión se ejecutan en una subred pública para que pueda acceder a ellos para iniciar sesión y enviar trabajos.

    • Instancias: seleccionec6i.xlarge.

    • Configuración de escalado: para ver el recuento mínimo de instancias, introduzca1. Para ver el número máximo de instancias, introduzca. 1 Al fijar ambos recuentos, se 1 mantiene un único nodo de inicio de sesión en funcionamiento en todo momento como punto de entrada estable al clúster.

  • En Configuración adicional, especifique lo siguiente:

    • ID de AMI: seleccione la AMI que desee usar y que tenga un nombre en el siguiente formato:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      nota

      Las AMI de ejemplo para Slurm 25.05 y versiones anteriores utilizan Amazon Linux 2 (amzn2) en lugar de Amazon Linux 2023 (). al2023

      Para obtener más información sobre las AMI de muestra, consulte. Uso de Amazon Machine Images (AMI) de muestra con AWS UNIDADES

  • En la sección Acciones del ciclo de vida de los nodos, agregue scripts que monten el almacenamiento compartido y reenvíen los registros de los nodos. Elige Agregar script para cada una de las siguientes acciones. Los guiones se ejecutan de arriba a abajo dentro de una etapa, así que agréguelos en el orden que se muestra. Para obtener más información sobre los scripts que mantiene AWS, consulteAWS-guiones mantenidos.

    1. configure-cloudwatch-logs: reenvía los registros de acciones del ciclo de vida de cada nodo a Amazon Logs. CloudWatch Configúralo primero para que los resultados de las acciones siguientes se capturen desde el primer arranque del nodo.

      • Etapa del ciclo de vida: seleccionenodeBootstrapped.

      • Ubicación del script: introduzca s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh y region reemplácela por la AWS región de su clúster.

      • Nombre: introduzcaconfigure-cloudwatch-logs.

      • Argumentos: deje este campo vacío. El script envía automáticamente los registros al grupo de /aws/pcs/cluster-id/lifecycle registros.

      • Comportamiento de gestión de errores: seleccioneCONTINUE.

      • Política de ejecución: seleccioneFIRST_BOOT_ONLY.

    2. configure-efs-homes: monta el sistema de archivos Amazon EFS como base del directorio principal /home y configura el nodo para crear el directorio principal de cada usuario en el primer inicio de sesión.

      • Etapa nodeBootstrapped del ciclo de vida: seleccione.

      • Ubicación del script: introduzca s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh y region reemplácela por la AWS región de su clúster.

      • Nombre: introduzcaconfigure-efs-homes.

      • Argumentos: --efs-id efs-file-system-id --home-base /home --options tls introdúzcalo y efs-file-system-id sustitúyalo por el identificador del sistema de archivos EFS que creó anteriormente en el tutorial.

      • Comportamiento de gestión de errores: seleccioneCONTINUE.

      • Política de ejecución: seleccioneEVERY_BOOT.

    3. mount-fsx-lustre: monta el sistema de archivos fsX for Lustre para un almacenamiento desde cero compartido de alto rendimiento. /shared

      • Etapa del ciclo nodeBootstrapped de vida: seleccione.

      • Ubicación del script: introduzca s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh y region reemplácela por la AWS región de su clúster (por ejemplo,us-east-1).

      • Nombre: introduzcamount-fsx-lustre.

      • Argumentos: introduzca --fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared y fsx-dns-name sustitúyalo por el nombre DNS y mount-name por el nombre de montaje que anotó al crear el sistema de archivos FSx for Lustre.

      • Comportamiento de gestión de errores: seleccione. CONTINUE

      • Política de ejecución: seleccioneEVERY_BOOT.

    4. set-shared-dir-mode: establece permisos fijos (modo1777) que se pueden escribir en todo el mundo /shared para que cualquier usuario pueda crear archivos en él. Se ejecuta después para que se aplique al sistema de mount-fsx-lustre archivos montado.

      • Etapa del ciclo de vida: seleccionenodeBootstrapped.

      • Ubicación del script: Entrarhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Este script comunitario ha sido publicado por HPC Recipes for AWS.

      • Nombre: introduzcaset-shared-dir-mode.

      • Argumentos: introduzca--path /shared --mode 1777.

      • Comportamiento de gestión de errores: seleccioneCONTINUE.

      • Política de ejecución: seleccioneEVERY_BOOT.

  • Elija Crear grupo de nodos de procesamiento.

El campo Estado muestra la creación mientras se aprovisiona el grupo de nodos de procesamiento. Puedes continuar con el siguiente paso del tutorial mientras está en curso.