View a markdown version of this page

Cree un grupo de nodos de procesamiento para ejecutar trabajos de procesamiento en AWS ORDENADORES - AWS PIEZAS

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Cree un grupo de nodos de procesamiento para ejecutar trabajos de procesamiento en AWS ORDENADORES

En este paso, lanzarás un grupo de nodos de procesamiento que se escalará de forma elástica para ejecutar los trabajos enviados al clúster.

Para crear el grupo de nodos de procesamiento
  • Abra la consola AWS PCS y navegue hasta Clusters.

  • Seleccione el clúster denominado get-started

  • Dirígete a Compute node groups y elige Create.

  • En la sección Configuración de grupos de nodos de computación, proporciona lo siguiente:

    • Nombre del grupo de nodos de computación: Introducecompute-1.

  • En Configuración informática, introduzca o seleccione estos valores:

    • Plantilla de lanzamiento de EC2: elija la plantilla de lanzamiento en la que aparece el nombre compute-getstarted-lt

    • Perfil de instancia de IAM: elija el perfil de instancia denominado AWSPCS-getstarted-role

    • Subredes: seleccione la subred en la que empieza el nombre. hpc-networking:PrivateSubnetA Los nodos de procesamiento se ejecutan en una subred privada porque procesan trabajos y no es necesario que se pueda acceder a ellos desde Internet.

    • Instancias: seleccione. c6i.xlarge

    • Configuración de escalado: para ver el recuento mínimo de instancias, introduzca0. Para ver el número máximo de instancias, introduzca. 4 Un mínimo de 0 permite a AWS PCS escalar el grupo hasta que no haya ninguna instancia cuando no haya trabajos que ejecutar, por lo que solo se paga por el procesamiento cuando hay trabajo en cola.

  • En Configuración adicional, especifique lo siguiente:

    • ID de AMI: seleccione la AMI que desee usar y que tenga un nombre en el siguiente formato:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      nota

      Las AMI de ejemplo para Slurm 25.05 y versiones anteriores utilizan Amazon Linux 2 (amzn2) en lugar de Amazon Linux 2023 (). al2023

      Para obtener más información sobre las AMI de muestra, consulte. Uso de Amazon Machine Images (AMI) de muestra con AWS UNIDADES

  • En la sección Acciones del ciclo de vida de los nodos, agregue scripts que monten el almacenamiento compartido y reenvíen los registros de los nodos. Elige Agregar script para cada una de las siguientes acciones. Los guiones se ejecutan de arriba a abajo dentro de una etapa, así que agréguelos en el orden que se muestra. Para obtener más información sobre los scripts que mantiene AWS, consulteAWS-guiones mantenidos.

    1. configure-cloudwatch-logs: reenvía los registros de acciones del ciclo de vida de cada nodo a Amazon Logs. CloudWatch Configúralo primero para que los resultados de las acciones siguientes se capturen desde el primer arranque del nodo.

      • Etapa del ciclo de vida: seleccionenodeBootstrapped.

      • Ubicación del script: introduzca s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh y region reemplácela por la AWS región de su clúster.

      • Nombre: introduzcaconfigure-cloudwatch-logs.

      • Argumentos: deje este campo vacío. El script envía automáticamente los registros al grupo de /aws/pcs/cluster-id/lifecycle registros.

      • Comportamiento de gestión de errores: seleccioneCONTINUE.

      • Política de ejecución: seleccioneFIRST_BOOT_ONLY.

    2. configure-efs-homes: monta el sistema de archivos Amazon EFS como base del directorio principal /home y configura el nodo para crear el directorio principal de cada usuario en el primer inicio de sesión.

      • Etapa nodeBootstrapped del ciclo de vida: seleccione.

      • Ubicación del script: introduzca s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh y region reemplácela por la AWS región de su clúster.

      • Nombre: introduzcaconfigure-efs-homes.

      • Argumentos: --efs-id efs-file-system-id --home-base /home --options tls introdúzcalo y efs-file-system-id sustitúyalo por el identificador del sistema de archivos EFS que creó anteriormente en el tutorial.

      • Comportamiento de gestión de errores: seleccioneCONTINUE.

      • Política de ejecución: seleccioneEVERY_BOOT.

    3. mount-fsx-lustre: monta el sistema de archivos fsX for Lustre para un almacenamiento desde cero compartido de alto rendimiento. /shared

      • Etapa del ciclo nodeBootstrapped de vida: seleccione.

      • Ubicación del script: introduzca s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh y region reemplácela por la AWS región de su clúster (por ejemplo,us-east-1).

      • Nombre: introduzcamount-fsx-lustre.

      • Argumentos: introduzca --fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared y fsx-dns-name sustitúyalo por el nombre DNS y mount-name por el nombre de montaje que anotó al crear el sistema de archivos FSx for Lustre.

      • Comportamiento de gestión de errores: seleccione. CONTINUE

      • Política de ejecución: seleccioneEVERY_BOOT.

    4. set-shared-dir-mode: establece permisos fijos (modo1777) que se pueden escribir en todo el mundo /shared para que cualquier usuario pueda crear archivos en él. Se ejecuta después para que se aplique al sistema de mount-fsx-lustre archivos montado.

      • Etapa del ciclo de vida: seleccionenodeBootstrapped.

      • Ubicación del script: Entrarhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Este script comunitario ha sido publicado por HPC Recipes for AWS.

      • Nombre: introduzcaset-shared-dir-mode.

      • Argumentos: introduzca--path /shared --mode 1777.

      • Comportamiento de gestión de errores: seleccioneCONTINUE.

      • Política de ejecución: seleccioneEVERY_BOOT.

  • Elija Crear grupo de nodos de procesamiento.

El campo Estado muestra la creación mientras se aprovisiona el grupo de nodos de procesamiento.

importante

Espera a que el campo Estado aparezca Activo antes de continuar con el siguiente paso de este tutorial.