Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Cree un grupo de nodos de procesamiento para ejecutar trabajos de procesamiento en AWS ORDENADORES
En este paso, lanzarás un grupo de nodos de procesamiento que se escalará de forma elástica para ejecutar los trabajos enviados al clúster.
Para crear el grupo de nodos de procesamiento
-
Abra la consola AWS PCS
y navegue hasta Clusters. -
Seleccione el clúster denominado
get-started -
Dirígete a Compute node groups y elige Create.
-
En la sección Configuración de grupos de nodos de computación, proporciona lo siguiente:
-
Nombre del grupo de nodos de computación: Introduce
compute-1.
-
-
En Configuración informática, introduzca o seleccione estos valores:
-
Plantilla de lanzamiento de EC2: elija la plantilla de lanzamiento en la que aparece el nombre
compute-getstarted-lt -
Perfil de instancia de IAM: elija el perfil de instancia denominado
AWSPCS-getstarted-role -
Subredes: seleccione la subred en la que empieza el nombre.
hpc-networking:PrivateSubnetALos nodos de procesamiento se ejecutan en una subred privada porque procesan trabajos y no es necesario que se pueda acceder a ellos desde Internet. -
Instancias: seleccione.
c6i.xlarge -
Configuración de escalado: para ver el recuento mínimo de instancias, introduzca
0. Para ver el número máximo de instancias, introduzca.4Un mínimo de0permite a AWS PCS escalar el grupo hasta que no haya ninguna instancia cuando no haya trabajos que ejecutar, por lo que solo se paga por el procesamiento cuando hay trabajo en cola.
-
-
En Configuración adicional, especifique lo siguiente:
-
ID de AMI: seleccione la AMI que desee usar y que tenga un nombre en el siguiente formato:
aws-pcs-sample_ami-al2023-platform-slurm-versionnota
Las AMI de ejemplo para Slurm 25.05 y versiones anteriores utilizan Amazon Linux 2 (
amzn2) en lugar de Amazon Linux 2023 ().al2023Para obtener más información sobre las AMI de muestra, consulte. Uso de Amazon Machine Images (AMI) de muestra con AWS UNIDADES
-
-
En la sección Acciones del ciclo de vida de los nodos, agregue scripts que monten el almacenamiento compartido y reenvíen los registros de los nodos. Elige Agregar script para cada una de las siguientes acciones. Los guiones se ejecutan de arriba a abajo dentro de una etapa, así que agréguelos en el orden que se muestra. Para obtener más información sobre los scripts que mantiene AWS, consulteAWS-guiones mantenidos.
-
configure-cloudwatch-logs: reenvía los registros de acciones del ciclo de vida de cada nodo a Amazon Logs. CloudWatch Configúralo primero para que los resultados de las acciones siguientes se capturen desde el primer arranque del nodo.
-
Etapa del ciclo de vida: seleccione
nodeBootstrapped. -
Ubicación del script: introduzca
s3://aws-pcs-repo-yregion/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.shregionreemplácela por la AWS región de su clúster. -
Nombre: introduzca
configure-cloudwatch-logs. -
Argumentos: deje este campo vacío. El script envía automáticamente los registros al grupo de
/aws/pcs/registros.cluster-id/lifecycle -
Comportamiento de gestión de errores: seleccione
CONTINUE. -
Política de ejecución: seleccione
FIRST_BOOT_ONLY.
-
-
configure-efs-homes: monta el sistema de archivos Amazon EFS como base del directorio principal
/homey configura el nodo para crear el directorio principal de cada usuario en el primer inicio de sesión.-
Etapa
nodeBootstrappeddel ciclo de vida: seleccione. -
Ubicación del script: introduzca
s3://aws-pcs-repo-yregion/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.shregionreemplácela por la AWS región de su clúster. -
Nombre: introduzca
configure-efs-homes. -
Argumentos:
--efs-idintrodúzcalo yefs-file-system-id--home-base /home --options tlsefs-file-system-idsustitúyalo por el identificador del sistema de archivos EFS que creó anteriormente en el tutorial. -
Comportamiento de gestión de errores: seleccione
CONTINUE. -
Política de ejecución: seleccione
EVERY_BOOT.
-
-
mount-fsx-lustre: monta el sistema de archivos fsX for Lustre para un almacenamiento desde cero compartido de alto rendimiento.
/shared-
Etapa del ciclo
nodeBootstrappedde vida: seleccione. -
Ubicación del script: introduzca
s3://aws-pcs-repo-yregion/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.shregionreemplácela por la AWS región de su clúster (por ejemplo,us-east-1). -
Nombre: introduzca
mount-fsx-lustre. -
Argumentos: introduzca
--fsx-dns-nameyfsx-dns-name--mount-namemount-name--mount-point /sharedfsx-dns-namesustitúyalo por el nombre DNS ymount-namepor el nombre de montaje que anotó al crear el sistema de archivos FSx for Lustre. -
Comportamiento de gestión de errores: seleccione.
CONTINUE -
Política de ejecución: seleccione
EVERY_BOOT.
-
-
set-shared-dir-mode: establece permisos fijos (modo
1777) que se pueden escribir en todo el mundo/sharedpara que cualquier usuario pueda crear archivos en él. Se ejecuta después para que se aplique al sistema demount-fsx-lustrearchivos montado.-
Etapa del ciclo de vida: seleccione
nodeBootstrapped. -
Ubicación del script: Entrar
https://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Este script comunitario ha sido publicado por HPC Recipes for AWS. -
Nombre: introduzca
set-shared-dir-mode. -
Argumentos: introduzca
--path /shared --mode 1777. -
Comportamiento de gestión de errores: seleccione
CONTINUE. -
Política de ejecución: seleccione
EVERY_BOOT.
-
-
-
Elija Crear grupo de nodos de procesamiento.
El campo Estado muestra la creación mientras se aprovisiona el grupo de nodos de procesamiento.
importante
Espera a que el campo Estado aparezca Activo antes de continuar con el siguiente paso de este tutorial.