Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Cree un grupo de nodos de procesamiento para los nodos de inicio de sesión en AWS PC
Un grupo de nodos de procesamiento es una colección virtual de nodos de procesamiento (instancias EC2) que AWS PCS lanza y administra. Al definir un grupo de nodos de procesamiento, especificas características comunes, como los tipos de instancias EC2, el número mínimo y máximo de instancias, las subredes de VPC de destino, la opción de compra preferida y la configuración de lanzamiento personalizada. AWS PCS lanza, administra y termina de manera eficiente los nodos de procesamiento de un grupo de nodos de procesamiento, de acuerdo con esta configuración.
En este paso, lanzará un grupo de nodos de procesamiento estático que proporcionará acceso interactivo al clúster. Puedes usar SSH o Amazon EC2 Systems Manager (SSM) para iniciar sesión en él, ejecutar los comandos de shell y gestionar los trabajos de Slurm.
Para crear el grupo de nodos de procesamiento
-
Abra la consola AWS PCS
y navegue hasta Clusters. -
Seleccione el clúster denominado
get-started -
Dirígete a Compute node groups y elige Create.
-
En la sección Configuración de grupos de nodos de computación, proporciona lo siguiente:
-
Nombre del grupo de nodos de computación: Introduce
login.
-
-
En Configuración informática, introduzca o seleccione estos valores:
-
Plantilla de lanzamiento de EC2: elija la plantilla de lanzamiento en la que aparece el nombre
login-getstarted-lt -
Perfil de instancia de IAM: elija el perfil de instancia denominado
AWSPCS-getstarted-role -
Subredes: seleccione la subred en la que empieza el nombre.
hpc-networking:PublicSubnetALos nodos de inicio de sesión se ejecutan en una subred pública para que pueda acceder a ellos para iniciar sesión y enviar trabajos. -
Instancias: seleccione
c6i.xlarge. -
Configuración de escalado: para ver el recuento mínimo de instancias, introduzca
1. Para ver el número máximo de instancias, introduzca.1Al fijar ambos recuentos, se1mantiene un único nodo de inicio de sesión en funcionamiento en todo momento como punto de entrada estable al clúster.
-
-
En Configuración adicional, especifique lo siguiente:
-
ID de AMI: seleccione la AMI que desee usar y que tenga un nombre en el siguiente formato:
aws-pcs-sample_ami-al2023-platform-slurm-versionnota
Las AMI de ejemplo para Slurm 25.05 y versiones anteriores utilizan Amazon Linux 2 (
amzn2) en lugar de Amazon Linux 2023 ().al2023Para obtener más información sobre las AMI de muestra, consulte. Uso de Amazon Machine Images (AMI) de muestra con AWS UNIDADES
-
-
En la sección Acciones del ciclo de vida de los nodos, agregue scripts que monten el almacenamiento compartido y reenvíen los registros de los nodos. Elige Agregar script para cada una de las siguientes acciones. Los guiones se ejecutan de arriba a abajo dentro de una etapa, así que agréguelos en el orden que se muestra. Para obtener más información sobre los scripts que mantiene AWS, consulteAWS-guiones mantenidos.
-
configure-cloudwatch-logs: reenvía los registros de acciones del ciclo de vida de cada nodo a Amazon Logs. CloudWatch Configúralo primero para que los resultados de las acciones siguientes se capturen desde el primer arranque del nodo.
-
Etapa del ciclo de vida: seleccione
nodeBootstrapped. -
Ubicación del script: introduzca
s3://aws-pcs-repo-yregion/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.shregionreemplácela por la AWS región de su clúster. -
Nombre: introduzca
configure-cloudwatch-logs. -
Argumentos: deje este campo vacío. El script envía automáticamente los registros al grupo de
/aws/pcs/registros.cluster-id/lifecycle -
Comportamiento de gestión de errores: seleccione
CONTINUE. -
Política de ejecución: seleccione
FIRST_BOOT_ONLY.
-
-
configure-efs-homes: monta el sistema de archivos Amazon EFS como base del directorio principal
/homey configura el nodo para crear el directorio principal de cada usuario en el primer inicio de sesión.-
Etapa
nodeBootstrappeddel ciclo de vida: seleccione. -
Ubicación del script: introduzca
s3://aws-pcs-repo-yregion/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.shregionreemplácela por la AWS región de su clúster. -
Nombre: introduzca
configure-efs-homes. -
Argumentos:
--efs-idintrodúzcalo yefs-file-system-id--home-base /home --options tlsefs-file-system-idsustitúyalo por el identificador del sistema de archivos EFS que creó anteriormente en el tutorial. -
Comportamiento de gestión de errores: seleccione
CONTINUE. -
Política de ejecución: seleccione
EVERY_BOOT.
-
-
mount-fsx-lustre: monta el sistema de archivos fsX for Lustre para un almacenamiento desde cero compartido de alto rendimiento.
/shared-
Etapa del ciclo
nodeBootstrappedde vida: seleccione. -
Ubicación del script: introduzca
s3://aws-pcs-repo-yregion/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.shregionreemplácela por la AWS región de su clúster (por ejemplo,us-east-1). -
Nombre: introduzca
mount-fsx-lustre. -
Argumentos: introduzca
--fsx-dns-nameyfsx-dns-name--mount-namemount-name--mount-point /sharedfsx-dns-namesustitúyalo por el nombre DNS ymount-namepor el nombre de montaje que anotó al crear el sistema de archivos FSx for Lustre. -
Comportamiento de gestión de errores: seleccione.
CONTINUE -
Política de ejecución: seleccione
EVERY_BOOT.
-
-
set-shared-dir-mode: establece permisos fijos (modo
1777) que se pueden escribir en todo el mundo/sharedpara que cualquier usuario pueda crear archivos en él. Se ejecuta después para que se aplique al sistema demount-fsx-lustrearchivos montado.-
Etapa del ciclo de vida: seleccione
nodeBootstrapped. -
Ubicación del script: Entrar
https://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Este script comunitario ha sido publicado por HPC Recipes for AWS. -
Nombre: introduzca
set-shared-dir-mode. -
Argumentos: introduzca
--path /shared --mode 1777. -
Comportamiento de gestión de errores: seleccione
CONTINUE. -
Política de ejecución: seleccione
EVERY_BOOT.
-
-
-
Elija Crear grupo de nodos de procesamiento.
El campo Estado muestra la creación mientras se aprovisiona el grupo de nodos de procesamiento. Puedes continuar con el siguiente paso del tutorial mientras está en curso.