Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Erstellen Sie eine Rechenknotengruppe für Anmeldeknoten in AWS STCK
Eine Rechenknotengruppe ist eine virtuelle Sammlung von Rechenknoten (EC2-Instances), die AWS PCS startet und verwaltet. Wenn Sie eine Rechenknotengruppe definieren, geben Sie allgemeine Merkmale wie EC2-Instance-Typen, minimale und maximale Instance-Anzahl, Ziel-VPC-Subnetze, bevorzugte Kaufoption und benutzerdefinierte Startkonfiguration an. AWS PCS startet, verwaltet und beendet Rechenknoten in einer Rechenknotengruppe gemäß diesen Einstellungen effizient.
In diesem Schritt starten Sie eine statische Rechenknotengruppe, die interaktiven Zugriff auf den Cluster bietet. Sie können SSH oder Amazon EC2 Systems Manager (SSM) verwenden, um sich dort anzumelden, dann Shell-Befehle ausführen und Slurm-Jobs verwalten.
Um die Compute-Knotengruppe zu erstellen
-
Öffnen Sie die AWS PCS-Konsole
und navigieren Sie zu Clusters. -
Wählen Sie den Cluster mit dem Namen
get-started -
Navigieren Sie zu Compute Node Groups und wählen Sie Create aus.
-
Geben Sie im Abschnitt zur Einrichtung der Compute-Knotengruppe Folgendes an:
-
Name der Compute-Knotengruppe — Geben Sie ein
login.
-
-
Geben Sie unter Computerkonfiguration die folgenden Werte ein oder wählen Sie sie aus:
-
EC2-Startvorlage — Wählen Sie die Startvorlage aus, die den Namen enthält
login-getstarted-lt -
IAM-Instanzprofil — Wählen Sie das Instance-Profil mit dem Namen
AWSPCS-getstarted-role -
Subnetze — Wählen Sie das Subnetz aus, mit dem der Name beginnt.
hpc-networking:PublicSubnetAAnmeldeknoten werden in einem öffentlichen Subnetz ausgeführt, sodass Sie sie erreichen können, um sich anzumelden und Ihre Arbeit einzureichen. -
Instanzen — Wählen Sie
c6i.xlarge. -
Skalierungskonfiguration — Geben Sie
1für Min. Instanzanzahl den Wert ein. Geben1Sie für Max. Instanzanzahl den Wert ein. Wenn Sie beide Zähler auf setzen, läuft1immer ein einziger Anmeldeknoten als stabiler Einstiegspunkt in den Cluster.
-
-
Geben Sie unter Zusätzliche Einstellungen Folgendes an:
-
AMI-ID — Wählen Sie ein AMI aus, das Sie verwenden möchten und das einen Namen im folgenden Format hat:
aws-pcs-sample_ami-al2023-platform-slurm-versionAnmerkung
Beispiel-AMIs für Slurm 25.05 und frühere Versionen verwenden Amazon Linux (2
amzn2) anstelle von Amazon Linux 2023 ().al2023Weitere Informationen zu den Beispiel-AMIs finden Sie unter. Verwenden von Amazon Machine Images (AMIs) -Beispieldateien mit AWS STK.
-
-
Fügen Sie im Abschnitt „Aktionen für den Knotenlebenszyklus“ Skripts hinzu, die gemeinsam genutzten Speicher bereitstellen und Knotenprotokolle weiterleiten. Wählen Sie für jede der folgenden Aktionen die Option Skript hinzufügen aus. Skripte werden innerhalb einer Phase von oben nach unten ausgeführt. Fügen Sie sie daher in der angegebenen Reihenfolge hinzu. Weitere Informationen zu den von AWS verwalteten Skripten finden Sie unterAWS-gepflegte Skripte.
-
configure-cloudwatch-logs — Leitet die Lebenszyklus-Aktionsprotokolle jedes Knotens an Amazon Logs weiter. CloudWatch Konfigurieren Sie es zuerst so, dass die Ausgabe der nachfolgenden Aktionen vom ersten Start des Knotens an erfasst wird.
-
Lifecycle-Phase — Wählen Sie
nodeBootstrapped. -
Speicherort des Skripts — Geben Sie
s3://aws-pcs-repo-ihn ein undregion/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.shregionersetzen Sie ihn durch die AWS Region Ihres Clusters. -
Name — Geben Sie ein
configure-cloudwatch-logs. -
Argumente — Lassen Sie dieses Feld leer. Das Skript sendet automatisch Protokolle an die
/aws/pcs/Protokollgruppe.cluster-id/lifecycle -
Verhalten bei der Fehlerbehandlung — Wählen Sie
CONTINUE. -
Ausführungsrichtlinie — Wählen Sie
FIRST_BOOT_ONLY.
-
-
configure-efs-homes — Mounten Sie das Amazon EFS-Dateisystem als Basisverzeichnis
/homeund konfiguriert den Knoten so, dass bei der ersten Anmeldung das Basisverzeichnis jedes Benutzers erstellt wird.-
Lifecycle-Phase — Wählen Sie.
nodeBootstrapped -
Speicherort des Skripts — Geben Sie
s3://aws-pcs-repo-ihn ein undregion/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.shregionersetzen Sie ihn durch die AWS Region Ihres Clusters. -
Name — Geben Sie ein
configure-efs-homes. -
Argumente — Geben Sie ein
--efs-idundefs-file-system-id--home-base /home --options tlsefs-file-system-idersetzen Sie es durch die ID des EFS-Dateisystems, das Sie zuvor im Tutorial erstellt haben. -
Verhalten bei der Fehlerbehandlung — Wählen Sie
CONTINUE. -
Ausführungsrichtlinie — Wählen Sie
EVERY_BOOT.
-
-
mount-fsx-lustre — Mounten Sie das FSx for Lustre-Dateisystem unter für leistungsstarken gemeinsamen Scratch-Speicher.
/shared-
nodeBootstrappedLifecycle-Phase — Wählen Sie aus. -
Speicherort des Skripts — Geben Sie
s3://aws-pcs-repo-ihn ein undregion/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.shregionersetzen Sie ihn durch die AWS Region Ihres Clusters (z. B.us-east-1). -
Name — Geben Sie ein
mount-fsx-lustre. -
Argumente — Geben Sie ein
--fsx-dns-nameundfsx-dns-name--mount-namemount-name--mount-point /sharedfsx-dns-nameersetzen Sie es durch den DNS-Namen undmount-namedurch den Mount-Namen, den Sie bei der Erstellung des FSx for Lustre-Dateisystems notiert haben. -
Verhalten bei der Fehlerbehandlung — Wählen Sie.
CONTINUE -
Ausführungsrichtlinie — Wählen Sie
EVERY_BOOT.
-
-
set-shared-dir-mode — Setzt den Modus
/sharedauf weltweit beschreibbare, feste Zugriffsrechte (Modus1777), sodass jeder Benutzer darin Dateien erstellen kann. Es wird danach ausgeführt,mount-fsx-lustresodass es für das gemountete Dateisystem gilt.-
Lifecycle-Phase — Wählen Sie
nodeBootstrapped. -
Speicherort des Skripts — Geben Sie ein
https://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Dieses Community-Skript wird von HPC Recipes for AWS veröffentlicht. -
Name — Geben Sie ein
set-shared-dir-mode. -
Argumente — Geben Sie ein
--path /shared --mode 1777. -
Verhalten bei der Fehlerbehandlung — Wählen Sie
CONTINUE. -
Ausführungsrichtlinie — Wählen Sie
EVERY_BOOT.
-
-
-
Wählen Sie Compute-Knotengruppe erstellen aus.
Im Feld Status wird der Wert Creating angezeigt, während die Compute-Knotengruppe bereitgestellt wird. Sie können mit dem nächsten Schritt des Tutorials fortfahren, während es in Bearbeitung ist.