View a markdown version of this page

Erstellen Sie eine Rechenknotengruppe für Anmeldeknoten in AWS STCK - AWS STCK

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Erstellen Sie eine Rechenknotengruppe für Anmeldeknoten in AWS STCK

Eine Rechenknotengruppe ist eine virtuelle Sammlung von Rechenknoten (EC2-Instances), die AWS PCS startet und verwaltet. Wenn Sie eine Rechenknotengruppe definieren, geben Sie allgemeine Merkmale wie EC2-Instance-Typen, minimale und maximale Instance-Anzahl, Ziel-VPC-Subnetze, bevorzugte Kaufoption und benutzerdefinierte Startkonfiguration an. AWS PCS startet, verwaltet und beendet Rechenknoten in einer Rechenknotengruppe gemäß diesen Einstellungen effizient.

In diesem Schritt starten Sie eine statische Rechenknotengruppe, die interaktiven Zugriff auf den Cluster bietet. Sie können SSH oder Amazon EC2 Systems Manager (SSM) verwenden, um sich dort anzumelden, dann Shell-Befehle ausführen und Slurm-Jobs verwalten.

Um die Compute-Knotengruppe zu erstellen
  • Öffnen Sie die AWS PCS-Konsole und navigieren Sie zu Clusters.

  • Wählen Sie den Cluster mit dem Namen get-started

  • Navigieren Sie zu Compute Node Groups und wählen Sie Create aus.

  • Geben Sie im Abschnitt zur Einrichtung der Compute-Knotengruppe Folgendes an:

    • Name der Compute-Knotengruppe — Geben Sie einlogin.

  • Geben Sie unter Computerkonfiguration die folgenden Werte ein oder wählen Sie sie aus:

    • EC2-Startvorlage — Wählen Sie die Startvorlage aus, die den Namen enthält login-getstarted-lt

    • IAM-Instanzprofil — Wählen Sie das Instance-Profil mit dem Namen AWSPCS-getstarted-role

    • Subnetze — Wählen Sie das Subnetz aus, mit dem der Name beginnt. hpc-networking:PublicSubnetA Anmeldeknoten werden in einem öffentlichen Subnetz ausgeführt, sodass Sie sie erreichen können, um sich anzumelden und Ihre Arbeit einzureichen.

    • Instanzen — Wählen Siec6i.xlarge.

    • Skalierungskonfiguration — Geben Sie 1 für Min. Instanzanzahl den Wert ein. Geben 1 Sie für Max. Instanzanzahl den Wert ein. Wenn Sie beide Zähler auf setzen, läuft 1 immer ein einziger Anmeldeknoten als stabiler Einstiegspunkt in den Cluster.

  • Geben Sie unter Zusätzliche Einstellungen Folgendes an:

    • AMI-ID — Wählen Sie ein AMI aus, das Sie verwenden möchten und das einen Namen im folgenden Format hat:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      Anmerkung

      Beispiel-AMIs für Slurm 25.05 und frühere Versionen verwenden Amazon Linux (2amzn2) anstelle von Amazon Linux 2023 (). al2023

      Weitere Informationen zu den Beispiel-AMIs finden Sie unter. Verwenden von Amazon Machine Images (AMIs) -Beispieldateien mit AWS STK.

  • Fügen Sie im Abschnitt „Aktionen für den Knotenlebenszyklus“ Skripts hinzu, die gemeinsam genutzten Speicher bereitstellen und Knotenprotokolle weiterleiten. Wählen Sie für jede der folgenden Aktionen die Option Skript hinzufügen aus. Skripte werden innerhalb einer Phase von oben nach unten ausgeführt. Fügen Sie sie daher in der angegebenen Reihenfolge hinzu. Weitere Informationen zu den von AWS verwalteten Skripten finden Sie unterAWS-gepflegte Skripte.

    1. configure-cloudwatch-logs — Leitet die Lebenszyklus-Aktionsprotokolle jedes Knotens an Amazon Logs weiter. CloudWatch Konfigurieren Sie es zuerst so, dass die Ausgabe der nachfolgenden Aktionen vom ersten Start des Knotens an erfasst wird.

      • Lifecycle-Phase — Wählen SienodeBootstrapped.

      • Speicherort des Skripts — Geben Sie s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh ihn ein und region ersetzen Sie ihn durch die AWS Region Ihres Clusters.

      • Name — Geben Sie einconfigure-cloudwatch-logs.

      • Argumente — Lassen Sie dieses Feld leer. Das Skript sendet automatisch Protokolle an die /aws/pcs/cluster-id/lifecycle Protokollgruppe.

      • Verhalten bei der Fehlerbehandlung — Wählen SieCONTINUE.

      • Ausführungsrichtlinie — Wählen SieFIRST_BOOT_ONLY.

    2. configure-efs-homes — Mounten Sie das Amazon EFS-Dateisystem als Basisverzeichnis /home und konfiguriert den Knoten so, dass bei der ersten Anmeldung das Basisverzeichnis jedes Benutzers erstellt wird.

      • Lifecycle-Phase — Wählen Sie. nodeBootstrapped

      • Speicherort des Skripts — Geben Sie s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh ihn ein und region ersetzen Sie ihn durch die AWS Region Ihres Clusters.

      • Name — Geben Sie einconfigure-efs-homes.

      • Argumente — Geben Sie ein --efs-id efs-file-system-id --home-base /home --options tls und efs-file-system-id ersetzen Sie es durch die ID des EFS-Dateisystems, das Sie zuvor im Tutorial erstellt haben.

      • Verhalten bei der Fehlerbehandlung — Wählen SieCONTINUE.

      • Ausführungsrichtlinie — Wählen SieEVERY_BOOT.

    3. mount-fsx-lustre — Mounten Sie das FSx for Lustre-Dateisystem unter für leistungsstarken gemeinsamen Scratch-Speicher. /shared

      • nodeBootstrappedLifecycle-Phase — Wählen Sie aus.

      • Speicherort des Skripts — Geben Sie s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh ihn ein und region ersetzen Sie ihn durch die AWS Region Ihres Clusters (z. B.us-east-1).

      • Name — Geben Sie einmount-fsx-lustre.

      • Argumente — Geben Sie ein --fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared und fsx-dns-name ersetzen Sie es durch den DNS-Namen und mount-name durch den Mount-Namen, den Sie bei der Erstellung des FSx for Lustre-Dateisystems notiert haben.

      • Verhalten bei der Fehlerbehandlung — Wählen Sie. CONTINUE

      • Ausführungsrichtlinie — Wählen SieEVERY_BOOT.

    4. set-shared-dir-mode — Setzt den Modus /shared auf weltweit beschreibbare, feste Zugriffsrechte (Modus1777), sodass jeder Benutzer darin Dateien erstellen kann. Es wird danach ausgeführt, mount-fsx-lustre sodass es für das gemountete Dateisystem gilt.

      • Lifecycle-Phase — Wählen SienodeBootstrapped.

      • Speicherort des Skripts — Geben Sie einhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Dieses Community-Skript wird von HPC Recipes for AWS veröffentlicht.

      • Name — Geben Sie einset-shared-dir-mode.

      • Argumente — Geben Sie ein--path /shared --mode 1777.

      • Verhalten bei der Fehlerbehandlung — Wählen SieCONTINUE.

      • Ausführungsrichtlinie — Wählen SieEVERY_BOOT.

  • Wählen Sie Compute-Knotengruppe erstellen aus.

Im Feld Status wird der Wert Creating angezeigt, während die Compute-Knotengruppe bereitgestellt wird. Sie können mit dem nächsten Schritt des Tutorials fortfahren, während es in Bearbeitung ist.