View a markdown version of this page

Erstellen Sie eine Rechenknotengruppe für die Ausführung von Rechenaufträgen in AWS STCK - AWS STCK

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Erstellen Sie eine Rechenknotengruppe für die Ausführung von Rechenaufträgen in AWS STCK

In diesem Schritt starten Sie eine Rechenknotengruppe, die elastisch skaliert wird, um Jobs auszuführen, die an den Cluster gesendet werden.

Um die Compute-Knotengruppe zu erstellen
  • Öffnen Sie die AWS PCS-Konsole und navigieren Sie zu Clusters.

  • Wählen Sie den Cluster mit dem Namen get-started

  • Navigieren Sie zu Compute Node Groups und wählen Sie Create aus.

  • Geben Sie im Abschnitt zur Einrichtung der Compute-Knotengruppe Folgendes an:

    • Name der Compute-Knotengruppe — Geben Sie eincompute-1.

  • Geben Sie unter Computerkonfiguration die folgenden Werte ein oder wählen Sie sie aus:

    • EC2-Startvorlage — Wählen Sie die Startvorlage aus, die den Namen enthält compute-getstarted-lt

    • IAM-Instanzprofil — Wählen Sie das Instance-Profil mit dem Namen AWSPCS-getstarted-role

    • Subnetze — Wählen Sie das Subnetz aus, mit dem der Name beginnt. hpc-networking:PrivateSubnetA Rechenknoten werden in einem privaten Subnetz ausgeführt, da sie Jobs verarbeiten und nicht über das Internet erreichbar sein müssen.

    • Instanzen — Wählen Sie ausc6i.xlarge.

    • Skalierungskonfiguration — Geben Sie 0 für Min. Instanzanzahl den Wert ein. Geben 4 Sie für Max. Instanzanzahl den Wert ein. Bei einer Mindestanzahl 0 von Werten kann AWS PCS die Gruppe so herunterskalieren, dass keine Instanzen mehr ausgeführt werden, sodass Sie nur dann für die Berechnung zahlen, wenn sich die Arbeit in der Warteschlange befindet.

  • Geben Sie unter Zusätzliche Einstellungen Folgendes an:

    • AMI-ID — Wählen Sie ein AMI aus, das Sie verwenden möchten und das einen Namen im folgenden Format hat:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      Anmerkung

      Beispiel-AMIs für Slurm 25.05 und frühere Versionen verwenden Amazon Linux (2amzn2) anstelle von Amazon Linux 2023 (). al2023

      Weitere Informationen zu den Beispiel-AMIs finden Sie unter. Verwenden von Amazon Machine Images (AMIs) -Beispieldateien mit AWS STK.

  • Fügen Sie im Abschnitt „Aktionen für den Knotenlebenszyklus“ Skripts hinzu, die gemeinsam genutzten Speicher bereitstellen und Knotenprotokolle weiterleiten. Wählen Sie für jede der folgenden Aktionen die Option Skript hinzufügen aus. Skripte werden innerhalb einer Phase von oben nach unten ausgeführt. Fügen Sie sie daher in der angegebenen Reihenfolge hinzu. Weitere Informationen zu den von AWS verwalteten Skripten finden Sie unterAWS-gepflegte Skripte.

    1. configure-cloudwatch-logs — Leitet die Lebenszyklus-Aktionsprotokolle jedes Knotens an Amazon Logs weiter. CloudWatch Konfigurieren Sie es zuerst so, dass die Ausgabe der nachfolgenden Aktionen vom ersten Start des Knotens an erfasst wird.

      • Lifecycle-Phase — Wählen SienodeBootstrapped.

      • Speicherort des Skripts — Geben Sie s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh ihn ein und region ersetzen Sie ihn durch die AWS Region Ihres Clusters.

      • Name — Geben Sie einconfigure-cloudwatch-logs.

      • Argumente — Lassen Sie dieses Feld leer. Das Skript sendet automatisch Protokolle an die /aws/pcs/cluster-id/lifecycle Protokollgruppe.

      • Verhalten bei der Fehlerbehandlung — Wählen SieCONTINUE.

      • Ausführungsrichtlinie — Wählen SieFIRST_BOOT_ONLY.

    2. configure-efs-homes — Mounten Sie das Amazon EFS-Dateisystem als Basisverzeichnis /home und konfiguriert den Knoten so, dass bei der ersten Anmeldung das Basisverzeichnis jedes Benutzers erstellt wird.

      • Lifecycle-Phase — Wählen Sie. nodeBootstrapped

      • Speicherort des Skripts — Geben Sie s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh ihn ein und region ersetzen Sie ihn durch die AWS Region Ihres Clusters.

      • Name — Geben Sie einconfigure-efs-homes.

      • Argumente — Geben Sie ein --efs-id efs-file-system-id --home-base /home --options tls und efs-file-system-id ersetzen Sie es durch die ID des EFS-Dateisystems, das Sie zuvor im Tutorial erstellt haben.

      • Verhalten bei der Fehlerbehandlung — Wählen SieCONTINUE.

      • Ausführungsrichtlinie — Wählen SieEVERY_BOOT.

    3. mount-fsx-lustre — Mounten Sie das FSx for Lustre-Dateisystem unter für leistungsstarken gemeinsamen Scratch-Speicher. /shared

      • nodeBootstrappedLifecycle-Phase — Wählen Sie aus.

      • Speicherort des Skripts — Geben Sie s3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh ihn ein und region ersetzen Sie ihn durch die AWS Region Ihres Clusters (z. B.us-east-1).

      • Name — Geben Sie einmount-fsx-lustre.

      • Argumente — Geben Sie ein --fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared und fsx-dns-name ersetzen Sie es durch den DNS-Namen und mount-name durch den Mount-Namen, den Sie bei der Erstellung des FSx for Lustre-Dateisystems notiert haben.

      • Verhalten bei der Fehlerbehandlung — Wählen Sie. CONTINUE

      • Ausführungsrichtlinie — Wählen SieEVERY_BOOT.

    4. set-shared-dir-mode — Setzt den Modus /shared auf weltweit beschreibbare, feste Zugriffsrechte (Modus1777), sodass jeder Benutzer darin Dateien erstellen kann. Es wird danach ausgeführt, mount-fsx-lustre sodass es für das gemountete Dateisystem gilt.

      • Lifecycle-Phase — Wählen SienodeBootstrapped.

      • Speicherort des Skripts — Geben Sie einhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Dieses Community-Skript wird von HPC Recipes for AWS veröffentlicht.

      • Name — Geben Sie einset-shared-dir-mode.

      • Argumente — Geben Sie ein--path /shared --mode 1777.

      • Verhalten bei der Fehlerbehandlung — Wählen SieCONTINUE.

      • Ausführungsrichtlinie — Wählen SieEVERY_BOOT.

  • Wählen Sie Compute-Knotengruppe erstellen aus.

Im Feld Status wird der Wert Creating angezeigt, während die Compute-Knotengruppe bereitgestellt wird.

Wichtig

Warten Sie, bis im Statusfeld Aktiv angezeigt wird, bevor Sie mit dem nächsten Schritt in diesem Tutorial fortfahren.