View a markdown version of this page

Verwenden von pcluster update-cluster - AWS ParallelCluster

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Verwenden von pcluster update-cluster

pcluster update-clusterAnalysiert in AWS ParallelCluster 3.x die Einstellungen, die zum Erstellen des aktuellen Clusters verwendet wurden, und die Einstellungen in der Konfigurationsdatei auf Probleme. Wenn Probleme entdeckt werden, werden sie gemeldet, und die Schritte zur Behebung der Probleme werden angezeigt. Wenn beispielsweise die Rechenleistung geändert InstanceType wird, muss die Rechenflotte gestoppt werden, bevor ein Update durchgeführt werden kann. Dieses Problem wird gemeldet, wenn es entdeckt wird. Wenn keine Blockierungsprobleme festgestellt werden, wird der Aktualisierungsvorgang gestartet und die Änderungen werden gemeldet.

Sie können das verwenden pcluster update-cluster--dryrun option, um die Änderungen vor ihrer Ausführung zu sehen. Weitere Informationen finden Sie unter Beispiele für pcluster update-cluster.

Anleitungen zur Problembehandlung finden Sie unterAWS ParallelCluster Fehlerbehebung.

Richtlinie aktualisieren: Definitionen

Aktualisierungsrichtlinie: Die Anmeldeknoten im Cluster müssen gestoppt werden, damit diese Einstellung für ein Update geändert werden kann.

Sie können diese Einstellungen nicht ändern, während die Anmeldeknoten im Cluster verwendet werden. Entweder müssen Sie die Änderung rückgängig machen, oder Sie müssen die Anmeldeknoten des Clusters beenden. (Sie können die Anmeldeknoten im Cluster stoppen, indem Sie die Anzahl der einzelnen Pools auf 0 setzen). Nachdem die Anmeldeknoten des Clusters gestoppt wurden, können Sie den Cluster aktualisieren (pcluster update-cluster), um die Änderungen zu aktivieren.

Anmerkung

Diese Aktualisierungsrichtlinie wird ab Version 3.7.0 unterstützt. AWS ParallelCluster

Aktualisierungsrichtlinie: Anmeldeknotenpools können hinzugefügt werden, aber das Entfernen eines Pools erfordert, dass alle Anmeldeknoten im Cluster gestoppt werden.

Um einen Pool zu entfernen, müssen Sie alle Anmeldeknoten im Cluster stoppen. (Sie können Anmeldeknoten im Cluster stoppen, indem Sie die Anzahl der einzelnen Pools auf 0 setzen). Nachdem die Anmeldeknoten des Clusters gestoppt wurden, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

Anmerkung

Diese Aktualisierungsrichtlinie wird ab AWS ParallelCluster Version 3.11.0 unterstützt.

Aktualisierungsrichtlinie: Die Anmeldeknoten im Pool müssen gestoppt werden, damit diese Einstellung für ein Update geändert werden kann.

Sie können diese Einstellungen nicht ändern, während die Anmeldeknoten im Pool verwendet werden. Entweder müssen Sie die Änderung rückgängig machen, oder Sie müssen die Anmeldeknoten des Pools beenden. (Sie können die Anmeldeknoten im Pool stoppen, indem Sie die Anzahl des Pools auf 0 setzen). Nachdem die Anmeldeknoten des Pools gestoppt wurden, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

Anmerkung

Diese Aktualisierungsrichtlinie wird ab AWS ParallelCluster Version 3.11.0 unterstützt.

Aktualisierungsrichtlinie: Diese Einstellung kann während eines Updates geändert werden.

Nachdem Sie diese Einstellung geändert haben, kann der Cluster mit aktualisiert werdenpcluster update-cluster.

Aktualisierungsrichtlinie: Wenn diese Einstellung geändert wird, ist das Update nicht zulässig.

Nach dem Ändern dieser Einstellung kann der Cluster nicht aktualisiert werden. Sie müssen die Einstellungen für den ursprünglichen Cluster zurücksetzen und einen neuen Cluster mit den aktualisierten Einstellungen erstellen. Sie können den ursprünglichen Cluster zu einem späteren Zeitpunkt löschen. Um den neuen Cluster zu erstellen, verwenden Siepcluster create-cluster. Um den ursprünglichen Cluster zu löschen, verwenden Siepcluster delete-cluster.

Aktualisierungsrichtlinie: Diese Einstellung wird bei einem Update nicht analysiert.

Diese Einstellungen können geändert und der Cluster mit aktualisiert werdenpcluster update-cluster.

Aktualisierungsrichtlinie: Die Rechenflotte muss gestoppt werden, damit diese Einstellung für ein Update geändert werden kann.

Diese Einstellungen können nicht geändert werden, solange die Rechenflotte existiert. Entweder muss die Änderung rückgängig gemacht werden oder die Rechenflotte muss gestoppt (verwendetpcluster update-compute-fleet) werden. Nachdem die Rechenflotte gestoppt wurde, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren. Wenn Sie beispielsweise einen Slurm Scheduler mit SlurmQueues//- ComputeResources Name/MinCount> 0 verwenden, wird eine Rechenflotte gestartet.

Aktualisierungsrichtlinie: Die Rechenflotte und die Anmeldeknoten müssen gestoppt werden, damit diese Einstellung für ein Update geändert werden kann.

Diese Einstellungen können nicht geändert werden, solange die Rechenflotte existiert oder wenn die Anmeldeknoten verwendet werden. Entweder muss die Änderung rückgängig gemacht werden oder die Rechenflotte und die Anmeldeknoten müssen gestoppt werden (Die Rechenflotte kann nicht mehr verwendet werdenpcluster update-compute-fleet). Nachdem die Rechenflotte und die Anmeldeknoten gestoppt wurden, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

Aktualisierungsrichtlinie: Diese Einstellung kann während eines Updates nicht verringert werden.

Diese Einstellungen können geändert, aber nicht verringert werden. Wenn diese Einstellungen verringert werden müssen, müssen Sie die Einstellungen für den ursprünglichen Cluster zurücksetzen und einen neuen Cluster mit den aktualisierten Einstellungen erstellen. Sie können den ursprünglichen Cluster zu einem späteren Zeitpunkt löschen. Um den neuen Cluster zu erstellen, verwenden Siepcluster create-cluster. Um den ursprünglichen Cluster zu löschen, verwenden Siepcluster delete-cluster.

Aktualisierungsrichtlinie: Wenn diese Einstellung geändert wird, ist das Update nicht zulässig. Wenn Sie das Update erzwingen, wird der neue Wert ignoriert und der alte Wert wird verwendet.

Nach dem Ändern dieser Einstellung kann der Cluster nicht aktualisiert werden. Sie müssen die Einstellungen für den ursprünglichen Cluster zurücksetzen und einen neuen Cluster mit den aktualisierten Einstellungen erstellen. Sie können den ursprünglichen Cluster zu einem späteren Zeitpunkt löschen. Um den neuen Cluster zu erstellen, verwenden Siepcluster create-cluster. Um den ursprünglichen Cluster zu löschen, verwenden Siepcluster delete-cluster.

Aktualisierungsrichtlinie: Die Rechenflotte muss gestoppt oder QueueUpdateStrategy eingerichtet sein, damit diese Einstellung für ein Update geändert werden kann.

Diese Einstellungen können geändert werden. Entweder muss die Rechenflotte gestoppt (verwendetpcluster update-compute-fleet) oder QueueUpdateStrategy eingestellt werden. Nachdem die Rechenflotte gestoppt oder QueueUpdateStrategy eingerichtet wurde, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

Anmerkung

Diese Aktualisierungsrichtlinie wird ab AWS ParallelCluster Version 3.2.0 unterstützt.

Aktualisierungsrichtlinie: Für diese Einstellung für Listenwerte kann während eines Updates ein neuer Wert hinzugefügt werden, oder die Rechenflotte muss gestoppt werden, wenn ein vorhandener Wert entfernt wird.

Ein neuer Wert für diese Einstellungen kann während eines Updates hinzugefügt werden. Nachdem der Liste ein neuer Wert hinzugefügt wurde, kann der Cluster mit (pcluster update-cluster) aktualisiert werden.

Um einen vorhandenen Wert aus der Liste zu entfernen, muss die Rechenflotte gestoppt werden (mitpcluster update-compute-fleet).

Wenn Sie beispielsweise einen Slurm Scheduler verwenden und einen neuen Instance-Typ zu diesem hinzufügen Instances/InstanceType, können Sie den Cluster aktualisieren, ohne die Rechenflotte anzuhalten. Um einen vorhandenen Instance-Typ zu entfernen Instances/InstanceType, muss zuerst die Computing-Flotte gestoppt werden (mithilfe von pcluster update-compute-fleet).

Anmerkung

Diese Aktualisierungsrichtlinie wird ab Version 3.2.0 unterstützt. AWS ParallelCluster

Aktualisierungsrichtlinie: Um die Größe einer Warteschlange zu reduzieren, QueueUpdateStrategy muss die Rechenflotte gestoppt oder auf TERMINATE gesetzt werden, damit diese Einstellung für ein Update geändert werden kann.

Diese Einstellungen können geändert werden, aber wenn die Änderung die Größe der Warteschlange reduzieren würde, muss die Rechenflotte gestoppt werden (mit pcluster update-compute-fleet) oder QueueUpdateStrategy auf TERMINATE gesetzt werden. Nachdem die Rechenflotte gestoppt oder QueueUpdateStrategy auf TERMINATE gesetzt wurde, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

Wenn Sie die Kapazität des Clusters ändern, werden nur die Knoten beendet, die sich am Ende der Knotenliste befinden. Alle anderen Knoten derselben Partition bleiben davon unberührt.

Wenn die Anfangskapazität des Clusters beispielsweise MinCount = 5 und istMaxCount = 10, sind es die Knoten. st-[1-5]; dy-[1-5] Wenn Sie die Größe des Clusters auf MinCount = 3 und ändernMaxCount = 5, setzt sich die neue Clusterkapazität aus den Knoten zusammenst-[1-3]; dy-[1-2], die während der Aktualisierung nicht verändert werden. Nur die Knoten st-[4-5]; dy-[3-5] werden während des Updates beendet.

Die folgenden Änderungen werden unterstützt und erfordern weder das Stoppen der Rechenflotte noch das QueueUpdateStrategy Setzen auf TERMINATE:

  • Eine neue SlurmQueue wird hinzugefügt

  • Ein neuer ComputeResource wird hinzugefügt

  • MaxCountist erhöht

  • MinCountist erhöht und MaxCount wird um mindestens den gleichen Betrag erhöht

    Hinweis: Diese Aktualisierungsrichtlinie wird ab AWS ParallelCluster Version 3.9.0 unterstützt.

Aktualisierungsrichtlinie: Für diese Einstellung für Listenwerte muss die Rechenflotte gestoppt oder QueueUpdateStrategy so eingestellt werden, dass ein neuer Wert hinzugefügt wird. Die Rechenflotte muss gestoppt werden, wenn ein vorhandener Wert entfernt wird.

Ein neuer Wert für diese Einstellungen kann während eines Updates hinzugefügt werden. Entweder muss die Rechenflotte gestoppt (verwendetpcluster update-compute-fleet) oder QueueUpdateStrategy neu eingestellt werden. Nachdem die Rechenflotte gestoppt oder QueueUpdateStrategy eingerichtet wurde, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

Um einen vorhandenen Wert aus der Liste zu entfernen, muss die Rechenflotte gestoppt (verwendetpcluster update-compute-fleet) werden.

Anmerkung

Diese Aktualisierungsrichtlinie wird ab AWS ParallelCluster Version 3.3.0 unterstützt.

Aktualisierungsrichtlinie: Alle Rechenknoten müssen gestoppt werden, damit eine verwaltete Placement-Gruppe gelöscht werden kann. Die Rechenflotte muss gestoppt oder QueueUpdateStrategy eingerichtet sein, damit diese Einstellung für ein Update geändert werden kann.

Die Rechenflotte muss gestoppt (verwendetpcluster update-compute-fleet) werden, um eine verwaltete Platzierungsgruppe zu entfernen. Wenn Sie vor dem Stoppen der Rechenflotte ein Cluster-Update ausführen, um eine verwaltete Platzierungsgruppe zu entfernen, wird eine Meldung über eine ungültige Konfiguration zurückgegeben und das Update wird nicht fortgesetzt. Das Stoppen der Rechenflotte garantiert, dass keine Instances laufen.

Beispiele für pcluster update-cluster

Diese Einstellungen können geändert werden, aber wenn die Änderung die Größe der Warteschlange verringern würde, muss die Rechenflotte gestoppt werden (mit pcluster update-compute-fleet) oder auf TERMINATE gesetzt werden. QueueUpdateStrategy Nachdem die Rechenflotte gestoppt oder QueueUpdateStrategy auf TERMINATE gesetzt wurde, können Sie den Cluster (pcluster update-cluster) aktualisieren, um die Änderungen zu aktivieren.

  • Dieses Beispiel zeigt ein Update mit einigen erlaubten Änderungen, und das Update wird direkt gestartet.

    $ pcluster update-cluster --cluster-name cluster_name --cluster-config ~/.parallelcluster/test_cluster --region us-east-1 { "cluster": { "clusterName": cluster_name, "cloudformationStackStatus": "UPDATE_IN_PROGRESS", "cloudformationStackArn": stack_arn, "region": "us-east-1", "version": "3.16.1", "clusterStatus": "UPDATE_IN_PROGRESS" }, "changeSet": [ { "parameter": "HeadNode.Networking.AdditionalSecurityGroups", "requestedValue": [ "sg-0cd61884c4ad11234" ], "currentValue": [ "sg-0cd61884c4ad16341" ] } ] }
  • Dieses Beispiel zeigt ein Dryrun-Update mit einigen erlaubten Änderungen. Dryrun ist nützlich, um den Änderungssatz zu melden, ohne das Update zu starten.

    $ pcluster update-cluster --cluster-name cluster_name --cluster-config ~/.parallelcluster/test_cluster --region us-east-1 --dryrun true { "message": "Request would have succeeded, but DryRun flag is set.", "changeSet": [ { "parameter": "HeadNode.Networking.AdditionalSecurityGroups", "requestedValue": [ "sg-0cd61884c4ad11234" ], "currentValue": [ "sg-0cd61884c4ad16341" ] } ] }
  • Dieses Beispiel zeigt ein Update mit einigen Änderungen, die das Update blockieren.

    $ pcluster update-cluster --cluster-name cluster_name --cluster-config ~/.parallelcluster/test_cluster --region us-east-1 { "message": "Update failure", "updateValidationErrors": [ { "parameter": "HeadNode.Ssh.KeyName", "requestedValue": "mykey_2", "message": "Update actions are not currently supported for the 'KeyName' parameter. Restore 'KeyName' value to 'jenkinsjun'. If you need this change, please consider creating a new cluster instead of updating the existing one.", "currentValue": "mykey_1" }, { "parameter": "Scheduling.SlurmQueues[queue1].ComputeResources[queue1-t2micro].InstanceType", "requestedValue": "c4.xlarge", "message": "All compute nodes must be stopped. Stop the compute fleet with the pcluster update-compute-fleet command", "currentValue": "t2.micro" }, { "parameter": "SharedStorage[ebs1].MountDir", "requestedValue": "/my/very/very/long/shared_dir", "message": "Update actions are not currently supported for the 'MountDir' parameter. Restore 'MountDir' value to '/shared'. If you need this change, please consider creating a new cluster instead of updating the existing one.", "currentValue": "/shared" } ], "changeSet": [ { "parameter": "HeadNode.Networking.AdditionalSecurityGroups", "requestedValue": [ "sg-0cd61884c4ad11234" ], "currentValue": [ "sg-0cd61884c4ad16341" ] }, { "parameter": "HeadNode.Ssh.KeyName", "requestedValue": "mykey_2", "currentValue": "mykey_1" }, { "parameter": "Scheduling.SlurmQueues[queue1].ComputeResources[queue1-t2micro].InstanceType", "requestedValue": "c4.xlarge", "currentValue": "t2.micro" }, { "parameter": "SharedStorage[ebs1].MountDir", "requestedValue": "/my/very/very/long/shared_dir", "currentValue": "/shared" } ] }