View a markdown version of this page

Utilizzo di pcluster update-cluster - AWS ParallelCluster

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Utilizzo di pcluster update-cluster

In AWS ParallelCluster 3.x, pcluster update-cluster analizza le impostazioni utilizzate per creare il cluster corrente e le impostazioni nel file di configurazione per individuare eventuali problemi. Se vengono rilevati problemi, questi vengono segnalati e vengono visualizzati i passaggi da eseguire per risolverli. Ad esempio, se il computer InstanceType viene modificato, il parco di computer deve essere interrotto prima di poter procedere con l'aggiornamento. Questo problema viene segnalato quando viene scoperto. Se non vengono rilevati problemi di blocco, viene avviato il processo di aggiornamento e vengono segnalate le modifiche.

È possibile pcluster update-cluster --dryrun option utilizzarlo per visualizzare le modifiche prima che vengano eseguite. Per ulteriori informazioni, consulta esempi di pcluster update-cluster.

Per una guida alla risoluzione dei problemi, vedereAWS ParallelCluster risoluzione dei problemi.

Politica di aggiornamento: definizioni

Politica di aggiornamento: i nodi di accesso nel cluster devono essere interrotti per modificare questa impostazione per un aggiornamento.

Non puoi modificare queste impostazioni mentre i nodi di accesso nel cluster sono in uso. È necessario annullare la modifica o interrompere i nodi di accesso del cluster. (Puoi interrompere i nodi di accesso nel cluster impostando il conteggio di ogni pool su 0). Dopo aver interrotto i nodi di accesso del cluster, puoi aggiornare il cluster (pcluster update-cluster) per attivare le modifiche.

Nota

Questa politica di aggiornamento è supportata a partire dalla versione 3.7.0. AWS ParallelCluster

Politica di aggiornamento: è possibile aggiungere pool di nodi di accesso, ma la rimozione di un pool richiede l'interruzione di tutti i nodi di accesso nel cluster.

Per rimuovere un pool, è necessario arrestare tutti i nodi di accesso nel cluster. (Puoi interrompere i nodi di accesso nel cluster impostando il numero di ciascun pool su 0). Dopo aver interrotto i nodi di accesso del cluster, puoi aggiornare il cluster (pcluster update-cluster) per attivare le modifiche.

Nota

Questa politica di aggiornamento è supportata a partire dalla AWS ParallelCluster versione 3.11.0.

Politica di aggiornamento: i nodi di accesso nel pool devono essere interrotti affinché questa impostazione possa essere modificata per un aggiornamento.

Non puoi modificare queste impostazioni mentre i nodi di accesso nel pool sono in uso. È necessario annullare la modifica o interrompere i nodi di accesso del pool. (È possibile interrompere i nodi di accesso nel pool impostando il numero del pool su 0). Dopo che i nodi di accesso del pool sono stati interrotti, puoi aggiornare il cluster (pcluster update-cluster) per attivare le modifiche.

Nota

Questa politica di aggiornamento è supportata a partire dalla AWS ParallelCluster versione 3.11.0.

Politica di aggiornamento: questa impostazione può essere modificata durante un aggiornamento.

Dopo aver modificato questa impostazione, il cluster può essere aggiornato utilizzandopcluster update-cluster.

Politica di aggiornamento: se questa impostazione viene modificata, l'aggiornamento non è consentito.

Dopo aver modificato questa impostazione, il cluster non può essere aggiornato. È necessario ripristinare le impostazioni del cluster originale e creare un nuovo cluster con le impostazioni aggiornate. È possibile eliminare il cluster originale in un secondo momento. Per creare il nuovo cluster, usapcluster create-cluster. Per eliminare il cluster originale, usapcluster delete-cluster.

Politica di aggiornamento: questa impostazione non viene analizzata durante un aggiornamento.

Queste impostazioni possono essere modificate e il cluster aggiornato utilizzandopcluster update-cluster.

Politica di aggiornamento: il parco computer deve essere interrotto per modificare questa impostazione per un aggiornamento.

Queste impostazioni non possono essere modificate finché esiste il parco di elaborazione. La modifica deve essere annullata o il parco computer deve essere interrotto (in uso). pcluster update-compute-fleet Dopo l'interruzione del parco di elaborazione, è possibile aggiornare il cluster (pcluster update-cluster) per attivare le modifiche. Ad esempio, se si utilizza uno Slurm scheduler con SlurmQueues//- ComputeResources Name/MinCount> 0, viene avviato un parco di elaborazione.

Politica di aggiornamento: il parco macchine di calcolo e i nodi di accesso devono essere interrotti per modificare questa impostazione per un aggiornamento.

Queste impostazioni non possono essere modificate finché esiste il parco di elaborazione o se i nodi di accesso sono in uso. La modifica deve essere annullata o il parco computer e i nodi di accesso devono essere interrotti (il parco di elaborazione può essere interrotto utilizzando). pcluster update-compute-fleet Dopo l'interruzione del parco dati e dei nodi di accesso, è possibile aggiornare il cluster (pcluster update-cluster) per attivare le modifiche.

Politica di aggiornamento: questa impostazione non può essere ridotta durante un aggiornamento.

Queste impostazioni possono essere modificate, ma non possono essere ridotte. Se è necessario ridurre queste impostazioni, è necessario ripristinare le impostazioni del cluster originale e creare un nuovo cluster con le impostazioni aggiornate. È possibile eliminare il cluster originale in un secondo momento. Per creare il nuovo cluster, usapcluster create-cluster. Per eliminare il cluster originale, usapcluster delete-cluster.

Politica di aggiornamento: se questa impostazione viene modificata, l'aggiornamento non è consentito. Se si forza l'aggiornamento, il nuovo valore verrà ignorato e verrà utilizzato il vecchio valore.

Dopo aver modificato questa impostazione, il cluster non può essere aggiornato. È necessario ripristinare le impostazioni del cluster originale e creare un nuovo cluster con le impostazioni aggiornate. È possibile eliminare il cluster originale in un secondo momento. Per creare il nuovo cluster, usapcluster create-cluster. Per eliminare il cluster originale, usapcluster delete-cluster.

Politica di aggiornamento: il parco di elaborazione deve essere interrotto o QueueUpdateStrategy deve essere impostato affinché questa impostazione venga modificata per un aggiornamento.

Queste impostazioni possono essere modificate. Il parco di computer deve essere interrotto (in usopcluster update-compute-fleet) o QueueUpdateStrategy deve essere impostato. Dopo aver interrotto o impostato il parco di elaborazione, QueueUpdateStrategy è possibile aggiornare il cluster (pcluster update-cluster) per attivare le modifiche.

Nota

Questa politica di aggiornamento è supportata a partire dalla AWS ParallelCluster versione 3.2.0.

Politica di aggiornamento: per questa impostazione dei valori dell'elenco, è possibile aggiungere un nuovo valore durante un aggiornamento oppure è necessario interrompere il parco di elaborazione quando si rimuove un valore esistente.

Un nuovo valore per queste impostazioni può essere aggiunto durante un aggiornamento. Dopo aver aggiunto un nuovo valore all'elenco, il cluster può essere aggiornato utilizzando (pcluster update-cluster).

Per rimuovere un valore esistente dall'elenco, è necessario interrompere (utilizzarepcluster update-compute-fleet) il parco di elaborazione.

Ad esempio, se si utilizza uno Slurm scheduler e si aggiunge un nuovo tipo di istanza a Instances/InstanceType, è possibile aggiornare il cluster senza interrompere il parco di elaborazione. Per rimuovere un tipo di istanza esistente da Instances/InstanceType, è necessario prima arrestare il parco di elaborazione (utilizzando pcluster update-compute-fleet).

Nota

Questa politica di aggiornamento è supportata a partire dalla versione 3.2.0. AWS ParallelCluster

Politica di aggiornamento: la riduzione delle dimensioni di una coda richiede l'arresto del parco di elaborazione o QueueUpdateStrategy deve essere impostata su TERMINATE affinché questa impostazione venga modificata per un aggiornamento.

Queste impostazioni possono essere modificate, ma se la modifica dovesse ridurre le dimensioni della coda, il parco di calcolo deve essere interrotto (utilizzando pcluster update-compute-fleet) o deve essere impostato su TERMINATE. QueueUpdateStrategy Dopo che il parco di elaborazione è stato interrotto o è impostato su TERMINATE, QueueUpdateStrategy è possibile aggiornare il cluster (pcluster update-cluster) per attivare le modifiche. pcluster update-cluster

Il set TERMINATE quando si ridimensiona la capacità del cluster, terminerà solo i nodi dalla parte posteriore dell'elenco dei nodi e lascerà inalterati tutti gli altri nodi della stessa partizione.

Ad esempio, se la capacità iniziale del cluster è e, lo sono i nodi. MinCount = 5 MaxCount = 10 st-[1-5]; dy-[1-5] Quando si ridimensiona il cluster su MinCount = 3 eMaxCount = 5, la nuova capacità del cluster sarà composta dai nodist-[1-3]; dy-[1-2], che non verranno toccati durante l'aggiornamento. Solo i nodi st-[4-5]; dy-[3-5] verranno terminati durante l'aggiornamento.

Le seguenti modifiche sono supportate e non richiedono l'arresto del parco di elaborazione né l'QueueUpdateStrategyimpostazione su TERMINATE:

  • È stato aggiunto un nuovo SlurmQueue

  • ComputeResourceViene aggiunto un nuovo

  • MaxCountè aumentato

  • MinCountè aumentato ed MaxCount è aumentato almeno dello stesso importo

    Nota: questa politica di aggiornamento è supportata a partire dalla AWS ParallelCluster versione 3.9.0.

Politica di aggiornamento: per questa impostazione dei valori dell'elenco, il parco di elaborazione deve essere interrotto o QueueUpdateStrategy deve essere impostato per aggiungere un nuovo valore; il parco di elaborazione deve essere interrotto quando si rimuove un valore esistente.

Un nuovo valore per queste impostazioni può essere aggiunto durante un aggiornamento. Il parco di computer deve essere interrotto (in usopcluster update-compute-fleet) o QueueUpdateStrategy deve essere impostato. Dopo aver interrotto o impostato il parco di elaborazione, QueueUpdateStrategy è possibile aggiornare il cluster (pcluster update-cluster) per attivare le modifiche.

Per rimuovere un valore esistente dall'elenco, è necessario interrompere (utilizzarepcluster update-compute-fleet) il parco di elaborazione.

Nota

Questa politica di aggiornamento è supportata a partire dalla AWS ParallelCluster versione 3.3.0.

Politica di aggiornamento: tutti i nodi di calcolo devono essere interrotti per l'eliminazione gestita del gruppo di collocamento. Il parco di elaborazione deve essere interrotto o QueueUpdateStrategy deve essere impostato affinché questa impostazione venga modificata per un aggiornamento.

Il parco computer deve essere interrotto (utilizzatopcluster update-compute-fleet) per rimuovere un gruppo di collocamento gestito. Se si esegue un aggiornamento del cluster per rimuovere un gruppo di collocamento gestito prima di interrompere il parco di elaborazione, viene restituito un messaggio di configurazione non valido e l'aggiornamento non procede. L'arresto del parco di elaborazione garantisce che nessuna istanza sia in esecuzione.

esempi di pcluster update-cluster

Queste impostazioni possono essere modificate, ma se la modifica dovesse ridurre le dimensioni della coda, il parco di elaborazione deve essere interrotto (utilizzando pcluster update-compute-fleet) o deve essere impostato su TERMINATE. QueueUpdateStrategy Dopo che il parco di elaborazione è stato interrotto o è impostato su TERMINATE, QueueUpdateStrategy è possibile aggiornare il cluster (pcluster update-cluster) per attivare le modifiche. pcluster update-cluster

  • Questo esempio dimostra un aggiornamento con alcune modifiche consentite e l'aggiornamento viene avviato direttamente.

    $ pcluster update-cluster --cluster-name cluster_name --cluster-config ~/.parallelcluster/test_cluster --region us-east-1 { "cluster": { "clusterName": cluster_name, "cloudformationStackStatus": "UPDATE_IN_PROGRESS", "cloudformationStackArn": stack_arn, "region": "us-east-1", "version": "3.16.1", "clusterStatus": "UPDATE_IN_PROGRESS" }, "changeSet": [ { "parameter": "HeadNode.Networking.AdditionalSecurityGroups", "requestedValue": [ "sg-0cd61884c4ad11234" ], "currentValue": [ "sg-0cd61884c4ad16341" ] } ] }
  • Questo esempio dimostra un aggiornamento dryrun con alcune modifiche consentite. Dryrun è utile per segnalare il set di modifiche senza avviare l'aggiornamento.

    $ pcluster update-cluster --cluster-name cluster_name --cluster-config ~/.parallelcluster/test_cluster --region us-east-1 --dryrun true { "message": "Request would have succeeded, but DryRun flag is set.", "changeSet": [ { "parameter": "HeadNode.Networking.AdditionalSecurityGroups", "requestedValue": [ "sg-0cd61884c4ad11234" ], "currentValue": [ "sg-0cd61884c4ad16341" ] } ] }
  • Questo esempio dimostra un aggiornamento con alcune modifiche che bloccano l'aggiornamento.

    $ pcluster update-cluster --cluster-name cluster_name --cluster-config ~/.parallelcluster/test_cluster --region us-east-1 { "message": "Update failure", "updateValidationErrors": [ { "parameter": "HeadNode.Ssh.KeyName", "requestedValue": "mykey_2", "message": "Update actions are not currently supported for the 'KeyName' parameter. Restore 'KeyName' value to 'jenkinsjun'. If you need this change, please consider creating a new cluster instead of updating the existing one.", "currentValue": "mykey_1" }, { "parameter": "Scheduling.SlurmQueues[queue1].ComputeResources[queue1-t2micro].InstanceType", "requestedValue": "c4.xlarge", "message": "All compute nodes must be stopped. Stop the compute fleet with the pcluster update-compute-fleet command", "currentValue": "t2.micro" }, { "parameter": "SharedStorage[ebs1].MountDir", "requestedValue": "/my/very/very/long/shared_dir", "message": "Update actions are not currently supported for the 'MountDir' parameter. Restore 'MountDir' value to '/shared'. If you need this change, please consider creating a new cluster instead of updating the existing one.", "currentValue": "/shared" } ], "changeSet": [ { "parameter": "HeadNode.Networking.AdditionalSecurityGroups", "requestedValue": [ "sg-0cd61884c4ad11234" ], "currentValue": [ "sg-0cd61884c4ad16341" ] }, { "parameter": "HeadNode.Ssh.KeyName", "requestedValue": "mykey_2", "currentValue": "mykey_1" }, { "parameter": "Scheduling.SlurmQueues[queue1].ComputeResources[queue1-t2micro].InstanceType", "requestedValue": "c4.xlarge", "currentValue": "t2.micro" }, { "parameter": "SharedStorage[ebs1].MountDir", "requestedValue": "/my/very/very/long/shared_dir", "currentValue": "/shared" } ] }