Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
AWS ParallelCluster Fehlerbehebung
Die folgenden Abschnitte enthalten Tipps zur Behebung von Problemen, die bei der Verwendung auftreten können AWS ParallelCluster. Die AWS ParallelCluster Community unterhält eine Wiki-Seite, die viele Tipps zur Problembehandlung im AWS ParallelCluster GitHub Wiki enthält
Ab AWS ParallelCluster Version 3.16.0 können Sie auch das Node-Diagnosetool ausführen, pcluster-diag um eine Reihe von Integritätszuständen auf einem laufenden Cluster für Sie überprüfen zu lassen. Weitere Informationen finden Sie unter Problembehandlung mit pcluster-diag.
Themen
Ich versuche, das zu aktualisieren AWS ParallelCluster API-Stapel
Es werden Fehler bei der Initialisierung von Rechenknoten angezeigt
Fehlerbehebung bei der Cluster-Bereitstellung mithilfe von Terraform
Behebung von Problemen in Clustern mit AWS Batch Integration
Problembehandlung bei der Mehrbenutzerintegration mit Active Directory
Behebung eines Timeouts bei Cluster-Updates, wenn cfn-hup nicht ausgeführt wird
Das Cluster-Update ist bei einer NodeUpdated benutzerdefinierten Aktion fehlgeschlagen
Es werden Fehler bei Benutzerdefiniert angezeigt Slurm configuration
Behebung von Änderungen an der Betriebssystemkonfiguration, die zu Fehlern oder Ausfällen führen