Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Häufige Fehler und Problembehebung
Fehler treten AWS Batch häufig auf Anwendungsebene auf oder werden durch Instanzkonfigurationen verursacht, die nicht Ihren spezifischen Jobanforderungen entsprechen. Zu anderen Problemen gehören Jobs, die im RUNNABLE Status hängen bleiben, oder Computerumgebungen, die in einem bestimmten INVALID Status hängen bleiben. Weitere Informationen zur Problembehandlung bei Aufträgen, die im RUNNABLE Status „hängen bleiben“, finden Sie unterJobs, die den Status RUNNABLE haben. Hinweise zur Problembehandlung bei Computerumgebungen in einem bestimmten INVALID Zustand finden Sie unterUNGÜLTIGE Rechenumgebung.
-
Überprüfen Sie die Amazon EC2 Spot-vCPU-Kontingente — Stellen Sie sicher, dass Ihre aktuellen Servicekontingente den Jobanforderungen entsprechen. Nehmen wir beispielsweise an, dass Ihr aktuelles Servicekontingent 256 vCPUs beträgt und für den Job 10.000 vCPUs erforderlich sind. Dann entspricht das Dienstkontingent nicht den Jobanforderungen. Weitere Informationen und Anleitungen zur Fehlerbehebung finden Sie unter Amazon EC2-Servicekontingente und Wie erhöhe ich das Servicekontingent meiner Amazon EC2-Ressourcen?
. -
Jobs schlagen fehl, bevor die Anwendung ausgeführt wird — Einige Jobs schlagen möglicherweise aufgrund eines
DockerTimeoutErrorFehlers oderCannotPullContainerErrorFehlers fehl. Informationen zur Problembehandlung finden Sie unter Wie behebe ich den DockerTimeoutError "" -Fehler in AWS Batch?. -
Ungenügende IP-Adressen — Die Anzahl der IP-Adressen in Ihrer VPC und Ihren Subnetzen kann die Anzahl der Instances, die Sie erstellen können, einschränken. Verwenden Sie Classless Inter-Domain Routings (CIDRs), um mehr IP-Adressen bereitzustellen, als für die Ausführung Ihrer Workloads erforderlich sind. Bei Bedarf können Sie auch eine dedizierte VPC mit einem großen Adressraum erstellen. Sie können beispielsweise eine VPC mit mehreren CIDRs
10.x.0.0/16und ein Subnetz in jeder Availability Zone mit einem CIDR von erstellen.10.x.y.0/17In diesem Beispiel liegt x zwischen 1-4 und y ist entweder 0 oder 128. Diese Konfiguration bietet 36.000 IP-Adressen in jedem Subnetz.
-
Stellen Sie sicher, dass Instances bei Amazon EC2 registriert sind — Wenn Sie Ihre Instances in der Amazon EC2-Konsole sehen, aber keine Amazon Elastic Container Service-Container-Instances in Ihrem Amazon ECS-Cluster, ist der Amazon ECS-Agent möglicherweise nicht auf einem Amazon Machine Image (AMI) installiert. Der Amazon ECS-Agent, die Amazon EC2-Daten in Ihrem AMI oder die Startvorlage sind möglicherweise ebenfalls nicht richtig konfiguriert. Um die Ursache zu isolieren, erstellen Sie eine separate Amazon EC2-Instance oder stellen Sie mithilfe von SSH eine Verbindung zu einer vorhandenen Instance her. Weitere Informationen finden Sie unter Konfiguration des Amazon ECS-Container-Agents, Speicherorte der Amazon ECS-Protokolldateien undRessourcen-AMIs berechnen.
-
Überprüfen Sie das AWS Dashboard — Überprüfen Sie das AWS Dashboard, um sicherzustellen, dass der erwartete Auftragsstatus eingehalten wird und ob die Rechenumgebung erwartungsgemäß skaliert wird. Sie können auch die Job-Logins überprüfen CloudWatch.
-
Stellen Sie sicher, dass Ihre Instanz erstellt wurde — Wenn eine Instanz erstellt wird, bedeutet dies, dass Ihre Computerumgebung wie erwartet skaliert wurde. Wenn Ihre Instances nicht erstellt wurden, suchen Sie nach den zugehörigen Subnetzen in Ihrer Computerumgebung, um sie zu ändern. Weitere Informationen finden Sie unter Überprüfen einer Skalierungsaktivität für eine Auto Scaling-Gruppe.
Wir empfehlen Ihnen außerdem, zu überprüfen, ob Ihre Instances die entsprechenden Jobanforderungen erfüllen können. Beispielsweise benötigt ein Job möglicherweise 1 TiB Arbeitsspeicher, aber die Rechenumgebung verwendet einen C5-Instance-Typ, der auf 192 GB Arbeitsspeicher begrenzt ist.
-
Vergewissern Sie sich, dass Ihre Instances angefordert werden von AWS Batch — Überprüfen Sie den Auto Scaling-Gruppenverlauf, um sicherzustellen, dass Ihre Instances von angefordert werden. AWS Batch Dies ist ein Hinweis darauf, wie Amazon EC2 versucht, Instances zu erwerben. Wenn Sie eine Fehlermeldung erhalten, die besagt, dass Amazon EC2 Spot keine Instance in einer bestimmten Availability Zone abrufen kann, kann das daran liegen, dass die Availability Zone keine bestimmte Instance-Familie anbietet.
-
Stellen Sie sicher, dass Instances bei Amazon ECS registriert sind — Wenn Sie Instances in der Amazon EC2-Konsole sehen, aber keine Amazon ECS-Container-Instances in Ihrem Amazon ECS-Cluster, ist der Amazon ECS-Agent möglicherweise nicht auf dem Amazon Machine Image (AMI) installiert. Darüber hinaus sind der Amazon ECS-Agent, die Amazon EC2-Daten in Ihrem AMI oder die Startvorlage möglicherweise nicht richtig konfiguriert. Um die Ursache zu isolieren, erstellen Sie eine separate Amazon EC2-Instance oder stellen Sie mithilfe von SSH eine Verbindung zu einer vorhandenen Instance her. Weitere Informationen finden Sie unter CloudWatch Agentenkonfigurationsdatei: Abschnitt Protokolle, Speicherorte der Amazon ECS-Protokolldateien undRessourcen-AMIs berechnen.
-
Öffnen Sie ein Support-Ticket — Wenn Sie nach einer Problembehandlung immer noch Probleme haben und einen Supportplan haben, öffnen Sie ein Support-Ticket. Stellen Sie sicher, dass das Support-Ticket Informationen zum Problem, zu den Besonderheiten der Arbeitslast, zur Konfiguration und zu den Testergebnissen enthält. Weitere Informationen finden Sie unter Support Tarife https://aws.amazon.com/premiumsupport/plans/
vergleichen. -
Sehen Sie sich die AWS Batch und HPC-Foren an — Weitere Informationen finden Sie in den AWS Batch
und https://repost.aws/tags/TAjBvP4otfT3eX8PswbXo9AQ/high-performance-compute HPC-Foren. -
Sehen Sie sich das AWS Batch Runtime Monitoring Dashboard an — Dieses Dashboard verwendet eine serverlose Architektur, um Ereignisse von Amazon ECS zu erfassen, und Amazon EC2 AWS Batch, um Einblicke in Jobs und Instances zu bieten. Weitere Informationen finden Sie unter AWS Batch Runtime Monitoring Dashboards Solution.