View a markdown version of this page

Überwachung langlebiger Funktionen - AWS Lambda

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Überwachung langlebiger Funktionen

Sie können Ihre dauerhaften Funktionen mithilfe von CloudWatch Metriken, CloudWatch Protokollen und Tracing überwachen. Da langlebige Funktionen über einen längeren Zeitraum ausgeführt werden können und sich über mehrere Funktionsaufrufe erstrecken, erfordert deren Überwachung das Verständnis ihrer jeweiligen Ausführungsmuster, einschließlich Checkpoints, Zustandsübergängen und Wiedergabeverhalten.

CloudWatch Metriken

Lambda veröffentlicht Metriken automatisch und ohne zusätzliche Kosten. CloudWatch Dauerhafte Funktionen bieten zusätzliche Metriken, die über die standardmäßigen Lambda-Metriken hinausgehen, um Ihnen bei der Überwachung lang andauernder Workflows, der Statusverwaltung und der Ressourcenauslastung zu helfen.

Dauerhafte Ausführungsmetriken

Lambda gibt die folgenden Metriken für dauerhafte Ausführungen aus:

Metrik Description
ApproximateRunningDurableExecutions Anzahl der dauerhaften Ausführungen im Status RUNNING
ApproximateRunningDurableExecutionsUtilization Prozentsatz der aktuell in Anspruch genommenen Höchstzahl an laufenden Dauerausführungen Ihres Kontos
DurableExecutionDuration Verstrichene Wanduhrzeit in Millisekunden, während der eine dauerhafte Ausführung im Status RUNNING verharrte
DurableExecutionStarted Anzahl der gestarteten dauerhaften Ausführungen
DurableExecutionStopped Anzahl der dauerhaften Ausführungen, die nicht mehr über die API ausgeführt wurden StopDurableExecution
DurableExecutionSucceeded Anzahl der dauerhaften Ausführungen, die erfolgreich abgeschlossen wurden
DurableExecutionFailed Anzahl der dauerhaften Ausführungen, die mit einem Fehler abgeschlossen wurden
DurableExecutionTimedOut Anzahl der dauerhaften Ausführungen, bei denen das konfigurierte Ausführungs-Timeout überschritten wurde
DurableExecutionOperations Kumulierte Anzahl der im Rahmen einer dauerhaften Ausführung ausgeführten Operationen (max.: 3.000)
DurableExecutionStorageWrittenBytes Kumulierte Datenmenge in Byte, die bei einer dauerhaften Ausführung beibehalten wurden (max.: 100 MB)

CloudWatch Metriken

Lambda gibt Standardmetriken für Aufruf, Leistung und Parallelität für langlebige Funktionen aus. Da eine dauerhafte Ausführung mehrere Funktionsaufrufe umfassen kann, während sie Checkpoints und Wiederholungen durchläuft, verhalten sich diese Metriken anders als bei Standardfunktionen:

  • Aufrufe: Zählt jeden Funktionsaufruf, einschließlich Wiederholungen. Eine einzige dauerhafte Ausführung kann mehrere Aufrufdatenpunkte generieren.

  • Dauer: Misst jeden Funktionsaufruf separat. Wird DurableExecutionDuration für die Gesamtzeit verwendet, die für eine einzelne dauerhafte Ausführung benötigt wurde.

  • Fehler: Verfolgt Fehler beim Aufrufen von Funktionen. Wird DurableExecutionFailed bei Fehlern auf Ausführungsebene verwendet.

Eine vollständige Liste der Standard-Lambda-Metriken finden Sie unter Arten von Metriken für Lambda-Funktionen.

Alarme erstellen CloudWatch

Erstellen Sie CloudWatch Alarme, um Sie zu benachrichtigen, wenn Metriken Schwellenwerte überschreiten. Zu den häufigsten Alarmen gehören:

  • ApproximateRunningDurableExecutionsUtilizationüberschreitet 80% Ihrer Quote

  • DurableExecutionFailedsteigt über einen Schwellenwert

  • DurableExecutionTimedOutzeigt an, dass das Zeitlimit für Ausführungen überschritten wird

  • DurableExecutionStorageWrittenBytesnähert sich den Speichergrenzen

Weitere Informationen finden Sie unter Verwenden von CloudWatch Alarmen.

EventBridge Ereignisse

Lambda veröffentlicht dauerhafte Ereignisse zur Änderung des Ausführungsstatus für EventBridge. Sie können diese Ereignisse verwenden, um Workflows auszulösen, Benachrichtigungen zu senden oder Änderungen des Ausführungslebenszyklus in Ihren dauerhaften Funktionen nachzuverfolgen.

Dauerhafte Ereignisse zur Änderung des Ausführungsstatus

Lambda gibt immer dann ein Ereignis aus, EventBridge wenn eine dauerhafte Ausführung den Status ändert. Diese Ereignisse haben die folgenden Eigenschaften:

  • Quelle: aws.lambda

  • Typ des Details: Durable Execution Status Change

Statusänderungsereignisse werden für die folgenden Ausführungszustände veröffentlicht:

  • RUNNING— Die Ausführung wurde gestartet

  • SUCCEEDED- Die Ausführung wurde erfolgreich abgeschlossen

  • STOPPED- Die Ausführung wurde mithilfe der StopDurableExecution API gestoppt

  • FAILED- Die Ausführung ist mit einem Fehler fehlgeschlagen

  • TIMED_OUT- Die Ausführung hat das konfigurierte Timeout überschritten

Das folgende Beispiel zeigt ein dauerhaftes Ereignis zur Änderung des Ausführungsstatus:

{ "version": "0", "id": "d019b03c-a8a3-9d58-85de-241e96206538", "detail-type": "Durable Execution Status Change", "source": "aws.lambda", "account": "123456789012", "time": "2025-11-20T13:08:22Z", "region": "us-east-1", "resources": [], "detail": { "durableExecutionArn": "arn:aws:lambda:us-east-1:123456789012:function:my-function:$LATEST/durable-execution/090c4189-b18b-4296-9d0c-cfd01dc3a122/9f7d84c9-ea3d-3ffc-b3e5-5ec51c34ffc9", "durableExecutionName": "order-123", "functionArn": "arn:aws:lambda:us-east-1:123456789012:function:my-function:2", "status": "RUNNING", "startTimestamp": "2025-11-20T13:08:22.345Z" } }

Bei Terminalzuständen (SUCCEEDEDSTOPPED,,FAILED,TIMED_OUT) enthält das Ereignis ein endTimestamp Feld, das angibt, wann die Ausführung abgeschlossen ist.

EventBridge Regeln erstellen

Erstellen Sie EventBridge Regeln, um Ereignisse mit dauerhaften Änderungen des Ausführungsstatus an Ziele wie Amazon Simple Notification Service, Amazon Simple Queue Service oder andere Lambda-Funktionen weiterzuleiten.

Im folgenden Beispiel wird eine Regel erstellt, die allen dauerhaften Änderungen des Ausführungsstatus entspricht:

{ "source": ["aws.lambda"], "detail-type": ["Durable Execution Status Change"] }

Im folgenden Beispiel wird eine Regel erstellt, die nur auf fehlgeschlagene Ausführungen zutrifft:

{ "source": ["aws.lambda"], "detail-type": ["Durable Execution Status Change"], "detail": { "status": ["FAILED"] } }

Im folgenden Beispiel wird eine Regel erstellt, die Statusänderungen für eine bestimmte Funktion abgleicht:

{ "source": ["aws.lambda"], "detail-type": ["Durable Execution Status Change"], "detail": { "functionArn": [{ "prefix": "arn:aws:lambda:us-east-1:123456789012:function:my-function" }] } }

Weitere Informationen zum Erstellen von EventBridge Regeln finden Sie in den EventBridge Amazon-Tutorials im EventBridge Benutzerhandbuch.

Verwenden von Warteschlangen mit unzustellbaren Buchstaben bei Ereignissen EventBridge

EventBridge Statusänderungsereignisse informieren in Echtzeit, wenn eine dauerhafte Ausführung in den Status FAILED, STOPPED oder TIMED_OUT übergeht. Sie enthalten jedoch nicht die ursprüngliche Nutzlast des Ereignisses, das die Ausführung ausgelöst hat. Um das auslösende Ereignis für eine spätere Analyse oder erneute Verarbeitung zu erfassen, konfigurieren Sie eine Dead-Letter-Queue (DLQ) in Ihrer dauerhaften Funktion.

Wenn eine dauerhafte Ausführung nach einem asynchronen Aufruf fehlschlägt, sendet Lambda das ursprüngliche auslösende Ereignis an den konfigurierten DLQ. Verwenden Sie EventBridge Ereignisse und DLQs zusammen für eine umfassende Strategie zur Fehlerbehandlung:

  • EventBridge Ereignisse — Lösen Sie sofortige Warnmeldungen aus, aktualisieren Sie Dashboards oder starten Sie Problembehebungsabläufe, wenn die Ausführung fehlschlägt.

  • Dead-letter Warteschlangen — Behalten Sie die ursprüngliche Nutzlast für Ereignisse bei, sodass Sie untersuchen können, was den Fehler verursacht hat, das Problem debuggen und das Ereignis optional erneut verarbeiten können, nachdem Sie das zugrunde liegende Problem behoben haben.

Informationen zur Konfiguration eines DLQ für Ihre Funktion finden Sie unter Warteschlangen. Dead-letter

AWS X-Ray Nachverfolgung

Sie können die X-Ray Ablaufverfolgung für Ihre dauerhaften Funktionen aktivieren. Lambda übergibt den X-Ray Trace-Header an die dauerhafte Ausführung, sodass Sie Anfragen in Ihrem gesamten Workflow verfolgen können.

Um das Tracing mithilfe der Lambda-Konsole zu aktivieren X-Ray, wählen Sie Ihre Funktion aus, wählen Sie dann Tools für Konfiguration, Überwachung und Betrieb aus und aktivieren Sie Active Tracing unter. X-Ray

So aktivieren Sie die X-Ray Ablaufverfolgung mit dem: AWS CLI

aws lambda update-function-configuration \ --function-name my-durable-function \ --tracing-config Mode=Active

So aktivieren Sie die AWS X-Ray Ablaufverfolgung mit: AWS SAM

Resources: MyDurableFunction: Type: AWS::Serverless::Function Properties: Tracing: Active DurableConfig: ExecutionTimeout: 3600

Weitere Informationen X-Ray dazu finden Sie im AWS X-Ray Entwicklerhandbuch.