AgentCore generierte Laufzeitbeobachtbarkeitsdaten
Die von bereitgestellten Laufzeitmetriken AgentCore geben Ihnen einen Überblick über die Ausführungsaktivitäten Ihrer Agenten, die Verarbeitungslatenz, die Ressourcennutzung und die Fehlerraten. AgentCore bietet auch aggregierte Metriken für die Gesamtzahl der Aufrufe und Sitzungen.
Themen
Kennzahlen zur Beobachtbarkeit und Laufzeit
In der folgenden Liste werden die Laufzeitmetriken beschrieben, die von AgentCore bereitgestellt werden. Laufzeitmetriken werden in Intervallen von einer Minute gebündelt. Weitere Informationen zum Anzeigen von Laufzeitmetriken finden Sie unter Beobachtbarkeitsdaten für Ihre Amazon AgentCore Bedrock-Agenten anzeigen.
- Aufrufe
-
Zeigt die Gesamtzahl der Anfragen an die Data Plane API an. Jeder API-Aufruf zählt als ein Aufruf, unabhängig von der Größe der Anforderungsnutzlast oder dem Antwortstatus.
- Aufrufe (aggregiert)
-
Zeigt die Gesamtzahl der Aufrufe für alle Ressourcen
- Drosselungen
-
Zeigt die Anzahl der Anfragen an, die vom Dienst aufgrund der Überschreitung der zulässigen TPS- (Transaktionen pro Sekunde) oder der Kontingentgrenzen gedrosselt wurden. Diese Anfragen werden ThrottlingException mit dem HTTP-Statuscode 429 zurückgegeben. Überwachen Sie diese Metrik, um festzustellen, ob Sie Ihre Servicequotas überprüfen oder die Anforderungsmuster optimieren müssen.
- Systemfehler
-
Zeigt die Anzahl der serverseitigen Fehler an, die AgentCore bei der Anforderungsverarbeitung aufgetreten sind. Ein hohes Maß an serverseitigen Fehlern kann auf potenzielle Infrastruktur- oder Serviceprobleme hindeuten, die zu untersuchen sind. Eine Liste möglicher Fehlercodes finden Sie unter Fehlertypen.
- Benutzerfehler
-
Stellt die Anzahl der clientseitigen Fehler dar, die auf ungültige Anfragen zurückzuführen sind. Zur Behebung dieser Probleme ist eine Benutzeraktion erforderlich. Ein hohes Maß an clientseitigen Fehlern kann auf Probleme mit der Formatierung von Anfragen oder mit den Berechtigungen hinweisen, die behoben werden müssen. Eine Liste möglicher Fehlercodes finden Sie unter Fehlertypen.
- Latenz
-
Die Gesamtzeit, die zwischen dem Empfang der Anfrage und dem Senden des endgültigen Antwort-Tokens vergangen ist. Stellt die gesamte Bearbeitungszeit der Anfrage von Anfang bis Ende dar.
- Gesamtzahl Fehler
-
Die Gesamtzahl der System- und Benutzerfehler. In der Amazon AgentCore Bedrock-Konsole zeigt diese Metrik die Anzahl der Fehler als Prozentsatz der Gesamtzahl der Aufrufe an.
- Anzahl der Sitzungen
-
Zeigt die Anzahl der neuen Agentensitzungen an, die innerhalb des Berichtszeitraums erstellt wurden. Jede Sitzung wird zum Zeitpunkt der Erstellung einmal gezählt. Bei nachfolgenden Aufrufen derselben Sitzung wird diese Metrik nicht erhöht. Dies ist ein kumulativer Zähler, kein Indikator für die aktuell aktiven Sitzungen. Nützlich, um die allgemeine Plattformnutzung zu überwachen, Trends bei der Sitzungserstellung zu ermitteln und die Muster der Benutzerinteraktion zu verstehen.
- Sitzungen (aggregiert)
-
Zeigt die Gesamtzahl der neuen Sitzungen an, die innerhalb des Berichtszeitraums für alle Ressourcen erstellt wurden.
- ActiveSessionCount
-
Zeigt die Anzahl der derzeit aktiven Sitzungen für Ihr Konto an. Im Gegensatz zur
SessionCountMetrik (einem kumulativen Zähler) handelt es sich bei dieser Metrik um eine Echtzeitmessung, die anzeigt, wie viele Sitzungen zu einem bestimmten Zeitpunkt laufen. Amazon Bedrock AgentCore veröffentlicht diese Metrik einmal pro Minute pro Servicetyp. Verwenden Sie es, um die aktuelle Kapazitätsauslastung zu überwachen, Alarme für unerwartete Nutzungsspitzen einzurichten und den Verbrauch Ihrer Sitzungskontingente zu ermitteln. Verwenden Sie dieServiceDimension — mit WertenAgentCore.Runtime, oderAgentCore.Browser—AgentCore.CodeInterpreter, um diese Metrik nach Workload-Typ zu filtern. Amazon Bedrock AgentCore veröffentlicht diese Metrik direkt in Ihrem AWS Konto imAWS/Bedrock-AgentCoreNamespace. - ActiveStreamingConnections
-
(WebSocket nur) Zeigt die aktuelle Anzahl der aktiven WebSocket Verbindungen pro Agent an. Überwachen Sie diese Metrik, um die Verbindungsnutzung zu verstehen und Verbindungsabbrüche oder -spitzen für die Kapazitätsplanung zu erkennen. Die einzig aussagekräftige Statistik ist eine Summe von einer Minute.
- InboundStreamingBytesProcessed
-
(WebSocket nur) Zeigt die Gesamtzahl der erfolgreich verarbeiteten Byte in WebSocket Frames an, die von Clients in Agent-Containern empfangen wurden. Verwenden Sie diese Metrik, um den Datendurchsatz zu überwachen und Nutzungsmuster zu identifizieren.
- OutboundStreamingBytesProcessed
-
(WebSocket nur) Zeigt die Gesamtzahl der erfolgreich verarbeiteten Byte in WebSocket Frames an, die von Agent-Containern an Clients gesendet wurden. Überwachen Sie diese Metrik, um die Reaktionsmuster der Agenten zu verstehen und eine erfolgreiche Datenübertragung sicherzustellen.
Metriken und Protokolle zur Ressourcennutzung
Amazon Bedrock AgentCore Runtime bietet umfassende Telemetrie zur Ressourcennutzung, einschließlich Kennzahlen zum CPU- und Speicherverbrauch für Ihre Laufzeitressourcen.
Anmerkung
Daten zur Ressourcennutzung können sich um bis zu 60 Minuten verzögern, und die Genauigkeit kann je nach Messwert unterschiedlich sein.
Verkaufte Metriken
Amazon Bedrock AgentCore Runtime stellt automatisch Kennzahlen zur Ressourcennutzung auf Konto-, Agentenlaufzeit- und Agentenendpunktebene bereit. Diese Metriken werden mit einer Auflösung von 1 Minute veröffentlicht. Die CloudWatch Amazon-Aggregation und die Aufbewahrung von metrischen Daten folgen den Standardrichtlinien von Amazon CloudWatch zur Datenspeicherung. Weitere Informationen finden Sie unter https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/cloudwatch_concepts.html #Metric.
Hier sind die Dimensionssätze und Metriken, die für die Überwachung Ihrer Ressourcen verfügbar sind:
| Name | Dimensionen | Description |
|---|---|---|
|
CPUUsed-vCPUHours |
Dienst; Dienst, Ressource; Dienst, Ressource, Name |
Die Gesamtmenge der verbrauchten virtuellen CPU in CPU-Hours V-Einheiten, verfügbar auf Ressourcen- und Kontoebene. Nützlich für die Nachverfolgung von Ressourcen und die Transparenz der geschätzten Rechnungsstellung. |
|
MemoryUsed-GBHours |
Dienst; Dienst, Ressource; Dienst, Ressource, Name |
Die Gesamtmenge des in GB-Hours Einheiten verbrauchten Speichers, der auf Ressourcen- und Kontoebene verfügbar ist. Nützlich für die Nachverfolgung von Ressourcen und die Transparenz der geschätzten Rechnungsstellung. |
Erläuterung der Abmessungen
-
Bedienung - AgentCore.Runtime
-
Ressource — Agent Arn
-
Name — Name des Agenten-Endpunkts im folgenden Format AgentName: EndpointName
Metriken auf Kontoebene sind in der Amazon CloudWatch Bedrock AgentCore Observability Console auf der Registerkarte Runtime verfügbar. Das Dashboard zeigt anhand dieser Kennzahlen generierte Diagramme zur Speicher- und CPU-Auslastung an, die die gesamte Ressourcennutzung aller Agenten in Ihrem Konto in der Region darstellen.
Metriken auf Agentenendpunktebene sind auf der AgentEndpoint Seite der Amazon CloudWatch Bedrock AgentCore Observability Console verfügbar. Das Dashboard zeigt anhand dieser Metriken generierte Diagramme zur Speicher- und CPU-Auslastung an, die die gesamte Ressourcennutzung aller vom angegebenen Agent-Endpunkt aufgerufenen Sitzungen darstellen.
Anmerkung
Telemetriedaten werden zu Überwachungszwecken bereitgestellt. Die tatsächliche Abrechnung wird auf der Grundlage der gemessenen Nutzungsdaten berechnet und kann aufgrund der Aggregationszeit, der Abstimmungsprozesse und der Messgenauigkeit von den Telemetriewerten abweichen. Die verbindlichen Gebühren entnehmen Sie Ihrer AWS Abrechnung.
Vended-Protokolle
Bedrock AgentCore Runtime bietet verkaufte Protokolle für Nutzungsmetriken auf Sitzungsebene mit einer Genauigkeit von 1 Sekunde. Jeder Protokolldatensatz enthält Daten zum Ressourcenverbrauch, einschließlich CPU-Auslastung (agent.runtime.vcpu.hours.used) und Speicherverbrauch (agent.runtime.memory.gb_hours.used).
Jeder Protokolldatensatz wird das folgende Schema haben:
| Protokolltyp | Protokollfelder | Description |
|---|---|---|
|
USAGE_LOGS |
event_timestamp, resource_arn, service.name, cloud.provider, cloud.region, account.id, region, resource.id, session.id, agent.name, elapsed_time_seconds, agent.runtime.vcpu.hours.used, agent.runtime.memory.gb_hours.used |
Ressourcennutzungsprotokolle für die Ressourcenverfolgung auf Sitzungsebene. |
Informationen zum Aktivieren des Protokolltyps USAGE_LOG für Ihre Agenten finden Sie unter Hinzufügen von Observability zu Ihren Amazon Bedrock-Ressourcen. AgentCore Die Protokolle werden dann im konfigurierten Ziel (AWS LogGroupAmazon S3 oder Amazon Kinesis Firehose) wie konfiguriert angezeigt.
Auf der Seite Agent Session der Amazon CloudWatch Bedrock AgentCore Observability Console können Sie anhand dieser Protokolle generierte Kennzahlen zur Ressourcennutzung sehen. Um Ihre Anzeige von Kennzahlen zu optimieren, wählen Sie mithilfe der Auswahltaste oben rechts den gewünschten Zeitraum aus, um sich auf bestimmte CPU- und Speicherauslastungsdaten zu konzentrieren.
Anmerkung
Telemetriedaten werden zu Überwachungszwecken bereitgestellt. Die tatsächliche Abrechnung wird auf der Grundlage der gemessenen Nutzungsdaten berechnet und kann aufgrund der Aggregationszeit, der Abstimmungsprozesse und der Messgenauigkeit von den Telemetriewerten abweichen. Die verbindlichen Gebühren entnehmen Sie Ihrer AWS Abrechnung.
Bereitgestellte Span-Daten
AgentCore Stellt strukturierte Zeitspannen bereit, die Einblick in die Aufrufe der Agenten-Laufzeit bieten, um die Beobachtbarkeit zu verbessern. Um diese Span-Daten zu aktivieren, müssen Sie Observability auf Ihrer Agentenressource aktivieren. Schritte und Einzelheiten finden Sie unter Hinzufügen von Observability zu Ihren Amazon AgentCore Bedrock-Ressourcen. Diese Span-Daten sind in Amazon CloudWatch Logs verfügbar. Spans erscheinen in der Protokollgruppe des Agenten (/aws/bedrock-agentcore/runtimes/<agent_id>-<endpoint_name>) oder in der aws/spans Protokollgruppe für Agenten, die das gemeinsame Span-Ziel verwenden. Weitere Informationen finden Sie unter Span-Ziel für Agenten, die in Amazon Bedrock AgentCore Runtime gehostet werden. Die folgende Tabelle definiert den Vorgang, für den Spans erstellt werden, und die Attribute für jede erfasste Spanne.
| Vorgangsname | Span-Attribute | Description |
|---|---|---|
|
InvokeAgentRuntime |
aws.operation.name, aws.resource.arn, aws.request_id, aws.agent.id, aws.endpoint.name, aws.account.id, session.id, latency_ms, error_type, aws.resource.type, aws.xray.origin, aws.region |
Ruft die Agenten-Laufzeit auf. |
-
aws.operation.name — der Name der Operation () InvokeAgentRuntime
-
aws.resource.arn — der Amazon-Ressourcenname für die Agentenlaufzeit
-
aws.request_id — Anforderungs-ID für den Aufruf
-
aws.agent.id — der eindeutige Bezeichner für die Agenten-Laufzeit
-
aws.endpoint.name — der Name des Endpunkts, der zum Aufrufen der Agenten-Laufzeit verwendet wird
-
aws.account.id — Konto-ID des Kunden
-
session.id — die Sitzungs-ID für den Aufruf
-
latency_ms — die Latenz der Anfrage in Millisekunden
-
error_type — entweder Throttle, System oder User (nur im Fehlerfall vorhanden)
-
aws.resource.type — der CFN-Ressourcentyp
-
aws.xray.origin — der CFN-Ressourcentyp, der von X-ray zur Identifizierung des Dienstes verwendet wird
-
aws.region — die Region, in der die Kundenressource existiert
Daten des Anwendungsprotokolls
AgentCore stellt strukturierte Anwendungsprotokolle bereit, die Ihnen helfen, einen Überblick über die Laufzeitaufrufe Ihrer Agenten und den Ressourcenverbrauch auf Sitzungsebene zu erhalten. Diese Protokolldaten werden bereitgestellt, wenn Sie Observability auf Ihrer Agentenressource aktivieren. Schritte und Einzelheiten finden Sie unter Hinzufügen von Observability zu Ihren Amazon AgentCore Bedrock-Ressourcen. AgentCore kann CloudWatch Protokolle in Logs, Amazon S3 oder Firehose Stream ausgeben. Wenn Sie ein CloudWatch Logs-Ziel verwenden, werden diese Protokolle in den Anwendungsprotokollen Ihres Agenten oder in Ihrer eigenen benutzerdefinierten Protokollgruppe gespeichert.
| Protokolltyp | Protokollfelder | Description |
|---|---|---|
|
APPLICATION_LOGS |
timestamp, resource_arn, event_timestamp, account_id, request_id, session_id, trace_id, span_id, service_name, operation, request_payload, response_payload |
Anwendungsprotokolle für mit InvokeRuntimeOperation Tracing-Feldern, Anforderungs- und Antwort-Payloads |
-
request_payload — die Anforderungs-Payload des Agentenaufrufs
-
response_payload — die Antwort vom Agentenaufruf
Arten von Fehlern
In der folgenden Liste werden die möglichen Fehlertypen für Benutzer-, System- und Drosselungsfehler definiert.
Benutzerfehlercodes
-
InvocationError.Validation- Der Kunde hat eine ungültige Eingabe eingegeben (400) -
InvocationError.ResourceNotFound- Die angeforderte Ressource existiert nicht (404) -
InvocationError.AccessDenied- Dem Client fehlen die Berechtigungen (403) -
InvocationError.Conflict- Ressourcenkonflikt (409)
System-Fehlercodes
-
InvocationError.Internal- Interner Serverfehler (500)
Fehlercodes bei der Drosselung
-
InvocationError.Throttling- Ratenbegrenzung (429) -
InvocationError.ServiceQuota- Service-side quota/limit erreicht (402)