AgentCore dati di osservabilità del gateway generati
Le seguenti sezioni descrivono le metriche, i log e gli intervalli del gateway inviati ad AgentCore Amazon. CloudWatch Queste metriche non sono disponibili nella pagina sull'osservabilità dell'IA CloudWatch generativa. Le metriche del gateway vengono raggruppate a intervalli di un minuto. Per ulteriori informazioni sulla visualizzazione delle metriche del gateway, consulta Visualizza i dati di osservabilità per i tuoi agenti Amazon AgentCore Bedrock.
Nota
Per abilitare i log forniti dal servizio per i AgentCore gateway, devi configurare le risorse necessarie. CloudWatch Per ulteriori informazioni, consulta Enabling observability for AgentCore runtime, memory, gateway, strumenti integrati e risorse di identità.
Metriche fornite
Gateway pubblica le metriche di invocazione e utilizzo su. CloudWatch Puoi visualizzare queste metriche e anche impostare allarmi per avvisarti quando determinate metriche superano le soglie. Per saperne di più, seleziona un argomento:
Argomenti
Parametri di invocazione
Queste metriche forniscono informazioni sulle chiamate, sulle prestazioni e sugli errori delle API.
Per queste metriche, vengono utilizzate le seguenti dimensioni:
-
Operazione: il nome dell'operazione API (ad es. InvokeGateway).
-
Protocollo — Il nome del protocollo (es. MCP).
-
Metodo: rappresenta l'operazione MCP che viene richiamata (es. tools/list).
-
Risorsa: rappresenta l'identificatore della risorsa (ad esempio l'ARN del gateway).
-
Nome: rappresenta il nome dello strumento.
| Metrica | Description | Statistiche | Unità |
|---|---|---|---|
|
Invocazioni |
Il numero totale di richieste effettuate a ciascuna API Data Plane. Ogni chiamata API conta come una chiamata indipendentemente dallo stato della risposta. |
Somma |
Conteggio |
|
Throttles |
Il numero di richieste limitate (codice di stato 429) dal servizio. |
Somma |
Conteggio |
|
SystemErrors |
Il numero di richieste non riuscite con il codice di stato 5xx. |
Somma |
Conteggio |
|
UserErrors |
Il numero di richieste non riuscite con il codice di stato 4xx tranne 429. |
Somma |
Conteggio |
|
Latenza |
Il tempo trascorso tra il momento in cui il servizio riceve la richiesta e l'inizio dell'invio del primo token di risposta. In altre parole, il tempo di risposta iniziale. |
Media, minimo, massimo, p50, p90, p99 |
Millisecondi |
|
Durata |
Il tempo totale trascorso tra la ricezione della richiesta e l'invio del token di risposta finale. Rappresenta il tempo completo di elaborazione end-to-end della richiesta. |
Media, minimo, massimo, p50, p90, p99 |
Millisecondi |
|
TargetExecutionTime |
Il tempo totale impiegato per eseguire la destinazione su Lambda /OpenApi/ ecc. Questo aiuta a determinare il contributo del target alla latenza totale. |
Media, minima, massima, p50, p90, p99 |
Millisecondi |
Parametri di utilizzo
Queste metriche forniscono informazioni su come viene utilizzato il gateway.
| Metrica | Description | Statistiche | Unità |
|---|---|---|---|
|
TargetType |
Il numero totale di richieste servite da ogni tipo di destinazione (MCP, Lambda, OpenAPI). |
Somma |
Conteggio |
Visualizza le metriche del gateway CloudWatch
Per ulteriori informazioni sulla visualizzazione dei CloudWatch parametri, consulta Visualizza i parametri disponibili nella Amazon CloudWatch User Guide. La procedura seguente mostra come visualizzare le metriche per i tuoi gateway:
Per visualizzare le metriche del gateway nella console
-
Apri la CloudWatch console all'indirizzo https://console.aws.amazon.com/cloudwatch/
. -
Nel riquadro di navigazione a sinistra, scegli Tutte le metriche nella sezione Metriche.
-
In Sfoglia, dal menu a discesa che mostra la AWS regione corrente, seleziona la regione per la quale desideri le metriche.
-
Scegli il namespace AWS/Bedrock-AgentCore.
-
Scegli una dimensione (es. Funzionamento) o combinazione di dimensioni (es. Metodo, operazione, protocollo) per visualizzare le relative metriche.
-
Per aggiungere una metrica al CloudWatch grafico, seleziona la casella di controllo accanto ad essa.
Configurazione degli allarmi CloudWatch
Puoi utilizzare l'operazione PutMetricAlarmAPI per impostare CloudWatch allarmi per avvisarti quando determinate metriche superano le soglie. Ad esempio, potresti voler ricevere una notifica quando il tasso di errore supera il 5% o quando la latenza supera 1 secondo.
L'esempio seguente mostra come creare un allarme per tassi di errore elevati utilizzando la AWS CLI:
aws cloudwatch put-metric-alarm \ --alarm-name "HighErrorRate" \ --alarm-description "Alarm when error rate exceeds 5%" \ --metric-name "SystemErrors" \ --namespace "AWS/Bedrock-AgentCore" \ --statistic "Sum" \ --dimensions "Name=Resource,Value=my-gateway-arn" \ --period 300 \ --evaluation-periods 1 \ --threshold 5 \ --comparison-operator "GreaterThanThreshold" \ --alarm-actions "arn:aws:sns:us-west-2:123456789012:my-topic"
Questo allarme si attiva quando il numero di errori di sistema supera i 5 in un periodo di 5 minuti. Quando l'allarme si attiva, invierà una notifica all'argomento SNS specificato.
Dati di registro forniti
AgentCore fornisce registri che consentono di monitorare e risolvere i principali processi relativi alle risorse del AgentCore gateway. Per abilitare questi dati di registro, è necessario creare una destinazione di registro.
AgentCore può inviare i log allo stream CloudWatch Logs, Amazon S3 o Firehose. Se si utilizza una destinazione CloudWatch Logs, questi log vengono archiviati nel gruppo di log predefinito /aws/vendedlogs/bedrock-agentcore/gateway/APPLICATION_LOGS/{gateway_id} o in un gruppo di log personalizzato che inizia con. /aws/vendedlogs/ Per ulteriori informazioni, consulta Enabling observability for AgentCore runtime, memory, gateway, strumenti integrati e risorse di identità.
AgentCore registra le seguenti informazioni per le risorse del gateway:
-
Avvio e completamento dell'elaborazione delle richieste del gateway
-
Messaggi di errore per le configurazioni di Target
-
Richieste MCP con intestazioni di autorizzazione mancanti o errate
-
Richieste MCP con parametri di richiesta errati (strumenti, metodo)
È inoltre possibile visualizzare i corpi delle richieste e delle risposte come parte dell'integrazione con Vend Logs quando una qualsiasi delle operazioni MCP viene eseguita sul Gateway. Possono eseguire ulteriori analisi su questi log, utilizzando i trace_id campi span_id and per collegare gli span vended e i log emessi. Per ulteriori informazioni sulla crittografia dei gateway con chiavi KMS gestite dal cliente, consulta Caratteristiche e argomenti avanzati per Amazon Bedrock Gateway. AgentCore
Registro di esempio:
{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370851622, "body": { "isError": false, "log": "Started processing request with requestId: 1", "requestBody": "{id=1, jsonrpc=2.0, method=tools/call, params={name=target-quick-start-f9scus___LocationTool, arguments={location=seattle}}}", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }
Registro di esempio con corpo della risposta:
{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370853807, "body": { "isError": false, "responseBody": "{jsonrpc=2.0, id=1, result={isError=false, content=[{type=text, text=\"good\"}]}}", "log": "Successfully processed request with requestId: 2", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }
Intervalli forniti
AgentCore supporta gli intervalli di vendita conformi a OTEL che è possibile utilizzare per tenere traccia delle invocazioni tra le diverse primitive utilizzate.
Esempi di intervalli di vendita per Tool Invocation:
-
kind:SERVER- tiene traccia dei dettagli complessivi dell'esecuzione, dello strumento richiamato, dei dettagli del gateway, dell'ID della AWS richiesta, dell'ID di traccia e dello span. -
kind:CLIENT- copre l'obiettivo specifico che è stato richiamato e i relativi dettagli come il tipo di target, il tempo di esecuzione del target, gli orari di inizio e fine dell'esecuzione del target, ecc.
Per altre chiamate al metodo MCP, viene emesso solo lo kind:SERVER span.
Sebbene questi intervalli emettano parametri, per capire perché si è verificato un errore per un intervallo specifico, un utente del Gateway deve controllare i log forniti. Vari campi, ad esempio, aws.request.id possono aiutare a spanId unire questi intervalli e registri.
| Operation | Attributi Span | Description |
|---|---|---|
|
Elenca strumenti |
aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overhead_latency_ms |
Elenca gli strumenti collegati a un gateway |
|
Strumento di chiamata |
aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overhead_latency_ms, nome.strumento |
Chiama uno strumento specifico. Vengono emesse due campate: 1. |
|
Strumenti di ricerca |
aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overhead_latency_ms, nome.strumento |
Cerca i dieci strumenti più pertinenti in base a una query di input |