View a markdown version of this page

AgentCore dati di osservabilità in fase di esecuzione generati - Amazon Bedrock AgentCore

AgentCore dati di osservabilità in fase di esecuzione generati

Le metriche di runtime fornite da AgentCore offrono visibilità sui livelli di attività di esecuzione degli agenti, sulla latenza di elaborazione, sull'utilizzo delle risorse e sui tassi di errore. AgentCore fornisce anche metriche aggregate per le chiamate e le sessioni totali.

Metriche di osservabilità e runtime

L'elenco seguente descrive le metriche di runtime fornite da. AgentCore Le metriche di runtime vengono raggruppate a intervalli di un minuto. Per ulteriori informazioni sulla visualizzazione delle metriche di runtime, consulta Visualizzare i dati di osservabilità per i tuoi agenti Amazon AgentCore Bedrock.

Invocazioni

Mostra il numero totale di richieste effettuate all'API Data Plane. Ogni chiamata API conta come un'unica chiamata, indipendentemente dalla dimensione del payload della richiesta o dallo stato della risposta.

Invocazioni (aggregate)

Mostra il numero totale di chiamate su tutte le risorse

Throttles

Visualizza il numero di richieste limitate dal servizio a causa del superamento dei limiti di quota o TPS (Transactions Per Second) consentiti. Queste richieste restituiscono il codice di stato HTTP ThrottlingException 429. Monitora questa metrica per determinare se è necessario rivedere le quote di servizio o ottimizzare i modelli di richiesta.

Errori di sistema

Mostra il numero di errori sul lato server riscontrati AgentCore durante l'elaborazione della richiesta. Livelli elevati di errori sul lato server possono indicare potenziali problemi di infrastruttura o di servizio che richiedono un'indagine. Vedi Tipi di errore per un elenco dei possibili codici di errore.

Errori dell'utente

Rappresenta il numero di errori sul lato client derivanti da richieste non valide. Questi richiedono l'intervento dell'utente per essere risolti. Livelli elevati di errori sul lato client possono indicare problemi relativi alla formattazione delle richieste o alle autorizzazioni che devono essere risolti. Vedi Tipi di errore per un elenco dei possibili codici di errore.

Latenza

Il tempo totale trascorso tra la ricezione della richiesta e l'invio del token di risposta finale. Rappresenta il tempo completo di elaborazione end-to-end della richiesta.

Totale errori

Il numero totale di errori di sistema e dell'utente. Nella AgentCore console Amazon Bedrock, questa metrica mostra il numero di errori come percentuale del numero totale di chiamate.

Numero di sessioni

Mostra il numero di nuove sessioni di agenti create nel periodo di riferimento. Ogni sessione viene contata una volta al momento della creazione; le chiamate successive alla stessa sessione non incrementano questa metrica. Si tratta di un contatore cumulativo, non di un indicatore delle sessioni attualmente attive. Utile per monitorare l'utilizzo complessivo della piattaforma, tracciare i tassi di creazione delle sessioni e comprendere i modelli di coinvolgimento degli utenti.

Sessioni (aggregate)

Mostra il numero totale di nuove sessioni create tra tutte le risorse nel periodo di riferimento.

ActiveSessionCount

Mostra il numero di sessioni attualmente attive per il tuo account. A differenza della SessionCount metrica (un contatore cumulativo), questa metrica è un indicatore in tempo reale che mostra quante sessioni sono in corso in un dato momento. Amazon Bedrock AgentCore pubblica questa metrica una volta al minuto per tipo di servizio. Usalo per monitorare l'attuale utilizzo della capacità, impostare allarmi in caso di picchi di utilizzo imprevisti e comprendere il consumo della quota di sessione. Usa la Service dimensione, con valori o AgentCore.Runtime AgentCore.CodeInterpreterAgentCore.Browser, per filtrare questa metrica per tipo di carico di lavoro. Amazon Bedrock AgentCore pubblica questa metrica direttamente nel tuo AWS account nel namespace. AWS/Bedrock-AgentCore

ActiveStreamingConnections

(WebSocket solo) Mostra il numero attuale di connessioni attive per agente. WebSocket Monitora questa metrica per comprendere l'utilizzo della connessione e rilevare interruzioni o picchi di connessione per la pianificazione della capacità. L'unica statistica significativa è una somma di 1 minuto.

InboundStreamingBytesProcessed

(WebSocket solo) Visualizza il numero totale di byte elaborati con successo nei WebSocket frame ricevuti dai client ai contenitori degli agenti. Utilizzate questa metrica per monitorare la velocità di trasmissione dei dati e identificare i modelli di utilizzo.

OutboundStreamingBytesProcessed

(WebSocket solo) Mostra il numero totale di byte elaborati con successo nei WebSocket frame inviati dai contenitori degli agenti ai client. Monitora questa metrica per comprendere i modelli di risposta degli agenti e garantire la corretta trasmissione dei dati.

Metriche e log sull'utilizzo delle risorse

Il AgentCore runtime di Amazon Bedrock fornisce una telemetria completa sull'utilizzo delle risorse, inclusi i parametri di consumo di CPU e memoria per le risorse di runtime.

Nota

I dati sull'utilizzo delle risorse possono subire ritardi fino a 60 minuti e la precisione potrebbe variare a seconda dei parametri.

Metriche vendute

Il AgentCore runtime di Amazon Bedrock fornisce automaticamente i parametri di utilizzo delle risorse a livello di account, runtime dell'agente ed endpoint dell'agente. Questi parametri sono pubblicati con una risoluzione di 1 minuto. CloudWatch L'aggregazione e la conservazione dei dati metrici di Amazon seguiranno le politiche standard di conservazione CloudWatch dei dati di Amazon. Per ulteriori informazioni, consulta #Metric. https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/cloudwatch_concepts.html

Ecco i set di dimensioni e le metriche disponibili per il monitoraggio delle risorse:

Nome Dimensioni Description

CPUUsed-vCPUHours

Servizio; Servizio, risorsa; Servizio, risorsa, nome

La quantità totale di CPU virtuale consumata nell'CPU-Hours unità v, disponibile a livello di risorsa e account. Utile per il monitoraggio delle risorse e la visibilità stimata della fatturazione.

MemoryUsed-GBHours

Servizio; Servizio, risorsa; Servizio, risorsa, nome

La quantità totale di memoria consumata in GB-Hours unità, disponibile a livello di risorsa e account. Utile per il monitoraggio delle risorse e la visibilità stimata della fatturazione.

Spiegazione delle dimensioni

  • Servizio - AgentCore.Runtime

  • Risorsa: Agent Arn

  • Nome: nome dell'endpoint dell'agente, nel formato: AgentName EndpointName

Le metriche a livello di account sono disponibili in Amazon CloudWatch Bedrock AgentCore Observability Console nella scheda Runtime. La dashboard mostra i grafici sull'utilizzo della memoria e della CPU generati da queste metriche, che rappresentano l'utilizzo totale delle risorse tra tutti gli agenti del tuo account all'interno della regione.

Le metriche a livello di Agent Endpoint sono disponibili nella AgentEndpoint pagina di Amazon CloudWatch Bedrock AgentCore Observability Console. La dashboard mostra i grafici sull'utilizzo della memoria e della CPU generati da queste metriche, che rappresentano l'utilizzo totale delle risorse in tutte le sessioni richiamate dall'Agent Endpoint specificato.

Nota

I dati di telemetria vengono forniti a scopo di monitoraggio. La fatturazione effettiva viene calcolata sulla base dei dati di utilizzo misurati e può differire dai valori di telemetria a causa dei tempi di aggregazione, dei processi di riconciliazione e della precisione di misurazione. Fai riferimento alla tua dichiarazione di fatturazione per gli addebiti autorevoli. AWS

Registri venduti

Bedrock AgentCore Runtime fornisce log forniti per le metriche di utilizzo a livello di sessione con una granularità di 1 secondo. Ogni record di registro contiene dati sul consumo di risorse, tra cui l'utilizzo della CPU (agent.runtime.vcpu.hours.used) e il consumo di memoria (agent.runtime.memory.gb_hours.used).

Ogni record di registro avrà il seguente schema:

Tipo di log Campi di log Description

USAGE_LOGS

event_timestamp, resource_arn, service.name, cloud.provider, cloud.region, account.id, region, resource.id, session.id, agent.name, elapsed_time_seconds, agent.runtime.vcpu.hours.used, agent.runtime.memory.gb_hours.used, agent.runtime.memory.gb_hours.used

Registri di utilizzo delle risorse per il monitoraggio delle risorse a livello di sessione.

Per abilitare il tipo di log USAGE_LOG per i tuoi agenti, consulta Aggiungere osservabilità alle tue risorse Amazon Bedrock. AgentCore I log vengono quindi visualizzati nella destinazione configurata (AWS LogGroupAmazon S3 o Amazon Kinesis Firehose) come configurata.

Nella pagina Agent Session di Amazon CloudWatch Bedrock AgentCore Observability Console, puoi vedere i parametri di utilizzo delle risorse generati da questi log. Per ottimizzare l'esperienza di visualizzazione delle metriche, seleziona l'intervallo di tempo desiderato utilizzando il selettore in alto a destra per concentrarti su dati specifici sull'utilizzo della CPU e della memoria.

Nota

I dati di telemetria vengono forniti a scopo di monitoraggio. La fatturazione effettiva viene calcolata sulla base dei dati di utilizzo misurati e può differire dai valori di telemetria a causa dei tempi di aggregazione, dei processi di riconciliazione e della precisione di misurazione. Fai riferimento alla tua dichiarazione di fatturazione per gli addebiti autorevoli. AWS

Dati di ampiezza forniti

Per migliorare l'osservabilità, AgentCore fornisce intervalli strutturati che forniscono visibilità sulle chiamate in fase di esecuzione degli agenti. Per abilitare questi dati di estensione, è necessario abilitare l'osservabilità sulla risorsa dell'agente. Per istruzioni e dettagli, consulta Aggiungere osservabilità alle AgentCore risorse Amazon Bedrock. Questi dati di estensione sono disponibili in Amazon CloudWatch Logs. Gli intervalli vengono visualizzati nel gruppo di log dell'agente (/aws/bedrock-agentcore/runtimes/<agent_id>-<endpoint_name>) o nel gruppo di aws/spans log per gli agenti che utilizzano la destinazione span condivisa. Per ulteriori informazioni, consulta Span destination for agent ospitati nel runtime di Amazon Bedrock AgentCore . La tabella seguente definisce l'operazione per cui vengono creati gli span e gli attributi per ogni intervallo acquisito.

Nome operazione Attributi Span Description

InvokeAgentRuntime

aws.operation.name, aws.resource.arn, aws.request_id, aws.agent.id, aws.endpoint.name, aws.account.id, session.id, latency_ms, error_type, aws.resource.type, aws.xray.origin, aws.region

Richiama il runtime dell'agente.

  • aws.operation.name - il nome dell'operazione () InvokeAgentRuntime

  • aws.resource.arn: il nome della risorsa Amazon per il runtime dell'agente

  • aws.request_id - ID di richiesta per la chiamata

  • aws.agent.id: l'identificatore univoco per il runtime dell'agente

  • aws.endpoint.name: il nome dell'endpoint utilizzato per richiamare il runtime dell'agente

  • aws.account.id - ID dell'account del cliente

  • session.id: l'ID di sessione per la chiamata

  • latency_ms: la latenza della richiesta in millisecondi

  • error_type: acceleratore, sistema o utente (presente solo in caso di errore)

  • aws.resource.type: il tipo di risorsa CFN

  • aws.xray.origin: il tipo di risorsa CFN utilizzato da x-ray per identificare il servizio

  • aws.region: la regione in cui esiste la risorsa del cliente

Dati del registro dell'applicazione

AgentCore fornisce registri delle applicazioni strutturati che consentono di ottenere visibilità sulle chiamate in fase di esecuzione degli agenti e sul consumo di risorse a livello di sessione. Questi dati di registro vengono forniti quando si abilita l'osservabilità sulla risorsa dell'agente. Per istruzioni e dettagli, consulta Aggiungere osservabilità alle AgentCore risorse Amazon Bedrock. AgentCore può inviare i log allo stream CloudWatch Logs, Amazon S3 o Firehose. Se utilizzi una destinazione CloudWatch Logs, questi log vengono archiviati nei log delle applicazioni del tuo agente o nel tuo gruppo di log personalizzato.

Tipo di log Campi di log Description

APPLICATION_LOGS

timestamp, resource_arn, event_timestamp, account_id, request_id, session_id, trace_id, span_id, nome_servizio, operazione, request_payload, response_payload

Registri delle applicazioni InvokeRuntimeOperation con campi di tracciamento, payload di richieste e risposte

  • request_payload: il payload della richiesta di invocazione dell'agente

  • response_payload - la risposta dall'invocazione dell'agente

Tipi di errore

L'elenco seguente definisce i possibili tipi di errore per gli utenti, il sistema e gli errori di limitazione.

Codici di errore utente

  • InvocationError.Validation- Il client ha fornito un input non valido (400)

  • InvocationError.ResourceNotFound- La risorsa richiesta non esiste (404)

  • InvocationError.AccessDenied- Il client non ha le autorizzazioni (403)

  • InvocationError.Conflict- Conflitto di risorse (409)

Codici di errore di sistema

  • InvocationError.Internal- Errore interno del server (500)

Codici di errore di limitazione

  • InvocationError.Throttling- Limitazione della velocità (429)

  • InvocationError.ServiceQuota- Service-side quota/limit raggiunto (402)