Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
AgentCore dati di osservabilità in fase di esecuzione generati
Le metriche di runtime fornite da AgentCore offrono visibilità sui livelli di attività di esecuzione degli agenti, sulla latenza di elaborazione, sull'utilizzo delle risorse e sui tassi di errore. AgentCore fornisce anche metriche aggregate per il totale delle chiamate e delle sessioni.
Argomenti
Metriche di osservabilità in fase di esecuzione
L'elenco seguente descrive le metriche di runtime fornite da. AgentCore Le metriche di runtime vengono raggruppate in batch a intervalli di un minuto. Per ulteriori informazioni sulla visualizzazione delle metriche di runtime, consulta Visualizzare i dati di osservabilità per i tuoi agenti Amazon Bedrock. AgentCore
- Invocazioni
-
Mostra il numero totale di richieste effettuate all'API Data Plane. Ogni chiamata API conta come una chiamata, indipendentemente dalla dimensione del payload della richiesta o dallo stato della risposta.
- Chiamate (aggregate)
-
Mostra il numero totale di invocazioni su tutte le risorse
- Throttles
-
Visualizza il numero di richieste limitate dal servizio a causa del superamento dei limiti TPS (Transactions Per Second) o di quota consentiti. Queste richieste vengono restituite ThrottlingException con il codice di stato HTTP 429. Monitora questa metrica per determinare se devi rivedere le quote di servizio o ottimizzare i modelli di richiesta.
- Errori di sistema
-
Mostra il numero di errori sul lato server riscontrati AgentCore durante l'elaborazione della richiesta. Livelli elevati di errori sul lato server possono indicare potenziali problemi di infrastruttura o di servizio che richiedono un'indagine. Per un elenco dei possibili codici di errore, consulta Tipi di errore.
- Errori dell'utente
-
Rappresenta il numero di errori sul lato client derivanti da richieste non valide. La risoluzione di questi problemi richiede l'intervento dell'utente. Livelli elevati di errori sul lato client possono indicare problemi relativi alla formattazione delle richieste o alle autorizzazioni che devono essere risolti. Vedi Tipi di errore per un elenco dei possibili codici di errore.
- Latenza
-
Il tempo totale trascorso tra la ricezione della richiesta e l'invio del token di risposta finale. Rappresenta il tempo completo di elaborazione end-to-end della richiesta.
- Totale errori
-
Il numero totale di errori di sistema e utente. Nella AgentCore console Amazon Bedrock, questa metrica mostra il numero di errori come percentuale del numero totale di chiamate.
- Numero di sessioni
-
Mostra il numero di nuove sessioni di agenti create nel periodo di riferimento. Ogni sessione viene conteggiata una volta al momento della creazione; le successive chiamate alla stessa sessione non incrementano questa metrica. Si tratta di un contatore cumulativo, non di un indicatore delle sessioni attualmente attive. Utile per monitorare l'utilizzo complessivo della piattaforma, tracciare l'andamento dei tassi di creazione delle sessioni e comprendere i modelli di coinvolgimento degli utenti.
- Sessioni (aggregate)
-
Mostra il numero totale di nuove sessioni create su tutte le risorse nel periodo di riferimento.
- ActiveSessionCount
-
Mostra il numero di sessioni attualmente attive per il tuo account. A differenza della
SessionCountmetrica (un contatore cumulativo), questa metrica è un indicatore in tempo reale che mostra quante sessioni sono in corso in un dato momento. Amazon Bedrock AgentCore pubblica questa metrica una volta al minuto per tipo di servizio. Usalo per monitorare l'attuale utilizzo della capacità, impostare allarmi in caso di picchi di utilizzo imprevisti e comprendere il consumo della quota di sessione. Usa laServicedimensione, con valoriAgentCore.Runtime, oAgentCore.CodeInterpreterAgentCore.Browser, per filtrare questa metrica in base al tipo di carico di lavoro. Amazon Bedrock AgentCore pubblica questa metrica direttamente nel tuo AWS account nel namespace.AWS/Bedrock-AgentCore - ActiveStreamingConnections
-
(WebSocket solo) Mostra il numero attuale di connessioni attive per agente. WebSocket Monitora questa metrica per comprendere l'utilizzo della connessione e rilevare cali o picchi di connessione per la pianificazione della capacità. L'unica statistica significativa è una somma di 1 minuto.
- InboundStreamingBytesProcessed
-
(WebSocket solo) Visualizza il numero totale di byte elaborati correttamente nei WebSocket frame ricevuti dai client ai contenitori degli agenti. Utilizza questa metrica per monitorare la velocità di trasmissione dei dati e identificare i modelli di utilizzo.
- OutboundStreamingBytesProcessed
-
(WebSocket solo) Mostra il numero totale di byte elaborati correttamente nei WebSocket frame inviati dai contenitori degli agenti ai client. Monitora questa metrica per comprendere i modelli di risposta degli agenti e garantire una trasmissione dei dati corretta.
Metriche e registri sull'utilizzo delle risorse
Il AgentCore runtime di Amazon Bedrock fornisce una telemetria completa sull'utilizzo delle risorse, incluse le metriche di consumo di CPU e memoria per le risorse di runtime.
Nota
I dati sull'utilizzo delle risorse possono subire ritardi fino a 60 minuti e la precisione può variare a seconda delle metriche.
Metriche vendute
Il AgentCore runtime di Amazon Bedrock fornisce automaticamente metriche sull'utilizzo delle risorse a livello di account, runtime dell'agente ed endpoint dell'agente. Queste metriche vengono pubblicate con una risoluzione di 1 minuto. CloudWatch L'aggregazione e la conservazione dei dati metrici di Amazon seguiranno le politiche standard di conservazione dei dati di Amazon CloudWatch . Per ulteriori informazioni, consulta #Metric. https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/cloudwatch_concepts.html
Ecco i set di dimensioni e le metriche disponibili per il monitoraggio delle risorse:
| Nome | Dimensioni | Description |
|---|---|---|
|
CPUUsed-vCPUHours |
Servizio; Servizio, risorsa; Servizio, risorsa, nome |
La quantità totale di CPU virtuale consumata in v CPU-Hours unit, disponibile a livello di risorsa e account. Utile per il monitoraggio delle risorse e la visibilità stimata della fatturazione. |
|
MemoryUsed-GBHours |
Servizio; Servizio, risorsa; Servizio, risorsa, nome |
La quantità totale di memoria consumata in GB-Hours unità, disponibile a livello di risorsa e account. Utile per il monitoraggio delle risorse e la visibilità stimata della fatturazione. |
Spiegazione delle dimensioni
-
Servizio - AgentCore.Runtime
-
Risorsa - Agente Arn
-
Nome - Nome dell'endpoint dell'agente, nel formato: AgentName EndpointName
Le metriche a livello di account sono disponibili nella console di Amazon CloudWatch Bedrock AgentCore Observability nella scheda Runtime. La dashboard mostra i grafici sull'utilizzo della memoria e della CPU generati da queste metriche, che rappresentano l'utilizzo totale delle risorse tra tutti gli agenti del tuo account all'interno della regione.
Le metriche a livello di agente endpoint sono disponibili nella AgentEndpoint pagina di Amazon CloudWatch Bedrock Observability Console. AgentCore La dashboard mostra i grafici sull'utilizzo della memoria e della CPU generati da queste metriche, che rappresentano l'utilizzo totale delle risorse in tutte le sessioni richiamate dall'Agent Endpoint specificato.
Nota
I dati di telemetria vengono forniti a scopo di monitoraggio. La fatturazione effettiva viene calcolata in base ai dati di utilizzo misurati e può differire dai valori di telemetria a causa dei tempi di aggregazione, dei processi di riconciliazione e della precisione delle misurazioni. Fai riferimento al tuo estratto conto per gli addebiti autorevoli. AWS
Registri venduti
Bedrock AgentCore Runtime fornisce log venduti per le metriche di utilizzo a livello di sessione con una granularità di 1 secondo. Ogni record di registro contiene dati sul consumo di risorse, tra cui l'utilizzo della CPU (agent.runtime.vcpu.hours.used) e il consumo di memoria (agent.runtime.memory.gb_hours.used).
Ogni record di registro avrà il seguente schema:
| Tipo di log | Campi di log | Description |
|---|---|---|
|
USAGE_LOGS |
event_timestamp, resource_arn, service.name, cloud.provider, cloud.region, account.id, region, resource.id, session.id, agent.name, elapsed_time_seconds, agent.runtime.vcpu.hours.used, agent.runtime.memory.gb_hours.used, agent.runtime.memory.gb_hours.used |
Registri di utilizzo delle risorse per il monitoraggio delle risorse a livello di sessione. |
Per abilitare il tipo di registro USAGE_LOG per i tuoi agenti, consulta Aggiungi osservabilità alle tue risorse Amazon Bedrock. AgentCore I log vengono quindi visualizzati nella destinazione configurata (Amazon S3 o Amazon Kinesis AWS LogGroup Firehose) così come configurata.
Nella pagina Agent Session della Amazon CloudWatch Bedrock AgentCore Observability Console, puoi visualizzare le metriche sull'utilizzo delle risorse generate da questi log. Per ottimizzare l'esperienza di visualizzazione delle metriche, seleziona l'intervallo di tempo desiderato utilizzando il selettore in alto a destra per concentrarti su dati specifici di CPU e utilizzo della memoria.
Nota
I dati di telemetria vengono forniti a scopo di monitoraggio. La fatturazione effettiva viene calcolata in base ai dati di utilizzo misurati e può differire dai valori di telemetria a causa dei tempi di aggregazione, dei processi di riconciliazione e della precisione delle misurazioni. Fai riferimento al tuo estratto conto per gli addebiti autorevoli. AWS
Dati di intervallo forniti
Per migliorare l'osservabilità, AgentCore fornisce intervalli strutturati che forniscono visibilità sulle chiamate di runtime degli agenti. Per abilitare questi dati di intervallo, è necessario abilitare l'osservabilità sulla risorsa dell'agente. Consulta Aggiungere l'osservabilità alle tue AgentCore risorse Amazon Bedrock per passaggi e dettagli. Questi dati di intervallo sono disponibili in Amazon Logs. CloudWatch Gli intervalli vengono visualizzati nel gruppo di log dell'agente (/aws/bedrock-agentcore/runtimes/<agent_id>-<endpoint_name>) o nel gruppo di aws/spans log per gli agenti che utilizzano la destinazione condivisa dello span. Per ulteriori informazioni, consulta Span destination per gli agenti ospitati nel runtime di Amazon Bedrock. AgentCore La tabella seguente definisce l'operazione per la quale vengono creati gli intervalli e gli attributi per ogni intervallo acquisito.
| Nome operazione | Attributi Span | Description |
|---|---|---|
|
InvokeAgentRuntime |
aws.operation.name, aws.resource.arn, aws.request_id, aws.agent.id, aws.endpoint.name, aws.account.id, session.id, latency_ms, error_type, aws.resource.type, aws.xray.origin, aws.region |
Richiama il runtime dell'agente. |
-
aws.operation.name - il nome dell'operazione () InvokeAgentRuntime
-
aws.resource.arn: il nome della risorsa Amazon per il runtime dell'agente
-
aws.request_id - ID della richiesta per l'invocazione
-
aws.agent.id: l'identificatore univoco per il runtime dell'agente
-
aws.endpoint.name - il nome dell'endpoint utilizzato per richiamare il runtime dell'agente
-
aws.account.id - ID dell'account del cliente
-
session.id: l'ID della sessione per l'invocazione
-
latency_ms: la latenza della richiesta in millisecondi
-
error_type: acceleratore, sistema o utente (presente solo in caso di errore)
-
aws.resource.type - il tipo di risorsa CFN
-
aws.xray.origin: il tipo di risorsa CFN utilizzato da x-ray per identificare il servizio
-
aws.region: la regione in cui esiste la risorsa cliente
Dati di registro dell'applicazione
AgentCore fornisce registri strutturati delle applicazioni che consentono di ottenere visibilità sulle chiamate di runtime degli agenti e sul consumo di risorse a livello di sessione. Questi dati di registro vengono forniti quando si abilita l'osservabilità sulla risorsa dell'agente. Consulta Aggiungere l'osservabilità alle tue AgentCore risorse Amazon Bedrock per passaggi e dettagli. AgentCore può inviare CloudWatch log su Logs, Amazon S3 o Firehose stream. Se utilizzi una destinazione CloudWatch Logs, questi log vengono archiviati nei log dell'applicazione del tuo agente o nel tuo gruppo di log personalizzato.
| Tipo di log | Campi di log | Description |
|---|---|---|
|
APPLICATION_LOGS |
timestamp, resource_arn, event_timestamp, account_id, request_id, session_id, trace_id, span_id, service_name, operation, request_payload, response_payload |
Registri delle applicazioni InvokeRuntimeOperation con campi di tracciamento e payload di richiesta e risposta |
-
request_payload: il payload della richiesta della chiamata dell'agente
-
response_payload: la risposta dalla chiamata dell'agente
Tipi di errore
L'elenco seguente definisce i possibili tipi di errore relativi agli utenti, al sistema e alle limitazioni.
Codici di errore utente
-
InvocationError.Validation- Il client ha fornito un input non valido (400) -
InvocationError.ResourceNotFound- La risorsa richiesta non esiste (404) -
InvocationError.AccessDenied- Il cliente non dispone delle autorizzazioni (403) -
InvocationError.Conflict- Conflitto di risorse (409)
Codici di errore di sistema
-
InvocationError.Internal- Errore interno del server (500)
Codici di errore di limitazione
-
InvocationError.Throttling- Limitazione della velocità (429) -
InvocationError.ServiceQuota- Service-side quota/limit raggiunto (402)