View a markdown version of this page

AgentCore dados de observabilidade de tempo de execução gerados - Amazon Bedrock AgentCore

AgentCore dados de observabilidade de tempo de execução gerados

As métricas de tempo de execução fornecidas pelo AgentCore oferecem visibilidade dos níveis de atividade de execução do agente, da latência de processamento, da utilização de recursos e das taxas de erro. AgentCore também fornece métricas agregadas para o total de invocações e sessões.

Métricas de tempo de execução de observabilidade

A lista a seguir descreve as métricas de tempo de execução fornecidas pelo AgentCore. As métricas de tempo de execução são agrupadas em intervalos de um minuto. Para saber mais sobre a visualização de métricas de tempo de execução, consulte Visualizar dados de observabilidade para seus agentes do Amazon Bedrock AgentCore .

Invocations

Mostra o número total de solicitações feitas à API Data Plane. Cada chamada de API conta como uma invocação, independentemente do tamanho da carga útil da solicitação ou do status da resposta.

Invocações (agregadas)

Mostra o número total de invocações em todos os recursos

Controles de utilização

Exibe o número de solicitações limitadas pelo serviço devido à superação dos limites permitidos de TPS (Transações por Segundo) ou de cota. Essas solicitações retornam ThrottlingException com o código de status HTTP 429. Monitore essa métrica para determinar se você precisa revisar suas cotas de serviço ou otimizar os padrões de solicitação.

Erros do sistema

Mostra o número de erros do servidor encontrados AgentCore durante o processamento da solicitação. Altos níveis de erros no lado do servidor podem indicar possíveis problemas relacionados à infraestrutura ou ao serviço que requerem investigação. Consulte Tipos de erro para obter uma lista de possíveis códigos de erro.

Erros do usuário

Representa o número de erros do lado do cliente resultantes de solicitações inválidas. Eles exigem a ação do usuário para serem resolvidos. Altos níveis de erros do lado do cliente podem indicar problemas com a formatação ou permissões da solicitação que precisam ser resolvidos. Consulte Tipos de erro para obter uma lista de possíveis códigos de erro.

Latência

O tempo total decorrido entre o recebimento da solicitação e o envio do token de resposta final. Representa o tempo completo de processamento de ponta a ponta da solicitação.

Total de erros

O número total de erros do sistema e do usuário. No AgentCore console do Amazon Bedrock, essa métrica exibe o número de erros como uma porcentagem do número total de invocações.

Contagem de sessões

Mostra o número de novas sessões de agentes criadas dentro do período do relatório. Cada sessão é contada uma vez no momento da criação; invocações subsequentes para a mesma sessão não incrementam essa métrica. Esse é um contador cumulativo, não um indicador das sessões atualmente ativas. Útil para monitorar o uso geral da plataforma, tendências nas taxas de criação de sessões e entender os padrões de engajamento do usuário.

Sessões (agregadas)

Mostra o número total de novas sessões criadas em todos os recursos dentro do período do relatório.

ActiveSessionCount

Mostra o número de sessões ativas atualmente em sua conta. Ao contrário da SessionCount métrica (um contador cumulativo), essa métrica é um indicador em tempo real que mostra quantas sessões estão sendo executadas em um determinado momento. O Amazon Bedrock AgentCore publica essa métrica uma vez por minuto por tipo de serviço. Use-o para monitorar a utilização atual da capacidade, definir alarmes para picos de uso inesperados e entender o consumo da cota de sessão. Use a Service dimensão — com valores AgentCore.RuntimeAgentCore.CodeInterpreter, ou AgentCore.Browser — para filtrar essa métrica por tipo de carga de trabalho. O Amazon Bedrock AgentCore publica essa métrica diretamente em sua AWS conta no namespace. AWS/Bedrock-AgentCore

ActiveStreamingConnections

(WebSocket somente) Mostra o número atual de WebSocket conexões ativas por agente. Monitore essa métrica para entender o uso da conexão e detectar quedas ou picos de conexão para o planejamento da capacidade. A única estatística significativa é a soma de 1 minuto.

InboundStreamingBytesProcessed

(WebSocket somente) Exibe o número total de bytes processados com sucesso em WebSocket quadros recebidos de clientes para contêineres de agentes. Use essa métrica para monitorar a taxa de transferência de dados e identificar padrões de uso.

OutboundStreamingBytesProcessed

(WebSocket somente) Mostra o número total de bytes processados com sucesso em WebSocket quadros enviados de contêineres de agentes para clientes. Monitore essa métrica para entender os padrões de resposta do agente e garantir uma transmissão de dados bem-sucedida.

Métricas e registros de uso de recursos

O AgentCore tempo de execução do Amazon Bedrock fornece telemetria abrangente de uso de recursos, incluindo métricas de consumo de CPU e memória para seus recursos de tempo de execução.

nota

Os dados de uso de recursos podem ser atrasados em até 60 minutos e a precisão pode diferir entre as métricas.

Métricas vendidas

O AgentCore tempo de execução do Amazon Bedrock fornece automaticamente métricas de uso de recursos nos níveis de conta, tempo de execução do agente e endpoint do agente. Essas métricas são publicadas com resolução de 1 minuto. A CloudWatch agregação e a retenção de dados métricos da Amazon seguirão as políticas padrão de retenção de CloudWatch dados da Amazon. Para obter mais informações, consulte https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/cloudwatch_concepts.html#Metric.

Aqui estão os conjuntos de dimensões e métricas disponíveis para monitorar seus recursos:

Nome Dimensões Description

CPUUsed-vCPUHours

Serviço; Serviço, recurso; Serviço, recurso, nome

A quantidade total de CPU virtual consumida na CPU-Hours unidade v, disponível nos níveis de recursos e contas. Útil para rastreamento de recursos e visibilidade estimada do faturamento.

MemoryUsed-GBHours

Serviço; Serviço, recurso; Serviço, recurso, nome

A quantidade total de memória consumida na GB-Hours unidade, disponível nos níveis de recursos e contas. Útil para rastreamento de recursos e visibilidade estimada do faturamento.

Explicação da dimensão

  • Serviço - AgentCore.Runtime

  • Recurso - Agent Arn

  • Nome - Nome do endpoint do agente, no formato de AgentName:: EndpointName

As métricas do nível da conta estão disponíveis no Amazon CloudWatch Bedrock AgentCore Observability Console, na guia Runtime. O painel exibe gráficos de uso de memória e CPU gerados a partir dessas métricas, representando o uso total de recursos em todos os agentes da sua conta na região.

As métricas do nível do Agent Endpoint estão disponíveis na AgentEndpoint página do Amazon CloudWatch Bedrock AgentCore Observability Console. O painel exibe gráficos de uso de memória e CPU gerados a partir dessas métricas, representando o uso total de recursos em todas as sessões invocadas pelo Agent Endpoint especificado.

nota

Os dados de telemetria são fornecidos para fins de monitoramento. O faturamento real é calculado com base nos dados de uso medidos e pode diferir dos valores de telemetria devido ao tempo de agregação, aos processos de reconciliação e à precisão da medição. Consulte seu extrato de AWS cobrança para ver as cobranças autorizadas.

Logs fornecidos

O Bedrock AgentCore Runtime fornece registros vendidos para métricas de uso em nível de sessão com granularidade de 1 segundo. Cada registro de log contém dados de consumo de recursos, incluindo uso da CPU (agent.runtime.vcpu.hours.used) e consumo de memória (agent.runtime.memory.gb_hours.used).

Cada registro de log terá o seguinte esquema:

Tipo de log Campos de log Description

LOGS_DE_USO

event_timestamp, resource_arn, service.name, cloud.provider, cloud.region, account.id, região, resource.id, session.id, agent.name, elapsed_time_seconds, agent.runtime.vcpu.hours.used, agent.runtime.memory.gb_hours.used

Registros de uso de recursos para rastreamento de recursos em nível de sessão.

Para habilitar o tipo de log USAGE_LOG para seus agentes, consulte Adicionar observabilidade aos seus recursos do Amazon Bedrock. AgentCore Os registros são então exibidos no destino configurado (AWS LogGroupAmazon S3 ou Amazon Kinesis Firehose) conforme configurado.

Na página de sessão do agente do Amazon CloudWatch Bedrock AgentCore Observability Console, você pode ver as métricas de uso de recursos geradas a partir desses registros. Para otimizar sua experiência de visualização métrica, selecione o intervalo de tempo desejado usando o seletor no canto superior direito para se concentrar em dados específicos de uso da CPU e da memória.

nota

Os dados de telemetria são fornecidos para fins de monitoramento. O faturamento real é calculado com base nos dados de uso medidos e pode diferir dos valores de telemetria devido ao tempo de agregação, aos processos de reconciliação e à precisão da medição. Consulte seu extrato de AWS cobrança para ver as cobranças autorizadas.

Dados de amplitude fornecidos

Para aprimorar a observabilidade, AgentCore fornece extensões estruturadas que fornecem visibilidade das invocações de tempo de execução do agente. Para habilitar esses dados de extensão, você precisa ativar a observabilidade em seu recurso de agente. Consulte Adicionar observabilidade aos seus AgentCore recursos do Amazon Bedrock para ver etapas e detalhes. Esses dados de intervalo estão disponíveis no Amazon CloudWatch Logs. Os intervalos aparecem no grupo de registros do agente (/aws/bedrock-agentcore/runtimes/<agent_id>-<endpoint_name>) ou no grupo de aws/spans registros dos agentes que usam o destino do intervalo compartilhado. Para obter mais informações, consulte Destino do Span para agentes hospedados no tempo de AgentCore execução do Amazon Bedrock. A tabela a seguir define a operação para a qual as extensões são criadas e os atributos de cada extensão capturada.

Nome da operação Atributos de amplitude Description

InvokeAgentRuntime

aws.operation.name, aws.resource.arn, aws.request_id, aws.agent.id, aws.endpoint.name, aws.account.id, session.id, latency_ms, error_type, aws.resource.type, aws.xray.origin, aws.region

Invoca o tempo de execução do agente.

  • aws.operation.name - o nome da operação () InvokeAgentRuntime

  • aws.resource.arn - o nome do recurso da Amazon para o tempo de execução do agente

  • aws.request_id - ID da solicitação para a invocação

  • aws.agent.id - o identificador exclusivo para o tempo de execução do agente

  • aws.endpoint.name - o nome do endpoint usado para invocar o tempo de execução do agente

  • aws.account.id - ID da conta do cliente

  • session.id - o ID da sessão para a invocação

  • latency_ms - a latência da solicitação em milissegundos

  • error_type - acelerador, sistema ou usuário (presente somente em caso de erro)

  • aws.resource.type - o tipo de recurso CFN

  • aws.xray.origin - o tipo de recurso CFN usado pelo x-ray para identificar o serviço

  • aws.region - a região em que o recurso do cliente existe

Dados de registro do aplicativo

AgentCore fornece registros estruturados de aplicativos que ajudam você a obter visibilidade das invocações de tempo de execução do agente e do consumo de recursos em nível de sessão. Esses dados de registro são fornecidos ao ativar a observabilidade em seu recurso de agente. Consulte Adicionar observabilidade aos seus AgentCore recursos do Amazon Bedrock para ver etapas e detalhes. AgentCore pode gerar registros para CloudWatch Logs, Amazon S3 ou Firehose stream. Se você usa um destino de CloudWatch registros, esses registros são armazenados nos registros do aplicativo do seu agente ou no seu próprio grupo de registros personalizado.

Tipo de log Campos de log Description

LOGS_DE_APLICATIVOS

timestamp, resource_arn, event_timestamp, account_id, request_id, session_id, trace_id, span_id, service_name, operação, request_payload, response_payload

Registros de aplicativos InvokeRuntimeOperation com campos de rastreamento, cargas úteis de solicitação e resposta

  • request_payload - a carga útil da solicitação da invocação do agente

  • response_payload - a resposta da invocação do agente

Tipos de erro

A lista a seguir define os possíveis tipos de erro para erros de usuário, sistema e limitação.

Códigos de erro do usuário

  • InvocationError.Validation- Entrada inválida fornecida pelo cliente (400)

  • InvocationError.ResourceNotFound- O recurso solicitado não existe (404)

  • InvocationError.AccessDenied- O cliente não tem permissões (403)

  • InvocationError.Conflict- Conflito de recursos (409)

Códigos de erro do sistema

  • InvocationError.Internal- Erro interno do servidor (500)

Códigos de erro de limitação

  • InvocationError.Throttling- Limitação de taxa (429)

  • InvocationError.ServiceQuota- Service-side quota/limit alcançado (402)