As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
AgentCore dados de observabilidade de tempo de execução gerados
As métricas de tempo de execução fornecidas pelo AgentCore oferecem visibilidade dos níveis de atividade de execução do agente, da latência de processamento, da utilização de recursos e das taxas de erro. AgentCore também fornece métricas agregadas para o total de invocações e sessões.
Tópicos
Métricas de tempo de execução de observabilidade
A lista a seguir descreve as métricas de tempo de execução fornecidas pelo AgentCore. As métricas de tempo de execução são agrupadas em intervalos de um minuto. Para saber mais sobre a visualização de métricas de tempo de execução, consulte Visualizar dados de observabilidade para seus agentes do Amazon Bedrock AgentCore .
- Invocations
-
Mostra o número total de solicitações feitas à API Data Plane. Cada chamada de API conta como uma invocação, independentemente do tamanho da carga útil da solicitação ou do status da resposta.
- Invocações (agregadas)
-
Mostra o número total de invocações em todos os recursos
- Controles de utilização
-
Exibe o número de solicitações limitadas pelo serviço devido ao excesso dos limites permitidos de TPS (transações por segundo) ou cota. Essas solicitações retornam ThrottlingException com o código de status HTTP 429. Monitore essa métrica para determinar se você precisa revisar suas cotas de serviço ou otimizar os padrões de solicitação.
- Erros do sistema
-
Mostra o número de erros do lado do servidor encontrados AgentCore durante o processamento da solicitação. Altos níveis de erros no lado do servidor podem indicar possíveis problemas relacionados à infraestrutura ou ao serviço que requerem investigação. Consulte Tipos de erro para obter uma lista de possíveis códigos de erro.
- Erros do usuário
-
Representa o número de erros do lado do cliente resultantes de solicitações inválidas. Eles exigem ação do usuário para serem resolvidos. Altos níveis de erros do lado do cliente podem indicar problemas com a formatação de solicitações ou permissões que precisam ser resolvidos. Consulte Tipos de erro para obter uma lista de possíveis códigos de erro.
- Latência
-
O tempo total decorrido entre o recebimento da solicitação e o envio do token de resposta final. Representa o tempo completo de processamento de ponta a ponta da solicitação.
- Total de erros
-
O número total de erros do sistema e do usuário. No AgentCore console Amazon Bedrock, essa métrica exibe o número de erros como uma porcentagem do número total de invocações.
- Contagem de sessões
-
Mostra o número de novas sessões de agentes criadas no período do relatório. Cada sessão é contada uma vez no momento da criação; invocações subsequentes para a mesma sessão não incrementam essa métrica. Esse é um contador cumulativo, não um indicador das sessões ativas no momento. Útil para monitorar o uso geral da plataforma, avaliar as taxas de criação de sessões e entender os padrões de engajamento do usuário.
- Sessões (agregadas)
-
Mostra o número total de novas sessões criadas em todos os recursos dentro do período do relatório.
- ActiveSessionCount
-
Mostra o número de sessões ativas atualmente em sua conta. Diferentemente da
SessionCountmétrica (um contador cumulativo), essa métrica é um indicador em tempo real que mostra quantas sessões estão sendo executadas em um determinado momento. A Amazon Bedrock AgentCore publica essa métrica uma vez por minuto por tipo de serviço. Use-o para monitorar a utilização da capacidade atual, definir alarmes para picos inesperados de uso e entender o consumo de sua cota de sessão. Use aServicedimensão — com valoresAgentCore.Runtime,AgentCore.CodeInterpreter, ouAgentCore.Browser— para filtrar essa métrica por tipo de carga de trabalho. O Amazon Bedrock AgentCore publica essa métrica diretamente em sua AWS conta no namespace.AWS/Bedrock-AgentCore - ActiveStreamingConnections
-
(WebSocket somente) Mostra o número atual de WebSocket conexões ativas por agente. Monitore essa métrica para entender o uso da conexão e detectar quedas ou picos de conexão para o planejamento da capacidade. A única estatística significativa é a soma de 1 minuto.
- InboundStreamingBytesProcessed
-
(WebSocket somente) Exibe o número total de bytes processados com sucesso em WebSocket quadros recebidos de clientes para contêineres de agentes. Use essa métrica para monitorar a taxa de transferência de dados e identificar padrões de uso.
- OutboundStreamingBytesProcessed
-
(WebSocket somente) Mostra o número total de bytes processados com sucesso em WebSocket quadros enviados dos contêineres do agente para os clientes. Monitore essa métrica para entender os padrões de resposta do agente e garantir uma transmissão de dados bem-sucedida.
Métricas e registros de uso de recursos
O Amazon Bedrock AgentCore Runtime fornece uma telemetria abrangente de uso de recursos, incluindo métricas de consumo de CPU e memória para seus recursos de tempo de execução.
nota
Os dados de uso de recursos podem ser atrasados em até 60 minutos e a precisão pode diferir entre as métricas.
Métricas vendidas
O Amazon Bedrock AgentCore Runtime fornece automaticamente métricas de uso de recursos nos níveis da conta, do tempo de execução do agente e do endpoint do agente. Essas métricas são publicadas com resolução de 1 minuto. A CloudWatch agregação e a retenção de dados métricos da Amazon seguirão as políticas padrão de retenção de CloudWatch dados da Amazon. Para obter mais informações, consulte https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/cloudwatch_concepts.html #Metric.
Aqui estão os conjuntos de dimensões e as métricas disponíveis para monitorar seus recursos:
| Nome | Dimensões | Description |
|---|---|---|
|
CPUUsed-vCPUHours |
Serviço; Serviço, Recurso; Serviço, Recurso, Nome |
A quantidade total de CPU virtual consumida em CPU-Hours unidades v, disponível nos níveis de recursos e contas. Útil para rastreamento de recursos e visibilidade estimada do faturamento. |
|
MemoryUsed-GBHours |
Serviço; Serviço, Recurso; Serviço, Recurso, Nome |
A quantidade total de memória consumida em GB-Hours unidade, disponível nos níveis de recursos e contas. Útil para rastreamento de recursos e visibilidade estimada do faturamento. |
Explicação da dimensão
-
Serviço - AgentCore.Runtime
-
Recurso - Agente Arn
-
Nome - Nome do endpoint do agente, no formato AgentName: EndpointName
As métricas em nível de conta estão disponíveis no Amazon CloudWatch Bedrock AgentCore Observability Console, na guia Runtime. O painel exibe gráficos de uso de memória e CPU gerados a partir dessas métricas, representando o uso total de recursos em todos os agentes em sua conta na região.
As métricas em nível de endpoint do agente estão disponíveis na AgentEndpoint página do Amazon CloudWatch Bedrock AgentCore Observability Console. O painel exibe gráficos de uso de memória e CPU gerados a partir dessas métricas, representando o uso total de recursos em todas as sessões invocadas pelo endpoint do agente especificado.
nota
Os dados de telemetria são fornecidos para fins de monitoramento. O faturamento real é calculado com base em dados de uso medidos e pode diferir dos valores de telemetria devido ao tempo de agregação, aos processos de reconciliação e à precisão da medição. Consulte seu extrato de AWS cobrança para ver as cobranças oficiais.
Logs fornecidos
O Bedrock AgentCore Runtime fornece registros distribuídos para métricas de uso em nível de sessão com granularidade de 1 segundo. Cada registro de log contém dados de consumo de recursos, incluindo uso da CPU (agent.runtime.vcpu.hours.used) e consumo de memória (agent.runtime.memory.gb_hours.used).
Cada registro de log terá o seguinte esquema:
| Tipo de log | Campos de log | Description |
|---|---|---|
|
REGISTROS DE USO |
event_timestamp, resource_arn, service.name, cloud.provider, cloud.region, account.id, region, resource.id, session.id, agent.name, elapsed_time_seconds, agent.runtime.vcpu.hours.used, agent.runtime.memory.gb_hours.used |
Registros de uso de recursos para rastreamento de recursos em nível de sessão. |
Para habilitar o tipo de log USAGE_LOG para seus agentes, consulte Adicionar observabilidade aos seus recursos do Amazon Bedrock. AgentCore Os registros são então exibidos no destino configurado (AWS LogGroupAmazon S3 ou Amazon Kinesis Firehose) conforme configurado.
Na página Agent Session do Amazon CloudWatch Bedrock AgentCore Observability Console, você pode ver as métricas de uso de recursos geradas a partir desses registros. Para otimizar sua experiência de visualização de métricas, selecione o intervalo de tempo desejado usando o seletor no canto superior direito para se concentrar em dados específicos de uso da CPU e da memória.
nota
Os dados de telemetria são fornecidos para fins de monitoramento. O faturamento real é calculado com base em dados de uso medidos e pode diferir dos valores de telemetria devido ao tempo de agregação, aos processos de reconciliação e à precisão da medição. Consulte seu extrato de AWS cobrança para ver as cobranças oficiais.
Dados de abrangência fornecidos
Para melhorar a observabilidade, AgentCore fornece extensões estruturadas que fornecem visibilidade das invocações de tempo de execução do agente. Para habilitar esses dados de abrangência, você precisa ativar a observabilidade em seu recurso de agente. Consulte Adicionar observabilidade aos seus AgentCore recursos do Amazon Bedrock para obter etapas e detalhes. Esses dados de abrangência estão disponíveis no Amazon CloudWatch Logs. Os intervalos aparecem no grupo de registros do agente (/aws/bedrock-agentcore/runtimes/<agent_id>-<endpoint_name>) ou no grupo de aws/spans registros para agentes que usam o destino de períodos compartilhados. Para obter mais informações, consulte Destino de Span para agentes hospedados no tempo de AgentCore execução do Amazon Bedrock. A tabela a seguir define a operação para a qual os períodos são criados e os atributos de cada período capturado.
| Nome da operação | Atributos de extensão | Description |
|---|---|---|
|
InvokeAgentRuntime |
aws.operation.name, aws.resource.arn, aws.request_id, aws.agent.id, aws.endpoint.name, aws.account.id, session.id, latency_ms, error_type, aws.resource.type, aws.xray.origin, aws.region |
Invoca o tempo de execução do agente. |
-
aws.operation.name - o nome da operação () InvokeAgentRuntime
-
aws.resource.arn - o nome do recurso Amazon para o tempo de execução do agente
-
aws.request_id - ID de solicitação para a invocação
-
aws.agent.id - o identificador exclusivo para o tempo de execução do agente
-
aws.endpoint.name - o nome do endpoint usado para invocar o tempo de execução do agente
-
aws.account.id - ID da conta do cliente
-
session.id - o ID da sessão para a invocação
-
latency_ms - a latência da solicitação em milissegundos
-
error_type - acelerador, sistema ou usuário (presente somente em caso de erro)
-
aws.resource.type - o tipo de recurso CFN
-
aws.xray.origin - o tipo de recurso CFN usado pelo x-ray para identificar o serviço
-
aws.region - a região em que o recurso do cliente existe
Dados de registro do aplicativo
AgentCore fornece registros estruturados de aplicativos que ajudam você a obter visibilidade das invocações do tempo de execução do agente e do consumo de recursos no nível da sessão. Esses dados de registro são fornecidos ao ativar a observabilidade em seu recurso de agente. Consulte Adicionar observabilidade aos seus AgentCore recursos do Amazon Bedrock para obter etapas e detalhes. AgentCore pode enviar registros para CloudWatch Logs, Amazon S3 ou Firehose stream. Se você usa um destino de CloudWatch registros, esses registros são armazenados nos registros do aplicativo do seu agente ou em seu próprio grupo de registros personalizado.
| Tipo de log | Campos de log | Description |
|---|---|---|
|
LOGS DE APLICATIVOS |
timestamp, resource_arn, event_timestamp, account_id, request_id, session_id, trace_id, span_id, service_name, operação, request_payload, response_payload |
Registros de aplicativos InvokeRuntimeOperation com campos de rastreamento, cargas úteis de solicitação e resposta |
-
request_payload - a carga útil da solicitação da invocação do agente
-
response_payload - a resposta da invocação do agente
Tipos de erro
A lista a seguir define os tipos de erro possíveis para erros de usuário, sistema e limitação.
Códigos de erro do usuário
-
InvocationError.Validation- O cliente forneceu uma entrada inválida (400) -
InvocationError.ResourceNotFound- O recurso solicitado não existe (404) -
InvocationError.AccessDenied- O cliente não tem permissões (403) -
InvocationError.Conflict- Conflito de recursos (409)
Códigos de erro do sistema
-
InvocationError.Internal- Erro interno do servidor (500)
Códigos de erro de limitação
-
InvocationError.Throttling- Limitação de taxa (429) -
InvocationError.ServiceQuota- Service-side quota/limit alcançado (402)