View a markdown version of this page

AgentCore dados de observabilidade do gateway gerados - Amazon Bedrock AgentCore

AgentCore dados de observabilidade do gateway gerados

As seções a seguir descrevem as métricas, os registros e os intervalos do gateway gerados pela AgentCore Amazon CloudWatch. Essas métricas não estão disponíveis na página CloudWatch generativa de observabilidade da IA. As métricas do gateway são agrupadas em intervalos de um minuto. Para saber mais sobre a visualização das métricas do gateway, consulte Visualizar dados de observabilidade para seus agentes do Amazon Bedrock AgentCore .

nota

Para habilitar os registros fornecidos pelo serviço para AgentCore gateways, você precisa configurar os recursos necessários. CloudWatch Consulte Habilitando a observabilidade para AgentCore tempo de execução, memória, gateway, ferramentas integradas e recursos de identidade para saber mais.

Métricas fornecidas

O Gateway publica métricas de invocação e uso no. CloudWatch Você pode visualizar essas métricas e também configurar alarmes para alertá-lo quando determinadas métricas excederem os limites. Para saber mais, selecione um tópico:

Métricas de invocação

Essas métricas fornecem informações sobre invocações, desempenho e erros da API.

Para essas métricas, as seguintes dimensões são usadas:

  • Operação — O nome da operação da API (ex. InvokeGateway).

  • Protocolo — O nome do protocolo (ex. MCP).

  • Método — Representa a operação MCP que está sendo invocada (ex. tools/list).

  • Recurso — Representa o identificador do recurso (por exemplo, ARN do gateway).

  • Nome — Representa o nome da ferramenta.

Métrica Description Statistics Unidades

Invocations

O número total de solicitações feitas para cada API do Data Plane. Cada chamada de API conta como uma invocação, independentemente do status da resposta.

Soma

Contagem

Controles de utilização

O número de solicitações limitadas (código de status 429) pelo serviço.

Soma

Contagem

SystemErrors

O número de solicitações que falharam com o código de status 5xx.

Soma

Contagem

UserErrors

O número de solicitações que falharam com o código de status 4xx, exceto 429.

Soma

Contagem

Latência

O tempo decorrido entre o momento em que o serviço recebe a solicitação e o momento em que ele começa a enviar o primeiro token de resposta. Em outras palavras, tempo de resposta inicial.

Média, Mínimo, Máximo, p50, p90, p99

Milissegundos

Duração

O tempo total decorrido entre o recebimento da solicitação e o envio do token de resposta final. Representa o tempo completo de processamento de ponta a ponta da solicitação.

Média, Mínimo, Máximo, p50, p90, p99

Milissegundos

TargetExecutionTime

O tempo total necessário para executar o alvo em Lambda/OpenAPI/ etc. Isso ajuda a determinar a contribuição do alvo para a latência total.

Média, Mínimo, Máximo, p50, p90, p99

Milissegundos

Métricas de uso

Essas métricas fornecem informações sobre como seu gateway está sendo usado.

Métrica Description Statistics Unidades

TargetType

O número total de solicitações atendidas por cada tipo de destino (MCP, Lambda, OpenAPI).

Soma

Contagem

Veja as CloudWatch métricas do gateway

Para obter mais informações sobre CloudWatch métricas de visualização, consulte Visualizar métricas disponíveis no Guia CloudWatch do usuário da Amazon. O procedimento a seguir mostra como visualizar as métricas dos seus gateways:

Para visualizar as métricas do gateway no console

  1. Abra o CloudWatch console em https://console.aws.amazon.com/cloudwatch/.

  2. No painel de navegação esquerdo, escolha Todas as métricas na seção Métricas.

  3. Em Procurar, no menu suspenso que exibe a AWS região atual, selecione a região para a qual você deseja métricas.

  4. Selecione o namespace AWS/Bedrock-AgentCore.

  5. Escolha uma dimensão (ex. Operação) ou combinação de dimensões (ex. Método, operação, protocolo) para visualizar as métricas para isso.

  6. Para adicionar uma métrica ao CloudWatch gráfico, marque a caixa de seleção ao lado dela.

Configurando CloudWatch alarmes

Você pode usar a operação da PutMetricAlarmAPI para configurar CloudWatch alarmes para alertá-lo quando determinadas métricas excederem os limites. Por exemplo, talvez você queira ser notificado quando a taxa de erro exceder 5% ou quando a latência exceder 1 segundo.

O exemplo a seguir mostra como criar um alarme para altas taxas de erro usando a AWS CLI:

aws cloudwatch put-metric-alarm \ --alarm-name "HighErrorRate" \ --alarm-description "Alarm when error rate exceeds 5%" \ --metric-name "SystemErrors" \ --namespace "AWS/Bedrock-AgentCore" \ --statistic "Sum" \ --dimensions "Name=Resource,Value=my-gateway-arn" \ --period 300 \ --evaluation-periods 1 \ --threshold 5 \ --comparison-operator "GreaterThanThreshold" \ --alarm-actions "arn:aws:sns:us-west-2:123456789012:my-topic"

Esse alarme será acionado quando o número de erros do sistema exceder 5 em um período de 5 minutos. Quando o alarme for acionado, ele enviará uma notificação para o tópico SNS especificado.

Dados de registro fornecidos

AgentCore fornece registros que ajudam você a monitorar e solucionar os principais processos de recursos do AgentCore gateway. Para habilitar esses dados de log, você precisa criar um destino de log.

AgentCore pode gerar registros para o CloudWatch fluxo Logs, Amazon S3 ou Firehose. Se você usa um destino de CloudWatch registros, esses registros são armazenados no grupo de registros padrão /aws/vendedlogs/bedrock-agentcore/gateway/APPLICATION_LOGS/{gateway_id} ou em um grupo de registros personalizado começando com/aws/vendedlogs/. Consulte Habilitando a observabilidade para AgentCore tempo de execução, memória, gateway, ferramentas integradas e recursos de identidade para saber mais.

AgentCore registra as seguintes informações para os recursos do gateway:

  • Início e conclusão do processamento de solicitações de gateway

  • Mensagens de erro para configurações do Target

  • Solicitações MCP com cabeçalhos de autorização ausentes ou incorretos

  • Solicitações MCP com parâmetros de solicitação incorretos (ferramentas, método)

Você também pode ver os corpos de solicitação e resposta como parte da integração do Vended Logs quando qualquer uma das operações de MCP é executada no Gateway. Eles podem fazer análises adicionais nesses registros, usando os trace_id campos span_id e para conectar os vãos vendidos e os troncos que estão sendo emitidos. Para obter mais informações sobre como criptografar seus gateways com chaves KMS gerenciadas pelo cliente, consulte Recursos e tópicos avançados do Amazon Bedrock Gateway. AgentCore

Log de amostra:

{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370851622, "body": { "isError": false, "log": "Started processing request with requestId: 1", "requestBody": "{id=1, jsonrpc=2.0, method=tools/call, params={name=target-quick-start-f9scus___LocationTool, arguments={location=seattle}}}", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }

Registro de amostra com corpo de resposta:

{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370853807, "body": { "isError": false, "responseBody": "{jsonrpc=2.0, id=1, result={isError=false, content=[{type=text, text=\"good\"}]}}", "log": "Successfully processed request with requestId: 2", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }

Vãos fornecidos

AgentCore suporta extensões vendidas compatíveis com OTEL que você pode usar para rastrear invocações em diferentes primitivas que estão sendo usadas.

Exemplos de extensões vendidas para invocação de ferramentas:

  • kind:SERVER- rastreia os detalhes gerais da execução, a ferramenta invocada, os detalhes do gateway, o ID da AWS solicitação, o ID de rastreamento e extensão.

  • kind:CLIENT- abrange o alvo específico que foi invocado e os detalhes sobre ele, como tipo de alvo, tempo de execução alvo, horários de início e término da execução alvo, etc.

Para outras invocações do método MCP, somente o kind:SERVER intervalo é emitido.

Embora esses intervalos emitam métricas, para investigar por que uma falha ocorreu em um período específico, um usuário do Gateway deve verificar os registros que são vendidos. Vários campos, por exemplo, spanId aws.request.id podem ajudar a unir esses vãos e troncos.

Operation Atributos de amplitude Description

Ferramentas de lista

aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overpath head_latency_ms

Listar ferramentas anexadas a um gateway

Ferramenta de chamada

aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overpath head_latency_ms, nome da ferramenta

Ligue para uma ferramenta específica. Dois intervalos são emitidos: 1. kind:SERVERque rastreia os detalhes gerais da execução (sucesso ou não), ferramenta invocada, detalhes do gateway, ID da AWS solicitação, rastreamento e ID do intervalo. 2. kind:CLIENTque abrange o alvo específico que foi invocado e detalhes sobre ele, como tipo de alvo, tempo de execução do alvo, horários de início e término da execução do alvo, etc.

Ferramentas de pesquisa

aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overpath head_latency_ms, nome da ferramenta

Pesquise as dez ferramentas mais relevantes com base em uma consulta de entrada