AgentCore dados de observabilidade do gateway gerados
As seções a seguir descrevem as métricas, os registros e os intervalos do gateway gerados pela AgentCore Amazon CloudWatch. Essas métricas não estão disponíveis na página CloudWatch generativa de observabilidade da IA. As métricas do gateway são agrupadas em intervalos de um minuto. Para saber mais sobre a visualização das métricas do gateway, consulte Visualizar dados de observabilidade para seus agentes do Amazon Bedrock AgentCore .
nota
Para habilitar os registros fornecidos pelo serviço para AgentCore gateways, você precisa configurar os recursos necessários. CloudWatch Consulte Habilitando a observabilidade para AgentCore tempo de execução, memória, gateway, ferramentas integradas e recursos de identidade para saber mais.
Métricas fornecidas
O Gateway publica métricas de invocação e uso no. CloudWatch Você pode visualizar essas métricas e também configurar alarmes para alertá-lo quando determinadas métricas excederem os limites. Para saber mais, selecione um tópico:
Tópicos
Métricas de invocação
Essas métricas fornecem informações sobre invocações, desempenho e erros da API.
Para essas métricas, as seguintes dimensões são usadas:
-
Operação — O nome da operação da API (ex. InvokeGateway).
-
Protocolo — O nome do protocolo (ex. MCP).
-
Método — Representa a operação MCP que está sendo invocada (ex. tools/list).
-
Recurso — Representa o identificador do recurso (por exemplo, ARN do gateway).
-
Nome — Representa o nome da ferramenta.
| Métrica | Description | Statistics | Unidades |
|---|---|---|---|
|
Invocations |
O número total de solicitações feitas para cada API do Data Plane. Cada chamada de API conta como uma invocação, independentemente do status da resposta. |
Soma |
Contagem |
|
Controles de utilização |
O número de solicitações limitadas (código de status 429) pelo serviço. |
Soma |
Contagem |
|
SystemErrors |
O número de solicitações que falharam com o código de status 5xx. |
Soma |
Contagem |
|
UserErrors |
O número de solicitações que falharam com o código de status 4xx, exceto 429. |
Soma |
Contagem |
|
Latência |
O tempo decorrido entre o momento em que o serviço recebe a solicitação e o momento em que ele começa a enviar o primeiro token de resposta. Em outras palavras, tempo de resposta inicial. |
Média, Mínimo, Máximo, p50, p90, p99 |
Milissegundos |
|
Duração |
O tempo total decorrido entre o recebimento da solicitação e o envio do token de resposta final. Representa o tempo completo de processamento de ponta a ponta da solicitação. |
Média, Mínimo, Máximo, p50, p90, p99 |
Milissegundos |
|
TargetExecutionTime |
O tempo total necessário para executar o alvo em Lambda/OpenAPI/ etc. Isso ajuda a determinar a contribuição do alvo para a latência total. |
Média, Mínimo, Máximo, p50, p90, p99 |
Milissegundos |
Métricas de uso
Essas métricas fornecem informações sobre como seu gateway está sendo usado.
| Métrica | Description | Statistics | Unidades |
|---|---|---|---|
|
TargetType |
O número total de solicitações atendidas por cada tipo de destino (MCP, Lambda, OpenAPI). |
Soma |
Contagem |
Veja as CloudWatch métricas do gateway
Para obter mais informações sobre CloudWatch métricas de visualização, consulte Visualizar métricas disponíveis no Guia CloudWatch do usuário da Amazon. O procedimento a seguir mostra como visualizar as métricas dos seus gateways:
Para visualizar as métricas do gateway no console
-
Abra o CloudWatch console em https://console.aws.amazon.com/cloudwatch/
. -
No painel de navegação esquerdo, escolha Todas as métricas na seção Métricas.
-
Em Procurar, no menu suspenso que exibe a AWS região atual, selecione a região para a qual você deseja métricas.
-
Selecione o namespace AWS/Bedrock-AgentCore.
-
Escolha uma dimensão (ex. Operação) ou combinação de dimensões (ex. Método, operação, protocolo) para visualizar as métricas para isso.
-
Para adicionar uma métrica ao CloudWatch gráfico, marque a caixa de seleção ao lado dela.
Configurando CloudWatch alarmes
Você pode usar a operação da PutMetricAlarmAPI para configurar CloudWatch alarmes para alertá-lo quando determinadas métricas excederem os limites. Por exemplo, talvez você queira ser notificado quando a taxa de erro exceder 5% ou quando a latência exceder 1 segundo.
O exemplo a seguir mostra como criar um alarme para altas taxas de erro usando a AWS CLI:
aws cloudwatch put-metric-alarm \ --alarm-name "HighErrorRate" \ --alarm-description "Alarm when error rate exceeds 5%" \ --metric-name "SystemErrors" \ --namespace "AWS/Bedrock-AgentCore" \ --statistic "Sum" \ --dimensions "Name=Resource,Value=my-gateway-arn" \ --period 300 \ --evaluation-periods 1 \ --threshold 5 \ --comparison-operator "GreaterThanThreshold" \ --alarm-actions "arn:aws:sns:us-west-2:123456789012:my-topic"
Esse alarme será acionado quando o número de erros do sistema exceder 5 em um período de 5 minutos. Quando o alarme for acionado, ele enviará uma notificação para o tópico SNS especificado.
Dados de registro fornecidos
AgentCore fornece registros que ajudam você a monitorar e solucionar os principais processos de recursos do AgentCore gateway. Para habilitar esses dados de log, você precisa criar um destino de log.
AgentCore pode gerar registros para o CloudWatch fluxo Logs, Amazon S3 ou Firehose. Se você usa um destino de CloudWatch registros, esses registros são armazenados no grupo de registros padrão /aws/vendedlogs/bedrock-agentcore/gateway/APPLICATION_LOGS/{gateway_id} ou em um grupo de registros personalizado começando com/aws/vendedlogs/. Consulte Habilitando a observabilidade para AgentCore tempo de execução, memória, gateway, ferramentas integradas e recursos de identidade para saber mais.
AgentCore registra as seguintes informações para os recursos do gateway:
-
Início e conclusão do processamento de solicitações de gateway
-
Mensagens de erro para configurações do Target
-
Solicitações MCP com cabeçalhos de autorização ausentes ou incorretos
-
Solicitações MCP com parâmetros de solicitação incorretos (ferramentas, método)
Você também pode ver os corpos de solicitação e resposta como parte da integração do Vended Logs quando qualquer uma das operações de MCP é executada no Gateway. Eles podem fazer análises adicionais nesses registros, usando os trace_id campos span_id e para conectar os vãos vendidos e os troncos que estão sendo emitidos. Para obter mais informações sobre como criptografar seus gateways com chaves KMS gerenciadas pelo cliente, consulte Recursos e tópicos avançados do Amazon Bedrock Gateway. AgentCore
Log de amostra:
{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370851622, "body": { "isError": false, "log": "Started processing request with requestId: 1", "requestBody": "{id=1, jsonrpc=2.0, method=tools/call, params={name=target-quick-start-f9scus___LocationTool, arguments={location=seattle}}}", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }
Registro de amostra com corpo de resposta:
{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370853807, "body": { "isError": false, "responseBody": "{jsonrpc=2.0, id=1, result={isError=false, content=[{type=text, text=\"good\"}]}}", "log": "Successfully processed request with requestId: 2", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }
Vãos fornecidos
AgentCore suporta extensões vendidas compatíveis com OTEL que você pode usar para rastrear invocações em diferentes primitivas que estão sendo usadas.
Exemplos de extensões vendidas para invocação de ferramentas:
-
kind:SERVER- rastreia os detalhes gerais da execução, a ferramenta invocada, os detalhes do gateway, o ID da AWS solicitação, o ID de rastreamento e extensão. -
kind:CLIENT- abrange o alvo específico que foi invocado e os detalhes sobre ele, como tipo de alvo, tempo de execução alvo, horários de início e término da execução alvo, etc.
Para outras invocações do método MCP, somente o kind:SERVER intervalo é emitido.
Embora esses intervalos emitam métricas, para investigar por que uma falha ocorreu em um período específico, um usuário do Gateway deve verificar os registros que são vendidos. Vários campos, por exemplo, spanId aws.request.id podem ajudar a unir esses vãos e troncos.
| Operation | Atributos de amplitude | Description |
|---|---|---|
|
Ferramentas de lista |
aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overpath head_latency_ms |
Listar ferramentas anexadas a um gateway |
|
Ferramenta de chamada |
aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overpath head_latency_ms, nome da ferramenta |
Ligue para uma ferramenta específica. Dois intervalos são emitidos: 1. |
|
Ferramentas de pesquisa |
aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overpath head_latency_ms, nome da ferramenta |
Pesquise as dez ferramentas mais relevantes com base em uma consulta de entrada |