View a markdown version of this page

Entenda a observabilidade de recursos agentes em AgentCore - Amazon Bedrock AgentCore

Entenda a observabilidade de recursos agentes em AgentCore

Esta seção define os conceitos de sessões, rastreamentos e intervalos relacionados ao monitoramento e à observabilidade dos agentes.

Sessões

Uma sessão representa um contexto completo de interação entre um usuário e um agente. As sessões encapsulam todo o fluxo de conversação ou interação, mantendo o estado e o contexto em várias trocas. Cada sessão tem um identificador exclusivo e captura todo o ciclo de vida do engajamento do usuário com o agente, da inicialização ao encerramento.

As sessões oferecem os seguintes recursos para os agentes:

  • Persistência do contexto em várias interações na mesma conversa

  • Gerenciamento de estado para manter informações específicas do usuário

  • Rastreamento do histórico de conversas para compreensão contextual

  • Alocação e gerenciamento de recursos durante a interação

  • Isolamento entre diferentes interações do usuário com o mesmo agente

Do ponto de vista da observabilidade, as sessões fornecem uma visão de alto nível dos padrões de engajamento do usuário, permitindo que você monitore o desempenho do agente em todas as métricas, rastreamentos e intervalos e entenda como os usuários interagem com seus agentes ao longo do tempo e em diferentes casos de uso.

Por padrão, AgentCore fornece um conjunto de métricas de observabilidade no nível da sessão para agentes que estão sendo executados no AgentCore tempo de execução. Você pode ver as métricas de tempo de execução no CloudWatch console da Amazon na página generativa de observabilidade da IA. Esta página oferece uma variedade de gráficos e visualizações para ajudá-lo a interpretar os dados de seus agentes. AgentCore também gera um conjunto padrão de métricas para recursos de memória, recursos de gateway e ferramentas integradas. Todas essas métricas podem ser visualizadas em CloudWatch. Além das métricas fornecidas, registros e extensões são fornecidos por padrão para recursos de memória e, ao instrumentar seu código de agente, você pode capturar métricas, registros e intervalos personalizados para seu agente, que também podem ser visualizados na página CloudWatch generativa de observabilidade da IA. Consulte as seções a seguir e veja os dados de observabilidade de seus AgentCore agentes do Amazon Bedrock para saber mais.

Rastreamentos

Um rastreamento representa um registro detalhado de um único ciclo de solicitação-resposta, começando com a invocação de um agente e pode incluir chamadas adicionais para outros agentes. Os rastreamentos capturam o caminho completo de execução de uma solicitação, incluindo todas as etapas de processamento interno, chamadas de serviço externas, pontos de decisão e utilização de recursos. Cada rastreamento é associado a uma sessão específica e fornece visibilidade granular do comportamento do agente em uma interação específica.

Os rastreamentos incluem os seguintes componentes para agentes:

  • Detalhes da solicitação, incluindo registros de data e hora, parâmetros de entrada e contexto

  • Etapas de processamento mostrando a sequência de operações realizadas

  • Invocações de ferramentas com input/output parâmetros e tempos de execução

  • Métricas de utilização de recursos, como tempo de processamento

  • Informações de erro, incluindo detalhes da exceção e tentativas de recuperação

  • Detalhes da geração de resposta e saída final

Do ponto de vista da observabilidade, os traces fornecem insights profundos sobre o funcionamento interno de seus agentes, permitindo que você solucione problemas, otimize o desempenho e compreenda os padrões de comportamento. Ao analisar os dados de rastreamento, você pode identificar gargalos, detectar anomalias e verificar se seu agente está funcionando conforme o esperado em diferentes cenários e entradas.

Para coletar dados de rastreamento, você precisa instrumentar o código do seu agente usando a AWS Distro for Open Telemetry (ADOT). Consulte Habilitando a observabilidade no código do agente para AgentCore-hosted agentes e Habilitando a observabilidade para agentes hospedados fora do AgentCore para saber mais.

Segmentos

Um intervalo representa uma unidade de trabalho discreta e mensurável dentro do fluxo de execução de um agente. Os spans capturam operações refinadas que ocorrem durante o processamento da solicitação, fornecendo visibilidade detalhada dos componentes internos e das etapas que compõem um rastreamento completo. Cada período tem um horário de início e término definido, criando um cronograma preciso das atividades do agente e suas durações.

Os intervalos incluem os seguintes atributos essenciais para a observabilidade do agente:

  • Nome da operação que identifica a função ou processo específico que está sendo executado

  • Registros de data e hora que marcam os horários exatos de início e término da operação

  • Parent-child relacionamentos que mostram como as operações se encaixam em processos maiores

  • Tags e atributos que fornecem metadados contextuais sobre a operação

  • Eventos que marcam ocorrências significativas durante a vida útil do período

  • Informações de status indicando sucesso, falha ou outros estados de conclusão

  • Métricas de utilização de recursos específicas para a operação

As extensões formam uma estrutura hierárquica dentro dos traços, com as extensões principais abrangendo as extensões secundárias que representam operações mais granulares. Por exemplo, um intervalo de “consulta do usuário de processo” de alto nível pode conter períodos secundários para “analisar entrada”, “recuperar contexto”, “gerar resposta” e “formatar saída”. Essa organização hierárquica cria uma árvore de execução detalhada que revela o fluxo completo das operações dentro do agente.

Por padrão, AgentCore gera um conjunto de dados de amplitude somente para recursos de memória. Esses dados podem ser visualizados em CloudWatch registros e sinais de CloudWatch aplicativos. Para registrar dados de amplitude para seus agentes ou recursos de gateway, você precisa instrumentar seu agente. Consulte Habilitando a observabilidade no código do agente para AgentCore-hosted agentes e Habilitando a observabilidade para agentes hospedados fora do AgentCore para saber mais.

Relação entre sessões, traços e extensões

Sessões, rastreamentos e extensões formam uma relação hierárquica de três camadas na estrutura de observabilidade para agentes. Uma sessão contém vários rastreamentos, com cada rastreamento representando uma interação discreta dentro do contexto mais amplo da sessão. Cada rastreamento, por sua vez, contém vários intervalos que capturam as operações e etapas refinadas dessa interação. Essa estrutura hierárquica permite analisar o comportamento do agente em diferentes níveis de granularidade, desde padrões de sessão de alto nível até fluxos de interação de nível médio e caminhos de execução detalhados para operações específicas.

A relação entre esses três componentes de observabilidade pode ser visualizada como:

  • Sessões (nível mais alto) - Representam conversas completas do usuário ou contextos de interação

  • Traços (nível médio) - representam ciclos individuais de solicitação-resposta em uma sessão

  • Expansões (nível mais baixo) - Representam operações ou etapas específicas em um traçado

Esse relacionamento de várias camadas permite vários recursos importantes de observabilidade:

  • Análise contextual das interações individuais dentro de seu fluxo de conversação mais amplo

  • Correlação de solicitações relacionadas em toda a jornada de interação do usuário

  • Solução de problemas progressiva, desde anomalias em nível de sessão até padrões em nível de rastreamento e causas-raiz em nível de extensão

  • Perfil de desempenho abrangente em diferentes dimensões temporais e funcionais

  • Compreensão holística dos padrões de comportamento e evolução dos agentes ao longo de uma conversa

  • Identificação precisa de gargalos de desempenho no nível da operação por meio da análise de amplitude

Embora os rastreamentos forneçam visibilidade de ciclos completos de solicitação-resposta, os spans oferecem uma visão mais profunda sobre o funcionamento interno desses ciclos. Os intervalos revelam exatamente quais operações consomem mais tempo, onde os erros se originam e como os diferentes componentes interagem em um único rastreamento. Essa granularidade é particularmente valiosa ao solucionar problemas complexos ou otimizar o desempenho em implementações sofisticadas de agentes.

Ao aproveitar os dados de sessão, rastreamento e amplitude em sua estratégia de observabilidade, você pode obter insights abrangentes sobre o comportamento, o desempenho e a eficácia do seu agente em vários níveis de detalhes. Essa abordagem de observabilidade em várias camadas oferece suporte à melhoria contínua, à solução de problemas robusta e à otimização informada das implementações de seus agentes, desde padrões de conversação de alto nível até o desempenho operacional individual.