View a markdown version of this page

AgentCore insights: Faça a triagem de falhas de agentes com análise de padrões - Base da Amazônia AgentCore

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

AgentCore insights: Faça a triagem de falhas de agentes com análise de padrões

nota

AgentCore os insights estão em pré-visualização pública. Os recursos e as APIs podem mudar antes da disponibilidade geral.

nota

Ao usar AgentCore insights no ap-south-1, o serviço usa perfis de inferência entre regiões da Bedrock APAC. Ao usar AgentCore insights no ap-northeast-2, o serviço usa perfis globais de inferência entre regiões da Bedrock. Em ambos os casos, sua solicitação pode ser encaminhada para qualquer uma das regiões de destino no perfil. Esse roteamento pode ocorrer mesmo que você não tenha optado por essas regiões ou tenha políticas de controle de serviços que neguem explicitamente a inferência nelas. As solicitações de entrada e os resultados de saída podem ser armazenados nessas regiões de destino para fins de detecção de abuso.

O Amazon Bedrock AgentCore Insights analisa as sessões do seu agente para identificar padrões de falha, extrair as intenções do usuário e resumir o comportamento de execução. O Insights amplia AgentCore as avaliações fornecendo uma análise de triagem que vai além da pontuação — ela mostra por que seu agente falha e o que seus usuários estão tentando realizar.

AgentCore o insights fornece três tipos de análise:

  • Análise de falhas: identifica falhas nas sessões do agente, as categoriza usando uma taxonomia detalhada (erros de ferramentas, alucinações, raciocínio incorreto, comportamento repetitivo e muito mais), rastreia as causas básicas em períodos específicos e fornece recomendações de correção.

  • Extração da intenção do usuário: extrai o que os usuários estavam tentando realizar em cada sessão e, em seguida, agrupa intenções semelhantes para mostrar os casos de uso mais comuns que seu agente trata.

  • Resumo da execução: resume a abordagem adotada pelo agente e o resultado de cada sessão, depois agrupa padrões de execução semelhantes para revelar como seu agente normalmente resolve problemas.

Após a análise por sessão, os resultados dos clusters de serviços em todas as sessões revelam padrões recorrentes. Para análise de falhas, isso produz uma hierarquia de três níveis: categorias de falha → subcategorias → clusters de causa raiz, cada um com sessões afetadas, explicações e recomendações de remediação.

Como os insights são acionados

A análise de insights pode ser acionada de duas maneiras:

  • Uma vez por meio de avaliação em lote: ligue StartBatchEvaluation insights para executar a análise em um intervalo de tempo de sessões. Os resultados são retornados por meio deGetBatchEvaluation.

  • Programação recorrente por meio de agrupamento: configure uma ClusteringConfig em sua configuração de avaliação on-line com uma ou mais frequências (DAILY,WEEKLY, ou). MONTHLY O serviço aciona automaticamente os trabalhos de avaliação em lote na cadência configurada. Você também pode criar um relatório personalizado na agenda recorrente para fixar em uma data e hora específicas.

Per-session a análise de insights é executada automaticamente quando os insights são configurados via CreateOnlineEvaluationConfig, mas os resultados agrupados de que os padrões de superfície são gerados somente durante trabalhos de avaliação em lote.

Da triagem à otimização

AgentCore os insights trabalham em conjunto com a AgentCore otimização para fechar o ciclo de melhoria. Depois que os insights identificarem os padrões de falha e as causas principais, você poderá inserir essas descobertas na API Recommendations para gerar um prompt de sistema aprimorado que resolva os problemas da triagem. Isso transforma a saída de diagnóstico em mudanças de configuração acionáveis:

  1. Triagem: execute insights para identificar categorias de falhas recorrentes e causas básicas.

  2. Gere recomendação: ligue StartRecommendation com o prompt atual do sistema e aponte para os mesmos rastreamentos do agente. O serviço produz um aviso recomendado do sistema com uma explicação do que ele mudou.

  3. Validar: use A/B testes para comparar as configurações originais e recomendadas com o tráfego ao vivo.