Estruturas de agentes compatíveis
O Amazon Bedrock AgentCore Evaluations avalia agentes criados com estruturas de agentes populares. O que um agente emite como telemetria e como essa telemetria é estruturada dependem da estrutura do agente com a qual você cria e da biblioteca de instrumentação usada para registrá-la.
Para cada estrutura suportada, esta seção descreve:
-
As bibliotecas de instrumentação que você pode usar.
-
Como instrumentar seu agente.
-
Qual é a aparência dos períodos e registros de eventos resultantes.
-
Como o serviço de avaliação localiza os valores de que precisa, como o prompt do usuário, a resposta do agente e as chamadas da ferramenta.
AgentCore As avaliações oferecem suporte às seguintes estruturas e bibliotecas de instrumentação. Ele suporta somente as versões em Python dessas bibliotecas.
| Estrutura do agente | Biblioteca de instrumentação | Nome do escopo | Versão recomendada |
|---|---|---|---|
|
Strands Agents |
Built-in (SDK do Strands Agents) |
|
Mais recente |
|
LangGraph |
OpenTelemetry ( |
|
|
|
LangGraph |
OpenInference ( |
|
|
|
Agentes OpenAI |
OpenTelemetry ( |
|
|
|
Agentes OpenAI |
OpenInference ( |
|
|
|
LlamaIndex |
OpenTelemetry ( |
|
|
|
LlamaIndex |
OpenInference ( |
|
|
|
Google ADK |
OpenInference ( |
|
|
|
SDK do Claude Agent |
OpenInference ( |
|
|
O nome do escopo é o valor do scope.name campo em cada período e registro de evento. O serviço de avaliação o usa para determinar se ele pode processar um intervalo.
Como o serviço lê uma sessão
Independentemente da estrutura, o serviço de avaliação reconstrói uma sessão a partir de dois sinais de telemetria: intervalos e registros de eventos. Ele classifica cada extensão por seu tipo e, em seguida, extrai o conteúdo dela:
-
Identifique o tipo de extensão a partir dos atributos específicos da estrutura. Um intervalo pode ser um intervalo de invocação do agente (a execução do agente de nível superior), um intervalo de ferramenta de execução (uma única chamada de ferramenta) ou um intervalo de inferência (uma única chamada de modelo).
-
Extraia os valores relevantes dos atributos de cada período ou de seu registro de eventos correlacionado. Por exemplo, o prompt do usuário vem da mensagem humana (função do usuário) na entrada do agente, e a resposta do agente vem da mensagem de IA (função do assistente) na saída do agente.
Os nomes exatos dos atributos e as localizações do conteúdo diferem de acordo com a estrutura e a biblioteca de instrumentação. A página de intervalos, registros de eventos e sinais de telemetria explica a estrutura de intervalos e registros de eventos e onde o conteúdo reside. As páginas por estrutura descrevem os atributos e dados de exemplo para cada estrutura compatível.
Configurar a observabilidade
Instrumentar seu agente é uma parte da produção de telemetria que o serviço de avaliação possa ler. Antes dos trabalhos de avaliação de ponta a ponta, seu agente também deve ter a observabilidade ativada e exportar seus períodos e registros de eventos para a Amazon. CloudWatch Execute as etapas a seguir:
-
Ative a Pesquisa de CloudWatch Transações, que é um pré-requisito para avaliação. Consulte Habilitando a AgentCore observabilidade.
-
Habilite a observabilidade para seu agente, com base em onde ele está hospedado:
-
Para agentes hospedados no Amazon Bedrock AgentCore Runtime, consulte Habilitando a observabilidade no código do agente para AgentCore-hosted agentes.
-
Agentes de amostra
Os exemplos a seguir mostram agentes da Strands hospedados fora do Amazon Bedrock AgentCore Runtime, exportando telemetria para a Amazon CloudWatch com ADOT. Eles se concentram na configuração da observabilidade em vez da API de avaliação. As amostras usam Strands, mas o mesmo padrão de hospedagem e exportação de telemetria se aplica a outras estruturas suportadas, como. LangGraph
-
Amazon EKS: observabilidade para um EKS-hosted agente e um agente
Strands no Amazon EKS . -
Amazon ECS: agente Strands no Amazon ECS
. -
AWS Lambda: agente Strands em AWS Lambda
.