Funcionamiento
Amazon Bedrock AgentCore Evaluations ofrece capacidades para evaluar el desempeño de los agentes de IA. Puede calcular métricas como la exactitud de un agente al completar una tarea completa (logro de un objetivo), la precisión de una herramienta utilizada por el agente al gestionar una solicitud de un usuario y cualquier métrica personalizada que se haya definido para evaluar dimensiones específicas del comportamiento de un agente. Las AgentCore evaluaciones pueden evaluar los agentes de IA que están alojados en AgentCore Runtime, así como los agentes de IA alojados fuera de Runtime. AgentCore
Puede crear y gestionar la evaluación o los recursos relevantes mediante la AgentCore CLI, el SDK de AgentCore Python, la consola de AWS administración o directamente a través de AWS los SDK.