Conditions préalables
Avant de procéder à des évaluations par lots, assurez-vous que les éléments suivants sont en place.
Exigences relatives aux agents
-
Un agent déployé sur AgentCore Runtime avec l'observabilité activée, ou un agent créé avec un framework compatible configuré avec AgentCore Observability. Frameworks pris en charge :
-
Agents à mèches
-
LangGraph avec
opentelemetry-instrumentation-langchainouopeninference-instrumentation-langchain
-
-
La recherche de transactions est activée dans CloudWatch (obligatoire lors de l'utilisation CloudWatch comme source de session).
-
Sessions d'agent avec données de télémétrie dans les journaux. CloudWatch Appelez votre agent et attendez 2 à 5 minutes pour CloudWatch ingérer la télémétrie avant de commencer une évaluation par lots.
AWS informations d'identification et autorisations
L'évaluation par lots s'exécute sous les informations d'identification de l'appelant. Contrairement à l'évaluation en ligne, l'évaluation par lots ne nécessite pas de rôle d'exécution de service distinct. Le service utilise votre identité IAM pour accéder aux CloudWatch journaux afin de découvrir les sessions et d'écrire les résultats d'évaluation.
AWS informations d'identification configurées avec des autorisations pour les services suivants :
-
bedrock-agentcore— pour démarrer, obtenir, répertorier, arrêter et supprimer des évaluations par lots -
logs(CloudWatch Logs) — pour lire les durées de session et écrire les résultats d'évaluation
Autorisations IAM requises
La politique IAM suivante accorde les autorisations minimales nécessaires pour exécuter des évaluations par lots :
{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Action": [ "bedrock-agentcore:StartBatchEvaluation", "bedrock-agentcore:GetBatchEvaluation", "bedrock-agentcore:ListBatchEvaluations", "bedrock-agentcore:StopBatchEvaluation", "bedrock-agentcore:DeleteBatchEvaluation" ], "Resource": "arn:aws:bedrock-agentcore:*:*:batch-evaluate/*" }, { "Sid": "ReadAgentLogs", "Effect": "Allow", "Action": [ "logs:GetLogEvents", "logs:FilterLogEvents", "logs:StartQuery", "logs:GetQueryResults" ], "Resource": [ "arn:aws:logs:*:*:log-group:/aws/bedrock-agentcore/runtimes/*", "arn:aws:logs:*:*:log-group:/aws/bedrock-agentcore/evaluations/*" ] }, { "Sid": "BedrockInvokeForCustomEvaluators", "Effect": "Allow", "Action": [ "bedrock:InvokeModel", "bedrock:InvokeModelWithResponseStream" ], "Resource": [ "arn:aws:bedrock:*::foundation-model/*", "arn:aws:bedrock:*:*:inference-profile/*" ] } ] }
Note
La BedrockInvokeForCustomEvaluators déclaration n'est requise que si vous utilisez un évaluateur personnalisé qui invoque les modèles Amazon Bedrock. Vous pouvez l'omettre lorsque vous utilisez uniquement des évaluateurs intégrés.
Exigences relatives au SDK et à la CLI
-
AWS SDK (boto3) : Python 3.10 ou version ultérieure.
-
AgentCore CLI : Exécutez
agentcore --versionpour vérifier votre version.
Note
La surface CLI d'évaluation par lots comprend les commandes suivantes :
-
agentcore run batch-evaluation— lance une évaluation par lots -
agentcore stop batch-evaluation -i <id>— arrête une évaluation par lots en cours -
agentcore view batch-evaluation [id]etagentcore batch-evaluations history— afficher une tâche ou répertorier des tâches -
agentcore archive batch-evaluation -i <id>— archiver un enregistrement des tâches d'évaluation par lots sur le service et effacer l'historique local
L'action bedrock-agentcore:DeleteBatchEvaluation IAM est soutenue par la archive batch-evaluation commande de la CLI ; il n'y a pas de verbe delete CLI littéral.