AgentCore données d'observabilité d'exécution générées
Les métriques d'exécution fournies par vous AgentCore donnent une visibilité sur les niveaux d'activité d'exécution de vos agents, la latence de traitement, l'utilisation des ressources et les taux d'erreur. AgentCore fournit également des statistiques agrégées pour le nombre total d'invocations et de sessions.
Rubriques
Mesures d'observabilité et d'exécution
La liste suivante décrit les métriques d'exécution fournies par AgentCore. Les mesures d'exécution sont regroupées par lots à intervalles d'une minute. Pour en savoir plus sur l'affichage des métriques d'exécution, consultez Afficher les données d'observabilité de vos agents Amazon Bedrock AgentCore .
- Invocations
-
Indique le nombre total de demandes adressées à l'API Data Plane. Chaque appel d'API compte comme un appel, quels que soient la taille de la charge utile de la demande ou le statut de la réponse.
- Invocations (agrégées)
-
Affiche le nombre total d'appels pour toutes les ressources
- Throttles
-
Affiche le nombre de demandes limitées par le service en raison du dépassement des limites de TPS (transactions par seconde) ou de quotas autorisés. Ces demandes sont renvoyées ThrottlingException avec le code d'état HTTP 429. Surveillez cette métrique pour déterminer si vous devez revoir vos quotas de service ou optimiser les modèles de demandes.
- Erreurs du système
-
Indique le nombre d'erreurs côté serveur rencontrées AgentCore lors du traitement des demandes. Un nombre élevé d’erreurs côté serveur peut indiquer des problèmes potentiels d’infrastructure ou de service qui nécessitent une enquête. Consultez la section Types d'erreur pour obtenir la liste des codes d'erreur possibles.
- Erreurs de l'utilisateur
-
Représente le nombre d'erreurs côté client résultant de demandes non valides. Ces problèmes nécessitent une action de l'utilisateur pour les résoudre. Des niveaux élevés d'erreurs côté client peuvent indiquer des problèmes de formatage des demandes ou d'autorisations qui doivent être résolus. Consultez la section Types d'erreur pour obtenir la liste des codes d'erreur possibles.
- Latence
-
Le temps total écoulé entre la réception de la demande et l'envoi du jeton de réponse final. Représente le temps de traitement complet de bout en bout de la demande.
- Total Errors (Nombre total d'erreurs)
-
Le nombre total d'erreurs du système et de l'utilisateur. Dans la AgentCore console Amazon Bedrock, cette métrique affiche le nombre d'erreurs sous forme de pourcentage du nombre total d'appels.
- Nombre de sessions
-
Indique le nombre de nouvelles sessions d'agent créées au cours de la période de référence. Chaque session est comptée une fois au moment de sa création ; les appels ultérieurs à la même session n'incrémentent pas cette métrique. Il s'agit d'un compteur cumulatif et non d'un indicateur des sessions actuellement actives. Utile pour surveiller l'utilisation globale de la plateforme, suivre les tendances des taux de création de sessions et comprendre les modèles d'engagement des utilisateurs.
- Sessions (agrégées)
-
Indique le nombre total de nouvelles sessions créées pour toutes les ressources au cours de la période de référence.
- ActiveSessionCount
-
Indique le nombre de sessions actuellement actives pour votre compte. Contrairement à la
SessionCountmétrique (un compteur cumulatif), cette métrique est une jauge en temps réel indiquant le nombre de sessions en cours à un moment donné. Amazon Bedrock AgentCore publie cette statistique une fois par minute par type de service. Utilisez-le pour surveiller l'utilisation actuelle de la capacité, définir des alarmes en cas de pics d'utilisation inattendus et comprendre votre consommation de quotas de session. Utilisez laServicedimension (avec des valeursAgentCore.RuntimeAgentCore.CodeInterpreter, ouAgentCore.Browser) pour filtrer cette métrique par type de charge de travail. Amazon Bedrock AgentCore publie cette métrique directement sur votre AWS compte dans l'espace deAWS/Bedrock-AgentCorenoms. - ActiveStreamingConnections
-
(WebSocket uniquement) Indique le nombre actuel de WebSocket connexions actives par agent. Surveillez cette métrique pour comprendre l'utilisation des connexions et détecter les interruptions ou les pics de connexion à des fins de planification des capacités. La seule statistique significative est une somme d'une minute.
- InboundStreamingBytesProcessed
-
(WebSocket uniquement) Affiche le nombre total d'octets traités avec succès dans les WebSocket trames reçues des clients vers les conteneurs d'agents. Utilisez cette métrique pour surveiller le débit de données et identifier les modèles d'utilisation.
- OutboundStreamingBytesProcessed
-
(WebSocket uniquement) Affiche le nombre total d'octets traités avec succès dans les WebSocket trames envoyées depuis les conteneurs d'agents aux clients. Surveillez cette métrique pour comprendre les modèles de réponse des agents et garantir une transmission de données réussie.
Statistiques et journaux d'utilisation des ressources
Amazon Bedrock AgentCore Runtime fournit une télémétrie complète de l'utilisation des ressources, y compris des mesures de consommation de processeur et de mémoire pour vos ressources d'exécution.
Note
Les données d'utilisation des ressources peuvent être retardées de 60 minutes au maximum et la précision peut varier selon les indicateurs.
Métriques vendues
Amazon Bedrock AgentCore Runtime fournit automatiquement des statistiques d'utilisation des ressources au niveau du compte, du temps d'exécution de l'agent et du point de terminaison de l'agent. Ces statistiques sont publiées à une résolution d'une minute. CloudWatch L'agrégation et la conservation des données métriques d'Amazon seront conformes aux politiques de conservation CloudWatch des données standard d'Amazon. Pour plus d'informations, consultez https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/cloudwatch_concepts.html#Metric.
Voici les ensembles de dimensions et les indicateurs disponibles pour surveiller vos ressources :
| Nom | Dimensions | Description |
|---|---|---|
|
CPUUsed-vCPUHours |
Service ; Service, ressource ; Service, ressource, nom |
La quantité totale de CPU virtuelle consommée par CPU-Hours unité v, disponible au niveau des ressources et du compte. Utile pour le suivi des ressources et la visibilité estimée de la facturation. |
|
MemoryUsed-GBHours |
Service ; Service, ressource ; Service, ressource, nom |
Quantité totale de mémoire consommée par GB-Hours unité, disponible au niveau des ressources et du compte. Utile pour le suivi des ressources et la visibilité estimée de la facturation. |
Explication des dimensions
-
Service - AgentCore.Runtime
-
Ressource - Agent Arn
-
Nom : nom du point de terminaison de l'agent, au format AgentName : EndpointName
Les statistiques au niveau du compte sont disponibles dans la console d' AgentCore observabilité Amazon CloudWatch Bedrock sous l'onglet Runtime. Le tableau de bord affiche les graphiques d'utilisation de la mémoire et du processeur générés à partir de ces indicateurs, représentant l'utilisation totale des ressources par tous les agents de votre compte dans la région.
Les métriques au niveau du point de terminaison de l'agent sont disponibles AgentEndpoint sur la page de la console d' AgentCore observabilité Amazon CloudWatch Bedrock. Le tableau de bord affiche les graphiques d'utilisation de la mémoire et du processeur générés à partir de ces mesures, représentant l'utilisation totale des ressources sur toutes les sessions invoquées par le point de terminaison de l'agent spécifié.
Note
Les données de télémétrie sont fournies à des fins de surveillance. La facturation réelle est calculée sur la base des données d'utilisation mesurées et peut différer des valeurs de télémétrie en raison du calendrier d'agrégation, des processus de rapprochement et de la précision des mesures. Reportez-vous à votre relevé AWS de facturation pour connaître les frais autorisés.
Journaux vended
Bedrock AgentCore Runtime fournit des journaux automatiques pour les mesures d'utilisation au niveau de la session avec une granularité d'une seconde. Chaque enregistrement de journal contient des données de consommation de ressources, notamment l'utilisation du processeur (agent.runtime.vcpu.hours.used) et la consommation de mémoire (agent.runtime.memory.gb_hours.used).
Chaque enregistrement de journal aura le schéma suivant :
| Type de journal | Champs de journal | Description |
|---|---|---|
|
JOURNAUX D'UTILISATION |
event_timestamp, resource_arn, service.name, cloud.provider, cloud.region, account.id, region, resource.id, session.id, agent.name, elapsed_time_seconds, agent.runtime.vcpu.hours.used, agent.runtime.memory.gb_hours.used |
Journaux d'utilisation des ressources pour le suivi des ressources au niveau des sessions. |
Pour activer le type de journal USAGE_LOG pour vos agents, consultez Ajouter de l'observabilité à vos ressources Amazon Bedrock. AgentCore Les journaux sont ensuite affichés dans la destination configurée (AWS LogGroupAmazon S3 ou Amazon Kinesis Firehose) telle que configurée.
Sur la page de session d'agent de la console d' AgentCore observabilité Amazon CloudWatch Bedrock, vous pouvez consulter les statistiques d'utilisation des ressources générées à partir de ces journaux. Pour optimiser votre expérience d'affichage des métriques, sélectionnez la plage de temps souhaitée à l'aide du sélecteur en haut à droite pour vous concentrer sur des données spécifiques relatives à l'utilisation du processeur et de la mémoire.
Note
Les données de télémétrie sont fournies à des fins de surveillance. La facturation réelle est calculée sur la base des données d'utilisation mesurées et peut différer des valeurs de télémétrie en raison du calendrier d'agrégation, des processus de rapprochement et de la précision des mesures. Reportez-vous à votre relevé AWS de facturation pour connaître les frais autorisés.
Données d'envergure fournies
Pour améliorer l'observabilité, AgentCore fournit des plages structurées qui fournissent une visibilité sur les invocations d'exécution des agents. Pour activer ces données d'intervalle, vous devez activer l'observabilité sur les ressources de votre agent. Consultez Ajouter de l'observabilité à vos AgentCore ressources Amazon Bedrock pour connaître les étapes et les détails. Ces données d'intervalle sont disponibles dans Amazon CloudWatch Logs. Les intervalles apparaissent dans le groupe de journaux de l'agent (/aws/bedrock-agentcore/runtimes/<agent_id>-<endpoint_name>) ou dans le groupe de aws/spans journaux pour les agents qui utilisent la destination d'intervalle partagée. Pour plus d'informations, consultez Span destination pour les agents hébergés dans Amazon Bedrock AgentCore Runtime. Le tableau suivant définit l'opération pour laquelle les intervalles sont créés et les attributs de chaque intervalle capturé.
| Nom de l’opération | Attributs d'envergure | Description |
|---|---|---|
|
InvokeAgentRuntime |
aws.operation.name, aws.resource.arn, aws.request_id, aws.agent.id, aws.endpoint.name, aws.account.id, session.id, latency_ms, error_type, aws.resource.type, aws.xray.origin, aws.region |
Invoque le runtime de l'agent. |
-
aws.operation.name - le nom de l'opération () InvokeAgentRuntime
-
aws.resource.arn : nom de la ressource Amazon pour le runtime de l'agent
-
aws.request_id - ID de demande pour l'invocation
-
aws.agent.id : identifiant unique pour le runtime de l'agent
-
aws.endpoint.name : nom du point de terminaison utilisé pour appeler le runtime de l'agent
-
aws.account.id : identifiant du compte du client
-
session.id - l'ID de session pour l'invocation
-
latency_ms - la latence de la demande en millisecondes
-
error_type : accélérateur, système ou utilisateur (présent uniquement en cas d'erreur)
-
aws.resource.type - le type de ressource CFN
-
aws.xray.origin : type de ressource CFN utilisé par x-ray pour identifier le service
-
aws.region - la région dans laquelle se trouve la ressource client
Données du journal des applications
AgentCore fournit des journaux d'applications structurés qui vous aident à obtenir une meilleure visibilité sur les appels d'exécution de vos agents et sur la consommation de ressources au niveau de la session. Ces données de journal sont fournies lorsque vous activez l'observabilité sur les ressources de votre agent. Consultez Ajouter de l'observabilité à vos AgentCore ressources Amazon Bedrock pour connaître les étapes et les détails. AgentCore peut générer des CloudWatch journaux vers Logs, Amazon S3 ou Firehose Stream. Si vous utilisez une destination CloudWatch Logs, ces journaux sont stockés dans les journaux d'application de votre agent ou dans votre propre groupe de journaux personnalisé.
| Type de journal | Champs de journal | Description |
|---|---|---|
|
JOURNAUX D'APPLICATIONS |
timestamp, resource_arn, event_timestamp, account_id, request_id, session_id, trace_id, span_id, service_name, operation, request_payload, response_payload |
Journaux d'application pour InvokeRuntimeOperation les champs de suivi, les charges utiles des demandes et des réponses |
-
request_payload - la charge utile de la demande d'invocation de l'agent
-
response_payload - la réponse à l'appel de l'agent
Types d’erreurs
La liste suivante définit les types d'erreur possibles pour les erreurs utilisateur, système et de régulation.
Codes d'erreur utilisateur
-
InvocationError.Validation- Le client a fourni une entrée non valide (400) -
InvocationError.ResourceNotFound- La ressource demandée n'existe pas (404) -
InvocationError.AccessDenied- Le client n'a pas les autorisations nécessaires (403) -
InvocationError.Conflict- Conflit lié aux ressources (409)
Codes d'erreur du système
-
InvocationError.Internal- Erreur interne du serveur (500)
Codes d'erreur de limitation
-
InvocationError.Throttling- Limitation de débit (429) -
InvocationError.ServiceQuota- Service-side quota/limit atteint (402)