View a markdown version of this page

AgentCore approfondimenti: triage dei guasti degli agenti con analisi dei modelli - Fondamento Amazon AgentCore

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

AgentCore approfondimenti: triage dei guasti degli agenti con analisi dei modelli

Nota

AgentCore insights è in anteprima pubblica. Le funzionalità e le API possono cambiare prima della disponibilità generale.

Nota

Quando si utilizzano AgentCore approfondimenti in ap-south-1, il servizio utilizza i profili di inferenza interregionali di Bedrock APAC. Quando si utilizzano gli AgentCore approfondimenti in ap-northeast-2, il servizio utilizza i profili di inferenza interregionali globali di Bedrock. In entrambi i casi, la richiesta può essere indirizzata a una qualsiasi delle regioni di destinazione nel profilo. Questo instradamento può avvenire anche se non hai aderito a tali regioni o se le politiche di controllo del servizio negano esplicitamente l'inferenza in esse. Le richieste di input e i risultati di output possono essere archiviati in queste regioni di destinazione per scopi di rilevamento degli abusi.

Amazon Bedrock AgentCore Insights analizza le sessioni degli agenti per identificare i modelli di errore, estrarre le intenzioni degli utenti e riepilogare il comportamento di esecuzione. Insights estende AgentCore le valutazioni fornendo un'analisi di triage che va oltre la valutazione dei punteggi: ti spiega perché il tuo agente fallisce e cosa stanno cercando di ottenere i tuoi utenti.

AgentCore insights offre tre tipi di analisi:

  • Analisi degli errori: identifica i guasti nelle sessioni degli agenti, li classifica utilizzando una tassonomia dettagliata (errori degli strumenti, allucinazioni, ragionamento errato, comportamento ripetitivo e altro), riconduce le cause principali a intervalli di tempo specifici e fornisce consigli per la correzione.

  • Estrazione delle intenzioni degli utenti: estrae ciò che gli utenti stavano cercando di ottenere in ogni sessione, quindi raggruppa intenti simili per mostrarti i casi d'uso più comuni gestiti dal tuo agente.

  • Riepilogo dell'esecuzione: riassume l'approccio adottato dall'agente e il risultato di ogni sessione, quindi raggruppa modelli di esecuzione simili per mostrare come l'agente risolve in genere i problemi.

Dopo un'analisi per sessione, il servizio raggruppa i risultati tra le sessioni per far emergere schemi ricorrenti. Per l'analisi degli errori, viene creata una gerarchia a tre livelli: categorie di errore → sottocategorie → cluster delle cause principali, ciascuno con le sessioni interessate, le spiegazioni e i consigli per la correzione.

Come vengono attivati gli approfondimenti

L'analisi degli approfondimenti può essere attivata in due modi:

  • Una sola volta tramite valutazione in batch: chiama StartBatchEvaluation insights per eseguire l'analisi su un intervallo di tempo di sessioni. I risultati vengono restituiti tramiteGetBatchEvaluation.

  • Ricorrente tramite pianificazione di clustering: configura a ClusteringConfig nella tua configurazione di valutazione online con una o più frequenze (DAILY,WEEKLY, o). MONTHLY Il servizio attiva automaticamente i processi di valutazione in batch sulla cadenza configurata. È inoltre possibile creare un report personalizzato nella pianificazione ricorrente da aggiungere a una data e un'ora specifiche.

Per-session l'analisi delle informazioni viene eseguita automaticamente quando le informazioni vengono configurate tramite CreateOnlineEvaluationConfig, ma i risultati raggruppati in base ai modelli di superficie vengono generati solo durante i lavori di valutazione in batch.

Dal triage all'ottimizzazione

AgentCore insights collabora con AgentCore l'ottimizzazione per chiudere il ciclo di miglioramento. Dopo che Insights ha identificato i modelli di errore e le cause principali, puoi inserire tali risultati nell'API Recommendations per generare un prompt di sistema migliorato che risolva i problemi esaminati. Questo trasforma l'output diagnostico in modifiche alla configurazione attuabili:

  1. Triage: esegui approfondimenti per identificare le categorie di errori ricorrenti e le cause principali.

  2. Genera consigli: chiama StartRecommendation con il prompt di sistema corrente e indirizzalo verso le stesse tracce degli agenti. Il servizio genera un prompt di sistema consigliato con una spiegazione delle modifiche apportate.

  3. Convalida: utilizza A/B i test per confrontare le configurazioni originali e consigliate con il traffico in tempo reale.