Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
AgentCore approfondimenti: triage dei guasti degli agenti con analisi dei modelli
Nota
AgentCore insights è in anteprima pubblica. Le funzionalità e le API possono cambiare prima della disponibilità generale.
Nota
Quando si utilizzano AgentCore approfondimenti in ap-south-1, il servizio utilizza i profili di inferenza interregionali di Bedrock APAC. Quando si utilizzano gli AgentCore approfondimenti in ap-northeast-2, il servizio utilizza i profili di inferenza interregionali globali di Bedrock. In entrambi i casi, la richiesta può essere indirizzata a una qualsiasi delle regioni di destinazione nel profilo. Questo instradamento può avvenire anche se non hai aderito a tali regioni o se le politiche di controllo del servizio negano esplicitamente l'inferenza in esse. Le richieste di input e i risultati di output possono essere archiviati in queste regioni di destinazione per scopi di rilevamento degli abusi.
Amazon Bedrock AgentCore Insights analizza le sessioni degli agenti per identificare i modelli di errore, estrarre le intenzioni degli utenti e riepilogare il comportamento di esecuzione. Insights estende AgentCore le valutazioni fornendo un'analisi di triage che va oltre la valutazione dei punteggi: ti spiega perché il tuo agente fallisce e cosa stanno cercando di ottenere i tuoi utenti.
AgentCore insights offre tre tipi di analisi:
-
Analisi degli errori: identifica i guasti nelle sessioni degli agenti, li classifica utilizzando una tassonomia dettagliata (errori degli strumenti, allucinazioni, ragionamento errato, comportamento ripetitivo e altro), riconduce le cause principali a intervalli di tempo specifici e fornisce consigli per la correzione.
-
Estrazione delle intenzioni degli utenti: estrae ciò che gli utenti stavano cercando di ottenere in ogni sessione, quindi raggruppa intenti simili per mostrarti i casi d'uso più comuni gestiti dal tuo agente.
-
Riepilogo dell'esecuzione: riassume l'approccio adottato dall'agente e il risultato di ogni sessione, quindi raggruppa modelli di esecuzione simili per mostrare come l'agente risolve in genere i problemi.
Dopo un'analisi per sessione, il servizio raggruppa i risultati tra le sessioni per far emergere schemi ricorrenti. Per l'analisi degli errori, viene creata una gerarchia a tre livelli: categorie di errore → sottocategorie → cluster delle cause principali, ciascuno con le sessioni interessate, le spiegazioni e i consigli per la correzione.
Come vengono attivati gli approfondimenti
L'analisi degli approfondimenti può essere attivata in due modi:
-
Una sola volta tramite valutazione in batch: chiama
StartBatchEvaluationinsightsper eseguire l'analisi su un intervallo di tempo di sessioni. I risultati vengono restituiti tramiteGetBatchEvaluation. -
Ricorrente tramite pianificazione di clustering: configura a
ClusteringConfignella tua configurazione di valutazione online con una o più frequenze (DAILY,WEEKLY, o).MONTHLYIl servizio attiva automaticamente i processi di valutazione in batch sulla cadenza configurata. È inoltre possibile creare un report personalizzato nella pianificazione ricorrente da aggiungere a una data e un'ora specifiche.
Per-session l'analisi delle informazioni viene eseguita automaticamente quando le informazioni vengono configurate tramite CreateOnlineEvaluationConfig, ma i risultati raggruppati in base ai modelli di superficie vengono generati solo durante i lavori di valutazione in batch.
Dal triage all'ottimizzazione
AgentCore insights collabora con AgentCore l'ottimizzazione per chiudere il ciclo di miglioramento. Dopo che Insights ha identificato i modelli di errore e le cause principali, puoi inserire tali risultati nell'API Recommendations per generare un prompt di sistema migliorato che risolva i problemi esaminati. Questo trasforma l'output diagnostico in modifiche alla configurazione attuabili:
-
Triage: esegui approfondimenti per identificare le categorie di errori ricorrenti e le cause principali.
-
Genera consigli: chiama
StartRecommendationcon il prompt di sistema corrente e indirizzalo verso le stesse tracce degli agenti. Il servizio genera un prompt di sistema consigliato con una spiegazione delle modifiche apportate. -
Convalida: utilizza A/B i test per confrontare le configurazioni originali e consigliate con il traffico in tempo reale.