View a markdown version of this page

Ottimizzazione delle prestazioni - Amazon Bedrock AgentCore

Ottimizzazione delle prestazioni

Per ottimizzare le prestazioni delle implementazioni Gateway, prendete in considerazione le seguenti best practice:

Ridurre al minimo la latenza degli strumenti

La latenza complessiva del gateway è in gran parte determinata dalla latenza degli strumenti sottostanti. Per ridurre al minimo la latenza:

  • Usa le funzioni Lambda nella stessa regione del gateway

  • Ottimizza le funzioni Lambda per avviamenti rapidi a freddo

  • Usa la concorrenza fornita per le funzioni Lambda che richiedono una bassa latenza

  • Assicurati che le API REST abbiano una bassa latenza e un'elevata disponibilità

Utilizza schemi di strumenti efficienti

Well-designed gli schemi di strumenti possono migliorare le prestazioni del gateway:

  • Mantieni gli schemi il più semplici possibile

  • Usa tipi di dati appropriati per i parametri

  • Includi descrizioni chiare dei parametri per aiutare gli agenti a utilizzare correttamente gli strumenti

  • Utilizzate i campi obbligatori per assicurarvi che gli agenti forniscano i parametri necessari

Abilita la ricerca semantica

La ricerca semantica aiuta gli agenti a trovare gli strumenti giusti per le loro attività, migliorando le prestazioni complessive delle interazioni agente-gateway. Abilita la ricerca semantica durante la creazione del gateway:

import boto3 # Initialize the AgentCore control client client = boto3.client('bedrock-agentcore-control', region_name="us-west-2") # Create a gateway with semantic search enabled gateway = client.create_gateway( name="semantic-search-gateway", description="A gateway with semantic search enabled", protocolConfiguration={ "mcp": { "searchType": "SEMANTIC" } } )
Monitora e ottimizza

Utilizzate le funzionalità di osservabilità descritte nella sezione precedente per monitorare le prestazioni del gateway e identificare opportunità di ottimizzazione:

  • Imposta CloudWatch allarmi per le metriche chiave

  • Analizza i log per identificare modelli e problemi

  • Esamina regolarmente le metriche delle prestazioni e apporta le modifiche necessarie