View a markdown version of this page

Lista di controllo da eseguire su larga scala - AWS Batch

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Lista di controllo da eseguire su larga scala

Prima di eseguire un carico di lavoro elevato su 50mila o più vCPU, considera la seguente lista di controllo.

Nota

Se prevedi di eseguire un carico di lavoro elevato su un milione o più di vCPU o hai bisogno di assistenza per l'esecuzione su larga scala, contatta il tuo team. AWS

  • Controlla le tue quote Amazon EC2: controlla le tue quote Amazon EC2 (note anche come limiti) nel pannello Quote di servizio del. Console di gestione AWS Se necessario, richiedi un aumento della quota per il numero massimo di istanze Amazon EC2. Ricorda che le istanze Amazon EC2 Spot e Amazon hanno On-Demand quote separate. Per ulteriori informazioni, consulta Guida introduttiva a Service Quotas.

  • Verifica la tua quota di Amazon Elastic Block Store per ogni regione: ogni istanza utilizza un volume GP2 o GP3 per il sistema operativo. Per impostazione predefinita, la quota per ciascuna Regione AWS è di 300 TiB. Tuttavia, ogni istanza utilizza i conteggi come parte di questa quota. Quindi, assicurati di tenerne conto quando verifichi la quota di Amazon Elastic Block Store per ciascuna regione. Se la tua quota viene raggiunta, non puoi creare altre istanze. Per ulteriori informazioni, consulta gli endpoint e le quote di Amazon Elastic Block Store

  • Usa Amazon S3 per lo storage: Amazon S3 offre un throughput elevato e aiuta a eliminare le incertezze sulla quantità di storage da fornire in base al numero di processi e istanze in ciascuna zona di disponibilità. Per ulteriori informazioni, consulta Best practice design pattern: ottimizzazione delle prestazioni di Amazon S3.

  • Scalabilità graduale per identificare precocemente i colli di bottiglia: per un processo che viene eseguito su un milione o più di vCPU, inizia con un valore inferiore e aumenta gradualmente in modo da poter identificare precocemente i colli di bottiglia. Ad esempio, inizia eseguendo su 50.000 vCPU. Quindi, aumenta il conteggio a 200 mila vCPU, quindi a 500 mila vCPU e così via. In altre parole, continuate ad aumentare gradualmente il numero di vCPU fino a raggiungere il numero desiderato di vCPU.

  • Monitoraggio per identificare tempestivamente potenziali problemi: per evitare potenziali interruzioni e problemi durante l'esecuzione su larga scala, assicurati di monitorare sia l'applicazione che l'architettura. Potrebbero verificarsi interruzioni anche quando si passa da 1.000 a 5.000 vCPU. Puoi utilizzare Amazon CloudWatch Logs per esaminare i dati di log o utilizzare CloudWatch Embedded Metrics utilizzando una libreria client. Per ulteriori informazioni, consulta CloudWatch Logs agent reference and aws-embedded-metrics