View a markdown version of this page

Liste de contrôle pour une utilisation à grande échelle - AWS Batch

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Liste de contrôle pour une utilisation à grande échelle

Avant d'exécuter une charge de travail importante sur 50 000 vCPU ou plus, tenez compte de la liste de contrôle suivante.

Note

Si vous envisagez d'exécuter une charge de travail importante sur un million de vCPU ou plus ou si vous avez besoin de conseils pour exécuter une charge de travail à grande échelle, contactez votre AWS équipe.

  • Vérifiez vos quotas Amazon EC2 — Vérifiez vos quotas Amazon EC2 (également appelés limites) dans le panneau Quotas de service du. Console de gestion AWS Si nécessaire, demandez une augmentation de quota pour votre nombre maximal d'instances Amazon EC2. N'oubliez pas que les On-Demand instances Amazon EC2 Spot et Amazon ont des quotas distincts. Pour plus d'informations, voir Commencer à utiliser les quotas de service.

  • Vérifiez votre quota Amazon Elastic Block Store pour chaque région  : chaque instance utilise un volume GP2 ou GP3 pour le système d'exploitation. Par défaut, le quota pour chacun Région AWS est de 300 TiB. Cependant, chaque instance utilise des comptes dans le cadre de ce quota. Veillez donc à en tenir compte lorsque vous vérifiez votre quota Amazon Elastic Block Store pour chaque région. Si votre quota est atteint, vous ne pouvez pas créer d'autres instances. Pour plus d'informations, consultez la section Points de terminaison et quotas Amazon Elastic Block Store

  • Utilisez Amazon S3 pour le stockage  : Amazon S3 fournit un débit élevé et permet d'éviter de deviner la quantité de stockage à provisionner en fonction du nombre de tâches et d'instances dans chaque zone de disponibilité. Pour plus d'informations, consultez Modèles de conception des meilleures pratiques : optimisation des performances d'Amazon S3.

  • Évoluez progressivement pour identifier rapidement les goulots d'étranglement  : pour une tâche exécutée sur un million de vCPU ou plus, commencez par le bas et augmentez progressivement afin de pouvoir identifier les goulots d'étranglement le plus tôt possible. Par exemple, commencez par exécuter sur 50 000 vCPU. Augmentez ensuite le nombre à 200 000 processeurs virtuels, puis à 500 000 processeurs virtuels, etc. En d'autres termes, continuez à augmenter progressivement le nombre de processeurs virtuels jusqu'à atteindre le nombre souhaité de processeurs virtuels.

  • Surveillez pour identifier rapidement les problèmes potentiels — Pour éviter les interruptions et les problèmes potentiels lors de l'exécution à grande échelle, veillez à surveiller à la fois votre application et votre architecture. Des interruptions peuvent se produire même lors de la mise à l'échelle de 1 000 à 5 000 vCPU. Vous pouvez utiliser Amazon CloudWatch Logs pour consulter les données des journaux ou utiliser CloudWatch Embedded Metrics à l'aide d'une bibliothèque cliente. Pour plus d'informations, consultez la section Référence de l'agent CloudWatch Logs et aws-embedded-metrics